Cluster

Agent Engineering

Coding Agents, MCP, Kontextsysteme, Evaluation und Kontrollen für verlässliche Automatisierung.

Blogbeiträge
72
Thema
AI und Agents

Mit dem Grundlagenartikel starten

Postfach, ohne Lärm

Erhalte die nächste Feldnotiz zu AI und Agents

Eine kurze E-Mail, wenn wir veröffentlichen. Ohne Tracking-Pixel und ohne Postfachfüller.

Neu in dieser Sammlung

Türkiser Routing-Knoten mit drei Endpunkten auf dunklem Wavect-Hintergrund; eine ausgewählte Route ist hervorgehoben KI & Agenten

Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz

Ein trainiertes Qwen3-0.6B schlägt gepromptetes Haiku und Nova Lite in einer Retrieval-Routing-Studie. Entscheidend sind Messverfahren, Trainingssignal und der Nutzen im eigenen System.

Geometrischer Code-Kern mit vier Werkzeug-Knoten in geschichteten Laufzeitrahmen auf dunklem Wavect-Hintergrund KI & Agenten

OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen

Was der Managed Codex Harness ersetzt, welche Verantwortung bei dir bleibt und wie du die Startzahlen vor einer echten Migration prüfst.

Große Quelldateien werden von einem Hilfsmodell gelesen; Claude erhält nur gezielte Zusammenfassungen und übernimmt die Analyse KI & Agenten

Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen

Was Spotifys 90-Prozent-Angabe wirklich misst, welche Portal-Voraussetzungen gelten und wann ausgelagerte Lesezugriffe trotz Zusatzkosten sinnvoll sind.

Drei KI-Kollegen sind vor Browser-, Datei- und MCP-Aktionen mit einem Regel- und Audit-Gateway verbunden; die Gesprächsspeicherung ist separat dargestellt KI & Agenten

OpenBot im Check: KI-Kollegen selbst hosten

Quellenbasierte OpenBot-Bewertung: Was das Aktions-Gateway leistet, welche Standardwerte du ändern solltest und wann eigener Betrieb sinnvoller ist als ein fertiger Assistent.

Ein Background Coding Agent erhält einen Prompt, stellt einen vorbereiteten Development-Snapshot wieder her, arbeitet in einer isolierten Sandbox, verifiziert die Änderung und öffnet einen Pull Request KI & Agenten

Ramp Inspect Architektur 2026: Background Coding Agents skalieren

Wie Ramp Inspect mit Modal Sandboxes, Filesystem-Snapshots, Koordination und Verifikation arbeitet und welche Kontrollen regulierte Engineering-Teams vor dem Skalieren brauchen.

KI-Agent verbindet sich über eine standardisierte Schnittstelle mit programmierbarer Labor- und Fabrikhardware KI & Agenten

Model Hardware Standard: MHS für Physical AI im Unternehmen

Anthropics MHS für Labor und Produktion prüfen: Architektur, MHS vs MCP, Safety-Grenzen, Pilotökonomie und eine konkrete Adoptions-Checkliste.

Vollständiges Artikelverzeichnis

  1. Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz
  2. OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen
  3. Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen
  4. OpenBot im Check: KI-Kollegen selbst hosten
  5. Ramp Inspect Architektur 2026: Background Coding Agents skalieren
  6. Model Hardware Standard: MHS für Physical AI im Unternehmen
  7. Fonio AI Erfahrungen 2026: Preise, API, DSGVO & Build vs Buy
  8. Mosaic (YC S26) im Check: Shared Memory für Coding Agents
  9. Ripwire Review 2026: Repo-Kontext für KI-Agenten ohne Embeddings?
  10. Atomare Multi-Datei-Edits für KI-Coding-Agenten: die Semaprax-Lektion
  11. Wissenstransfer zwischen KI-Agenten: Einmal entdecken, günstiger skalieren
  12. claude-rotate: Ein Proxy für mehrere Claude-Max-Konten
  13. Feynman im Test: Ist der Open-Source AI Research Agent bereit für Teams?
  14. Obscura Browser im Test: Aussagen, Grenzen und Produktions-Fit
  15. Claude-Code-Designsystem: 4 Bausteine für markentreue UI
  16. ChatGPT-Login: Das Modell sieht dein Passwort nicht
  17. KI-Agenten-Harness erklärt: Die Zuverlässigkeitsschicht rund um ein LLM
  18. Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
  19. LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
  20. OpenViking im Test 2026: Ist Dateisystem-Memory produktionsreif?
  21. LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
  22. TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
  23. Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
  24. Lokalisierte URL-Slugs und hreflang: Warum wir einen englischen Slug behalten
  25. Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
  26. Graft Review 2026: Gehört die Repo-Map ins Git?
  27. Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
  28. Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
  29. DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
  30. OpenSandbox im Review: Lohnt sich Self-Hosting?
  31. Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
  32. GitHub Spec Kit im Test: Lohnt sich der Prozess?
  33. Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
  34. Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
  35. MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
  36. KI-Texte menschlicher schreiben mit Agent Skills
  37. NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
  38. Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
  39. Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
  40. Hark Handoff im Test: Der Agent, der wirklich klickt
  41. Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
  42. PII vor LLM-Prompts entfernen: Eine praktische Pipeline
  43. Agent Reach im Test: Kosten, Sicherheit und Grenzen
  44. Cloudflare Wallets für KI-Agenten: Was ist live?
  45. YC QM Agent im Test: Ist Quartermaster bereit?
  46. jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
  47. Lightpanda Browser für KI-Agenten: Praxischeck 2026
  48. Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
  49. Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
  50. Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
  51. MCP ist keine Sicherheitsgrenze: Agentendaten schützen
  52. Können KI-Agenten miteinander kommunizieren? Band-Guide
  53. LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
  54. GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
  55. Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
  56. OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
  57. Meterless im Test 2026: Ist der Context Layer produktionsreif?
  58. Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
  59. Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
  60. KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
  61. T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
  62. Open Knowledge Format (OKF): Der Unternehmensleitfaden
  63. AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
  64. Claude Fable 5.1 in Claude Code nutzen
  65. Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
  66. Der Engpass war nie Intelligenz. Es war Kontext.
  67. ChatGPT Enterprise vs. Copilot vs. eigenes RAG
  68. MCP, RAG, Agent Skills oder Custom GPTs?
  69. KI-Agent-Pilot in 30/60/90 Tagen
  70. RAG über SharePoint, Confluence, Drive: Permissions-First
  71. RAG-Production-Readiness-Checkliste für EU-Unternehmen
  72. Warum KI-Agentenprojekte abgebrochen werden