Cluster

Agent Engineering

Coding Agents, MCP, Kontextsysteme, Evaluation und Kontrollen für verlässliche Automatisierung.

Blogbeiträge
73
Thema
AI und Agents

Mit dem Grundlagenartikel starten

Postfach, ohne Lärm

Erhalte die nächste Feldnotiz zu AI und Agents

Eine kurze E-Mail, wenn wir veröffentlichen. Ohne Tracking-Pixel und ohne Postfachfüller.

Neu in dieser Sammlung

Wavect-Illustration zum Artikel über lokales Voice Cloning und MCP-Anbindung mit Voicebox KI & Agenten

Voicebox: Lokales Voice Cloning, Diktieren und MCP-Setup

Eine Stimme klonen, in Anwendungen diktieren und Agenten lokal sprechen lassen: Voicebox mit MCP- und REST-Setup, Engine-Auswahl und Prüfung der Datenflüsse.

Türkiser Routing-Knoten mit drei Endpunkten auf dunklem Wavect-Hintergrund; eine ausgewählte Route ist hervorgehoben KI & Agenten

Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz

Ein trainiertes Qwen3-0.6B schlägt gepromptetes Haiku und Nova Lite in einer Retrieval-Routing-Studie. Entscheidend sind Messverfahren, Trainingssignal und der Nutzen im eigenen System.

Geometrischer Code-Kern mit vier Werkzeug-Knoten in geschichteten Laufzeitrahmen auf dunklem Wavect-Hintergrund KI & Agenten

OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen

Was der Managed Codex Harness ersetzt, welche Verantwortung bei dir bleibt und wie du die Startzahlen vor einer echten Migration prüfst.

Große Quelldateien werden von einem Hilfsmodell gelesen; Claude erhält nur gezielte Zusammenfassungen und übernimmt die Analyse KI & Agenten

Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen

Was Spotifys 90-Prozent-Angabe wirklich misst, welche Portal-Voraussetzungen gelten und wann ausgelagerte Lesezugriffe trotz Zusatzkosten sinnvoll sind.

Drei KI-Kollegen sind vor Browser-, Datei- und MCP-Aktionen mit einem Regel- und Audit-Gateway verbunden; die Gesprächsspeicherung ist separat dargestellt KI & Agenten

OpenBot im Check: KI-Kollegen selbst hosten

Quellenbasierte OpenBot-Bewertung: Was das Aktions-Gateway leistet, welche Standardwerte du ändern solltest und wann eigener Betrieb sinnvoller ist als ein fertiger Assistent.

Ein Background Coding Agent erhält einen Prompt, stellt einen vorbereiteten Development-Snapshot wieder her, arbeitet in einer isolierten Sandbox, verifiziert die Änderung und öffnet einen Pull Request KI & Agenten

Ramp Inspect Architektur 2026: Background Coding Agents skalieren

Wie Ramp Inspect mit Modal Sandboxes, Filesystem-Snapshots, Koordination und Verifikation arbeitet und welche Kontrollen regulierte Engineering-Teams vor dem Skalieren brauchen.

Vollständiges Artikelverzeichnis

  1. Voicebox: Lokales Voice Cloning, Diktieren und MCP-Setup
  2. Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz
  3. OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen
  4. Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen
  5. OpenBot im Check: KI-Kollegen selbst hosten
  6. Ramp Inspect Architektur 2026: Background Coding Agents skalieren
  7. Model Hardware Standard: MHS für Physical AI im Unternehmen
  8. Fonio AI Erfahrungen 2026: Preise, API, DSGVO & Build vs Buy
  9. Mosaic (YC S26) im Check: Shared Memory für Coding Agents
  10. Ripwire Review 2026: Repo-Kontext für KI-Agenten ohne Embeddings?
  11. Atomare Multi-Datei-Edits für KI-Coding-Agenten: die Semaprax-Lektion
  12. Wissenstransfer zwischen KI-Agenten: Einmal entdecken, günstiger skalieren
  13. claude-rotate: Ein Proxy für mehrere Claude-Max-Konten
  14. Feynman im Test: Ist der Open-Source AI Research Agent bereit für Teams?
  15. Obscura Browser im Test: Aussagen, Grenzen und Produktions-Fit
  16. Claude-Code-Designsystem: 4 Bausteine für markentreue UI
  17. ChatGPT-Login: Das Modell sieht dein Passwort nicht
  18. KI-Agenten-Harness erklärt: Die Zuverlässigkeitsschicht rund um ein LLM
  19. Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
  20. LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
  21. OpenViking im Test 2026: Ist Dateisystem-Memory produktionsreif?
  22. LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
  23. TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
  24. Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
  25. Lokalisierte URL-Slugs und hreflang: Warum wir einen englischen Slug behalten
  26. Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
  27. Graft Review 2026: Gehört die Repo-Map ins Git?
  28. Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
  29. Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
  30. DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
  31. OpenSandbox im Review: Lohnt sich Self-Hosting?
  32. Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
  33. GitHub Spec Kit im Test: Lohnt sich der Prozess?
  34. Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
  35. Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
  36. MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
  37. KI-Texte menschlicher schreiben mit Agent Skills
  38. NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
  39. Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
  40. Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
  41. Hark Handoff im Test: Der Agent, der wirklich klickt
  42. Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
  43. PII vor LLM-Prompts entfernen: Eine praktische Pipeline
  44. Agent Reach im Test: Kosten, Sicherheit und Grenzen
  45. Cloudflare Wallets für KI-Agenten: Was ist live?
  46. YC QM Agent im Test: Ist Quartermaster bereit?
  47. jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
  48. Lightpanda Browser für KI-Agenten: Praxischeck 2026
  49. Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
  50. Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
  51. Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
  52. MCP ist keine Sicherheitsgrenze: Agentendaten schützen
  53. Können KI-Agenten miteinander kommunizieren? Band-Guide
  54. LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
  55. GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
  56. Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
  57. OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
  58. Meterless im Test 2026: Ist der Context Layer produktionsreif?
  59. Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
  60. Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
  61. KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
  62. T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
  63. Open Knowledge Format (OKF): Der Unternehmensleitfaden
  64. AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
  65. Claude Fable 5.1 in Claude Code nutzen
  66. Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
  67. Der Engpass war nie Intelligenz. Es war Kontext.
  68. ChatGPT Enterprise vs. Copilot vs. eigenes RAG
  69. MCP, RAG, Agent Skills oder Custom GPTs?
  70. KI-Agent-Pilot in 30/60/90 Tagen
  71. RAG über SharePoint, Confluence, Drive: Permissions-First
  72. RAG-Production-Readiness-Checkliste für EU-Unternehmen
  73. Warum KI-Agentenprojekte abgebrochen werden