Cluster

Agent Engineering

Coding Agents, MCP, Kontextsysteme, Evaluation und Kontrollen für verlässliche Automatisierung.

Blogbeiträge
55
Thema
AI und Agents

Mit dem Grundlagenartikel starten

Neu in dieser Sammlung

Rust-Compilergraph verbindet persistente Deklarationsidentitäten mit verifizierten semantischen Patches KI & Agenten

Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust

Ein Compiler-Engineering-Einblick in persistente IDs, geprüfte HIR, deterministische Graphen und replaybare Patches in der experimentellen Sprache SEMAPRAX.

LangChain Deep Agents verbindet Planung, Subagenten, Dateien, Freigaben, Sandboxes und Production Traces KI & Agenten

LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?

Kaufnahe Bewertung von Architektur, v0.7, Sicherheitsgrenzen, Betriebskosten und einem messbaren Production-Pilot.

OpenViking verbindet Agenten-Memory, RAG-Ressourcen und Skills über viking-Pfade in einem Dateisystem KI & Agenten

OpenViking im Test 2026: Ist Dateisystem-Memory produktionsreif?

Käuferanalyse zu OpenViking für Agenten-Memory und RAG: Architektur, AGPL-Risiko, Sicherheitskontrollen, Betriebskosten und messbarer Zwei-Wochen-Pilot.

Kontinuierliche Verifier-Scores ordnen mehrere Trajektorien von KI-Agenten KI & Agenten

LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz

Technischer Einkaufsleitfaden für fein abgestufte LLM-Verifikation: Logprob-Scoring, Pivot-Turniere, Benchmarks und ein sicherer Pilot.

TrueForge Agent Harness verbindet Modelle, MCP-Tools, Subagenten, Freigaben, Sandbox-Code und Traces KI & Agenten

TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?

Ein kaufnaher Test von TrueForge: Agent Loop, Kontextkontrollen, Benchmark-Kosten, Deployment und offene Produktionsfragen für Unternehmen.

Eine Seite als HTML, als Markdown-Spiegel und als llms.txt-Eintrag, geprüft von einem Build-Gate KI & Agenten

Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht

Vier Oberflächen entscheiden, ob eine KI-Answer-Engine dich lesen kann, und jeder Fehlerfall ist im Browser unsichtbar. Hier ist die Liste, die unser eigenes Build-Gate gefangen hat.

Vollständiges Artikelverzeichnis

  1. Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
  2. LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
  3. OpenViking im Test 2026: Ist Dateisystem-Memory produktionsreif?
  4. LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
  5. TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
  6. Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
  7. Lokalisierte URLs zerlegen hreflang: ein englischer Slug genügt
  8. Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
  9. Graft Review 2026: Gehört die Repo-Map ins Git?
  10. Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
  11. Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
  12. DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
  13. OpenSandbox im Review: Lohnt sich Self-Hosting?
  14. Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
  15. GitHub Spec Kit im Test: Lohnt sich der Prozess?
  16. Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
  17. Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
  18. MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
  19. KI-Texte menschlicher schreiben mit Agent Skills
  20. NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
  21. Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
  22. Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
  23. Hark Handoff im Test: Der Agent, der wirklich klickt
  24. Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
  25. PII vor LLM-Prompts entfernen: Eine praktische Pipeline
  26. Agent Reach im Test: Kosten, Sicherheit und Grenzen
  27. Cloudflare Wallets für KI-Agenten: Was ist live?
  28. YC QM Agent im Test: Ist Quartermaster bereit?
  29. jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
  30. Lightpanda Browser für KI-Agenten: Praxischeck 2026
  31. Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
  32. Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
  33. Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
  34. MCP ist keine Sicherheitsgrenze: Agentendaten schützen
  35. Können KI-Agenten miteinander kommunizieren? Band-Guide
  36. LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
  37. GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
  38. Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
  39. OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
  40. Meterless im Test 2026: Ist der Context Layer produktionsreif?
  41. Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
  42. Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
  43. KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
  44. T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
  45. Open Knowledge Format (OKF): Der Unternehmensleitfaden
  46. AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
  47. Claude Fable 5 in Claude Code nutzen
  48. Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
  49. Der Engpass war nie Intelligenz. Es war Kontext.
  50. ChatGPT Enterprise vs. Copilot vs. eigenes RAG
  51. MCP, RAG, Agent Skills oder Custom GPTs?
  52. KI-Agent-Pilot in 30/60/90 Tagen
  53. RAG über SharePoint, Confluence, Drive: Permissions-First
  54. RAG-Production-Readiness-Checkliste für EU-Unternehmen
  55. Warum 40% der AI-Agent-Projekte sterben