Thema

AI und Agents

Engineering, Betrieb und Bewertung von AI-Systemen, Coding Agents und Modellinfrastruktur.

Blogbeiträge
149
Fokussierte Cluster
02

Fokussierte Cluster

Mit dem Grundlagenartikel starten

Postfach, ohne Lärm

Erhalte die nächste Feldnotiz zu AI und Agents

Eine kurze E-Mail, wenn wir veröffentlichen. Ohne Tracking-Pixel und ohne Postfachfüller.

Neu in dieser Sammlung

Abstrakte verzweigte Pfade für die Auswahl zwischen Clef, Clef-flash und Jev, keine gemessenen Benchmark-Werte KI & Agenten

Cloudflare Clef vs. Jev: Preise, Benchmarks und Migration

Clef ergänzt die Jev-artige Entscheidungs-API um offene Gewichte und Bilder. Preise, Confidence-Berechnung und Flash-Ergebnisse machen den Wechsel aber anspruchsvoller.

Übereinanderliegende Kontextkarten als bearbeitbarer Arbeitsbestand eines Agenten KI & Agenten

Context Language Models vs. Kompaktierung: Was testen?

Soll Ihr Agent seinen Kontext selbst bearbeiten? Vergleichen Sie CLMs mit Kompaktierung, prüfen Sie Harness und Lizenz und testen Sie den Erhalt wichtiger Fakten.

Lokaler Caveman-Proxy komprimiert verrauschten Coding-Agent-Kontext vor der Modellinferenz KI & Agenten

Caveman 3.0 für Claude Code: Lokale Input-Kompression, Recovery und Benchmarks

Caveman 3.0 setzt eine Apache-2.0-Kompressionsschicht zwischen Coding-Agent und Modell. Was Proxy, Recovery, Learn-Profiler und der gemeldete 33,2%-Benchmark wirklich zeigen.

Wavect-Illustration zur Analyse von Agenten-Traces mit LiteLLM Lens KI & Agenten

LiteLLM Lens: Agenten-Traces mit SQL und APIs analysieren

Von einzelnen Agenten-Traces zu belegbaren Befunden: LiteLLM Lens, ClickHouse-SQL, sichere API-Zugriffe und ein kontrollierter Weg zum Regressionstest.

SmythOS Studio selbst hosten: visuelle Workflows, eigene Infrastruktur und Grenzen der Laufzeitumgebung KI & Agenten

SmythOS Studio selbst hosten: Docker, Kosten und Grenzen

Ein visueller KI-Agenten-Builder mit MIT-Lizenz auf eigener Infrastruktur. Was Docker tatsächlich startet, welche Kosten bleiben und was vor dem Livegang zu prüfen ist.

DeerFlow-Agent-Harness mit verbundenen Ebenen für Kontext, Sandbox und Workflow KI & Agenten

DeerFlow 2.0: Docker-Setup, Sandboxes und Memory

DeerFlow jenseits der Ankündigung: Docker konfigurieren, gemeinsame Sandboxes verstehen, Memory-Probleme eingrenzen und die Produktionsfreigabe vorbereiten.

Vollständiges Artikelverzeichnis

  1. Cloudflare Clef vs. Jev: Preise, Benchmarks und Migration
  2. Context Language Models vs. Kompaktierung: Was testen?
  3. Caveman 3.0 für Claude Code: Lokale Input-Kompression, Recovery und Benchmarks
  4. LiteLLM Lens: Agenten-Traces mit SQL und APIs analysieren
  5. SmythOS Studio selbst hosten: Docker, Kosten und Grenzen
  6. DeerFlow 2.0: Docker-Setup, Sandboxes und Memory
  7. CLM-8B selbst hosten: vLLM, Action-Cache und Verifier
  8. AnyJev: LLM-Kalibrierung und Optionsreihenfolge
  9. LiteAgents SDK: Modell-Routing, Setup und Migration
  10. mcp-memory-service: Gemeinsames Gedächtnis für Claude Code und Cursor
  11. Claude Opus 5.5: Einsatzfälle, Prompts und Effort
  12. Laya und Jev im Unternehmen: 6 praktische Workflows
  13. Laya vs Jev: Benchmarks und das Risiko für KI-Startups
  14. Google AX Agent Executor: Budgets und Selbsthosting
  15. WikiSkill: Wie Agenten SKILL.md aus Erfahrung weiterentwickeln
  16. Tencent Octop im Review: Was Entwickler tatsächlich kostenlos bekommen
  17. Wigolo im Test: Lokale Web Intelligence für AI Agents
  18. Jev AI im Test: Entscheidungsmodelle für Agenten
  19. Supermemory: KI-Agenten mit Gedächtnis, RAG und lokalem Betrieb
  20. KI-Agenten-Designmuster: Einfach starten, Aktionen prüfen
  21. Claude Mods: Einrichtung, Function Hooks und Sicherheit
  22. Voicebox: Lokales Voice Cloning, Diktieren und MCP-Setup
  23. Valyus 0,6B-Router für Retrieval-Agenten: Ergebnisse, Grenzen und Einsatz
  24. OpenAI Agents API im Review: Migration, Kosten und Datenkontrollen
  25. Spotify shunt: Einrichtung, Token-Ersparnis und Grenzen
  26. OpenBot im Check: KI-Kollegen selbst hosten
  27. SwarmLLM Test 2026: Browser-P2P-Inferenz auf Smartphone und Laptop
  28. Ramp Inspect Architektur 2026: Background Coding Agents skalieren
  29. Model Hardware Standard: MHS für Physical AI im Unternehmen
  30. Fonio AI Erfahrungen 2026: Preise, API, DSGVO & Build vs Buy
  31. Mosaic (YC S26) im Check: Shared Memory für Coding Agents
  32. Ripwire Review 2026: Repo-Kontext für KI-Agenten ohne Embeddings?
  33. Atomare Multi-Datei-Edits für KI-Coding-Agenten: die Semaprax-Lektion
  34. Phonely Alma im Test: Ist das Voice-LLM produktionsreif?
  35. Utopia: Temporalen Wissensgraph im Unternehmen prüfen
  36. Wissenstransfer zwischen KI-Agenten: Einmal entdecken, günstiger skalieren
  37. claude-rotate: Ein Proxy für mehrere Claude-Max-Konten
  38. NVIDIA PAIR im Test: Lokales KI-Routing und die AMD-Lücke
  39. Feynman im Test: Ist der Open-Source AI Research Agent bereit für Teams?
  40. Obscura Browser im Test: Aussagen, Grenzen und Produktions-Fit
  41. Claude-Code-Designsystem: 4 Bausteine für markentreue UI
  42. Tencent Hy4 Preview im Test: Lohnt sich das 1M-Kontextmodell?
  43. PageLM im Check: Selbst hosten und kommerziell nutzen
  44. ChatGPT-Login: Das Modell sieht dein Passwort nicht
  45. M6 Mac mini vs. M5 Mac Studio für lokale KI: Kaufberatung
  46. KI-Agenten-Harness erklärt: Die Zuverlässigkeitsschicht rund um ein LLM
  47. FreeToken AI im Test: Frontier-MoE auf Consumer-GPUs?
  48. Darkbloom AI Test: Private Inferenz auf freien Macs
  49. Ox Alpha als GLM-5.3-Flash enthüllt: Was sich ändert
  50. Warum Agenten-Edits semantische Identität brauchen: SEMAPRAX in Rust
  51. LangChain Deep Agents im Test: Ist das Agent Harness produktionsreif?
  52. Pika Audio API Preise: Sind Soundeffekte wirklich 20x günstiger?
  53. Thunder Computes 13-Mio.-Dollar-Wette auf GPU-Virtualisierung: Einkaufsleitfaden
  54. OpenViking im Überblick: Dateisystem-Memory für KI-Agenten
  55. LLM-as-a-Verifier erklärt: Architektur, Kosten und Produktionseinsatz
  56. AirLLM mit 4 GB VRAM: So funktioniert Layer-wise Inference
  57. TrueForge im Test: Ist das Open-Source Agent Harness produktionsreif?
  58. Agentenlesbare Websites: llms.txt, Markdown-Spiegel und was kaputtgeht
  59. Qwen3.8-27B: Computer-Use-Agenten selbst hosten, ohne Screenshots zu exportieren
  60. Lokalisierte URL-Slugs und hreflang: Warum wir einen englischen Slug behalten
  61. Kann ein KI-Agent dein Produkt benutzen, oder nur darüber lesen?
  62. Graft Review 2026: Gehört die Repo-Map ins Git?
  63. Wie du Coding-Agenten mit Tool-Ausgabe-Kompression skalierbar machst
  64. Intelligenterer Token-Einsatz mit deinem AI-Coding-Agenten
  65. DeepSeek Harness im Test: Ist der Plugin-Stack produktionsreif?
  66. Der vLLM- und Triton-Stack von Netflix: 7 Produktionslektionen
  67. OpenSandbox im Review: Lohnt sich Self-Hosting?
  68. Transformers.js im Browser: Wann lokale KI in dein Produkt gehört
  69. Cloudflare Kitesurf im Test: Kosten, Grenzen und Produktions-Fit
  70. GitHub Spec Kit im Test: Lohnt sich der Prozess?
  71. Interner KI-Agenten-Marktplatz: Praxisleitfaden 2026
  72. LiteLLM selbst hosten: Production-Guide 2026
  73. KI-fähiges Unternehmenswiki: Architektur und Aufbau
  74. Ist Linux das beste Betriebssystem für KI-Agenten? Infrastruktur-Guide 2026
  75. Versieht Claude Texte mit Wasserzeichen? API-Antwort 2026
  76. OpenKB Review: Knowledge Compiler vs. RAG
  77. Unsloth Desktop im Test: Private lokale KI-Workstation?
  78. NeMo Switchyard 0.2: Agenten-Routing ohne Training?
  79. Firecrawl AnyDoc im Test: 14 Formate zu Markdown
  80. MCP Cloud vs. Manufact Cloud: MCP-Hosting-Ratgeber
  81. Muse Glimmer 30B: Ist Metas lokales Agentenmodell produktionsreif?
  82. KI-Texte menschlicher schreiben mit Agent Skills
  83. NVIDIA NOOA im Test: Sind objektorientierte Agenten produktionsreif?
  84. OmniRoute KI-Routing: Setup und Produktions-Checkliste
  85. Strix AI Pentesting: 30-Tage-Pilot und Kaufguide 2026
  86. Hyperagent im Test: Cloud-KI-Agenten ohne eigenen Server
  87. Gemini Robotics 2: Ganzkörpersteuerung und die Pilotentscheidung
  88. Hark Handoff im Test: Der Agent, der wirklich klickt
  89. Meta Muse Code Preise: Ist Contributor für Kundencode sicher?
  90. pdf-inspector im Test: PDFs vor OCR lokal routen
  91. PII vor LLM-Prompts entfernen: Eine praktische Pipeline
  92. Agent Reach im Test: Kosten, Sicherheit und Grenzen
  93. Cloudflare Wallets für KI-Agenten: Was ist live?
  94. Lokaler multimodaler KI-Coding-Assistent: Sprache, OCR und Datenschutz
  95. DeepSeek V4 Flash 0731 auf einem KI-PC: Was funktioniert?
  96. YC QM Agent im Test: Ist Quartermaster bereit?
  97. jcode vs Claude Code: Lohnt sich der Wechsel zum Rust-Harness?
  98. Lightpanda Browser für KI-Agenten: Praxischeck 2026
  99. Graph Engineering für KI-Agenten: Wann lohnt sich ein Knowledge Graph?
  100. Multi-Modell KI-Coding-Agent-Stack: Kaufleitfaden für Teams
  101. Ist MCP jetzt stateless? Deine Server-Migrationscheckliste
  102. MCP ist keine Sicherheitsgrenze: Agentendaten schützen
  103. Gemma 4 kostenlos mit Unsloth und Colab tunen
  104. Können KI-Agenten miteinander kommunizieren? Band-Guide
  105. Taalas HC1 im Check: Lohnt sich ein fest verdrahteter LLM-ASIC?
  106. LeanCTX Erfahrung aus Agentur-Sicht: technischer Praxisbericht
  107. Welches lokale LLM läuft auf deiner Hardware? llmfit Guide
  108. GPT-5.6 Sol mit CLIProxyAPI in Claude Code nutzen
  109. Miso TTS selbst hosten oder API: Kosten, Latenz und VRAM
  110. Enterprise MCP Authorization: Multi-Tenant-Referenzarchitektur
  111. RAG-Vektoren auf 2 Bit komprimieren: Ist datenunabhängige Quantisierung produktionsreif?
  112. LMCache meldet 13,7x niedrigere mittlere TTFT mit gemeinsamem KV Cache
  113. Verlustfreie LLM-Kompression vs. 8-bit GGUF: Was ist produktionsreif?
  114. OpenAI Eval-Sandbox-Escape: 12 Kontrollen für Cyber-Agenten
  115. Cisco Antares im Test: 1B Local AI für Vulnerability Localization
  116. Meterless im Test 2026: Ist der Context Layer produktionsreif?
  117. NVIDIA Nemotron 3.5 ASR: Ist Self-Hosted STT bereit für Voice Agents?
  118. Claude Code vs OpenCode: Was kostet dein Team 2026 weniger?
  119. Kimi K3 für EU-Unternehmen: API-Kosten, Datenschutz und Pilotplan
  120. Mesh LLM im Test: Ein großes LLM auf mehreren Rechnern ausführen?
  121. Graphify Review 2026: Lohnt sich ein Knowledge Graph für deine Codebasis?
  122. Bonsai 27B im Test: Läuft ein 27B-LLM wirklich auf dem Smartphone?
  123. KI-Pilot Kill-or-Scale-Scorecard: 12 Kennzahlen nach 30 Tagen
  124. Soofi S: Ist Deutschlands souveränes LLM bereit für Unternehmen?
  125. T3MP3ST Review 2026: Ersetzt es einen Penetrationstest?
  126. Colibri führt GLM-5.2 auf Consumer-Hardware aus. Der Haken.
  127. Open Knowledge Format (OKF): Der Unternehmensleitfaden
  128. AI Agent Cost per Action: Warum agentische Workflows Token-Rechnungen sprengen
  129. Wann lokale Modelle APIs schlagen: Break-even-Rechner für EU-Unternehmen
  130. LLM-Kostenrechner 2026: Rechne pro Aufgabe, nicht pro Token
  131. Pxpipe im Test: Senken Bilder Claude-Code-Kosten um 60%?
  132. Pro Token günstiger kann pro Aufgabe teurer sein
  133. Claude Fable 5.1 in Claude Code nutzen
  134. Anthropic sagt Nein zum Open-Weights-Verbot. Der Kostenkampf bleibt real.
  135. Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
  136. LLM-Gateways im Vergleich 2026: LiteLLM vs OpenRouter vs Portkey vs RouteLLM
  137. LLMs in der EU selbst hosten: Wann sich Open Weights wirklich rechnen
  138. Beste Open-Weight-LLMs 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama
  139. Der Engpass war nie Intelligenz. Es war Kontext.
  140. ChatGPT Enterprise vs. Copilot vs. eigenes RAG
  141. MCP, RAG, Agent Skills oder Custom GPTs?
  142. LLM-Token-Kosten 2026 senken
  143. KI-Agent-Pilot in 30/60/90 Tagen
  144. RAG über SharePoint, Confluence, Drive: Permissions-First
  145. RAG-Production-Readiness-Checkliste für EU-Unternehmen
  146. Wann lohnt es sich, ein LLM-Eval zu bauen? Kosten, ROI und dem Judge vertrauen
  147. Warum KI-Agentenprojekte abgebrochen werden
  148. RAG, Fine-Tuning oder Long Context? Vergleich 2026
  149. LLM-API-Kosten 2026. Architektur-Shift