Meinungen, keine Pressemitteilungen
Eine kuratierte Startseite führt zu fokussierten Themen- und Cluster-Hubs, damit ältere Beiträge nicht allein durch ihr Alter an Sichtbarkeit verlieren.
Alle Artikel durchsuchen
Die Seitensuche durchsucht das gesamte Archiv, nicht nur diese Seite.
Keine Beiträge zu deiner Suche. Probier einen anderen Begriff oder wähl ein Thema.
Neueste Artikel
Neun Artikel pro Seite, nach Veröffentlichungsdatum sortiert.
Pro Token günstiger. Pro Antwort teurer.
Sonnet 5 startete pro Token günstiger als Opus 4.8, kostete im vollständigen Benchmark aber mehr pro erledigter Aufgabe. Warum Cost per Task, nicht der Preis pro Token, die Zahl auf deiner Rechnung ist.
Claude Fable 5 in Claude Code nutzen
Starte Fable 5 in Claude Code, nutze es für Architektur, lange Migrationen und Review und route mechanische Umsetzung an günstigere Modelle. Mit Preis-, Retention- und Fallback-Grenzen.
Dario hat Open Source den Krieg erklärt. Der echte Krieg geht um deine KI-Rechnung.
Anthropic warf chinesischen Laboren vor, seine Modelle gestohlen zu haben, und bat Washington um Eingreifen. Streiche die Geopolitik, und es ist ein Kampf um den Preis von Intelligenz. Coinbase hat seine KI-Rechnung mit Open Weights und Routing bereits um 50 % gesenkt. Unsere Lesart, und die EU-Absicherung.
Agile De-Engineering
Wie eine Bewegung zur Befreiung von Engineers die Engineering-Kultur im Enterprise aushöhlte. Alexandre Kotcherguine und Kevin Riedl zeichnen Kommerzialisierung, Ritual Capture, Metrikumkehr und die Erosion des Handwerks nach.
Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)
Embeddings, Vektor-DB, Tokens, Hosting und die Wartungszeile, die alle vergessen. Eine Richtwert-Kostenaufstellung pro Sitz für einen internen DACH-KI-Assistenten.
Das MVP ist tot. Bau ein Minimum Credible Product.
KI macht Prototypen billig, nicht Produktentscheidungen. Die Rauheit des klassischen MVP beschädigt heute oft genau das Signal, das es sammeln soll. Ein Plädoyer für weniger Scope, einen vertrauenswürdigen Kernpfad und belastbare Evidenz.
LLM-Gateways im Vergleich 2026: LiteLLM vs OpenRouter vs Portkey vs RouteLLM
Ein Endpoint über viele Provider, mit Fallback, Caching, Spend-Limits und Routing an einem Ort. Wie sich LiteLLM, OpenRouter, Portkey und RouteLLM unterscheiden, und wie du nach der Einschränkung wählst, die dich bindet.
LLMs in der EU selbst hosten: Wann sich Open Weights wirklich rechnen
Die GPU ist der günstige Teil. Hier sind die echten Kosten von Self-Hosting, der Token-pro-Tag-Break-even gegen Hosted APIs, wann Datenresidenz dich zwingt, und der vLLM-Produktions-Stack.
Beste Open-Weight-LLMs 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama
DeepSeek V4, Qwen3.5/3.6, Kimi K3, GLM-5.2 und Llama 4 im Vergleich: Größe, Kontext, Lizenz, Hardware und EU-Self-Hosting.
Folge der Arbeit, die für dich zählt
Du bekommst eine kurze E-Mail, wenn wir etwas Neues veröffentlichen. Folge dem ganzen Blog oder nur den Themen, die dich interessieren.