AUS DER PRAXIS Ausgabe №164

Meinungen, keine Pressemitteilungen

Eine kuratierte Startseite führt zu fokussierten Themen- und Cluster-Hubs, damit ältere Beiträge nicht allein durch ihr Alter an Sichtbarkeit verlieren.

Nach Thema erkunden
06
Fokussierte Cluster
12
Blogbeiträge
164

Neueste Artikel

Neun Artikel pro Seite, nach Veröffentlichungsdatum sortiert.

Kosten pro Token versus Kosten pro Aufgabe: Ein niedrigerer Stückpreis kann trotzdem eine höhere Gesamtrechnung erzeugen KI & Agenten

Pro Token günstiger. Pro Antwort teurer.

Sonnet 5 startete pro Token günstiger als Opus 4.8, kostete im vollständigen Benchmark aber mehr pro erledigter Aufgabe. Warum Cost per Task, nicht der Preis pro Token, die Zahl auf deiner Rechnung ist.

Coding mit Claude Fable 5: Model-Routing über Fable, Opus, Sonnet und Haiku KI & Agenten

Claude Fable 5 in Claude Code nutzen

Starte Fable 5 in Claude Code, nutze es für Architektur, lange Migrationen und Review und route mechanische Umsetzung an günstigere Modelle. Mit Preis-, Retention- und Fallback-Grenzen.

Anthropics Krieg gegen Open-Source-KI ist in Wahrheit ein Kampf um die Kosten von Intelligenz KI & Agenten

Dario hat Open Source den Krieg erklärt. Der echte Krieg geht um deine KI-Rechnung.

Anthropic warf chinesischen Laboren vor, seine Modelle gestohlen zu haben, und bat Washington um Eingreifen. Streiche die Geopolitik, und es ist ein Kampf um den Preis von Intelligenz. Coinbase hat seine KI-Rechnung mit Open Weights und Routing bereits um 50 % gesenkt. Unsere Lesart, und die EU-Absicherung.

Agile De-Engineering und die Erosion der Engineering-Kultur im Enterprise Software Delivery & QA

Agile De-Engineering

Wie eine Bewegung zur Befreiung von Engineers die Engineering-Kultur im Enterprise aushöhlte. Alexandre Kotcherguine und Kevin Riedl zeichnen Kommerzialisierung, Ritual Capture, Metrikumkehr und die Erosion des Handwerks nach.

Kosten eines internen KI-Assistenten in DACH 2026 KI & Agenten

Was ein interner KI-Assistent in der DACH-Region wirklich kostet (2026)

Embeddings, Vektor-DB, Tokens, Hosting und die Wartungszeile, die alle vergessen. Eine Richtwert-Kostenaufstellung pro Sitz für einen internen DACH-KI-Assistenten.

Das Minimum Credible Product ersetzt das klassische MVP im KI-Zeitalter Produkt & MVP

Das MVP ist tot. Bau ein Minimum Credible Product.

KI macht Prototypen billig, nicht Produktentscheidungen. Die Rauheit des klassischen MVP beschädigt heute oft genau das Signal, das es sammeln soll. Ein Plädoyer für weniger Scope, einen vertrauenswürdigen Kernpfad und belastbare Evidenz.

LLM-Gateways im Vergleich 2026 KI & Agenten

LLM-Gateways im Vergleich 2026: LiteLLM vs OpenRouter vs Portkey vs RouteLLM

Ein Endpoint über viele Provider, mit Fallback, Caching, Spend-Limits und Routing an einem Ort. Wie sich LiteLLM, OpenRouter, Portkey und RouteLLM unterscheiden, und wie du nach der Einschränkung wählst, die dich bindet.

Open-Weight-LLMs in der EU selbst hosten KI & Agenten

LLMs in der EU selbst hosten: Wann sich Open Weights wirklich rechnen

Die GPU ist der günstige Teil. Hier sind die echten Kosten von Self-Hosting, der Token-pro-Tag-Break-even gegen Hosted APIs, wann Datenresidenz dich zwingt, und der vLLM-Produktions-Stack.

Open-Weight-LLM-Vergleich 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama KI & Agenten

Beste Open-Weight-LLMs 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama

DeepSeek V4, Qwen3.5/3.6, Kimi K3, GLM-5.2 und Llama 4 im Vergleich: Größe, Kontext, Lizenz, Hardware und EU-Self-Hosting.

Postfach, ohne Lärm

Folge der Arbeit, die für dich zählt

Du bekommst eine kurze E-Mail, wenn wir etwas Neues veröffentlichen. Folge dem ganzen Blog oder nur den Themen, die dich interessieren.

Was möchtest du erhalten?
Themen auswählen

Kostenlos, Double-Opt-in, ohne Tracking-Pixel.