---
title: "Claude Model Router: Hooks, Subagenten und Proxy"
canonical: https://wavect.io/de/blog/claude-model-router-hooks-vs-proxy/
language: de
description: "Claude Model Router wechselt nicht? Vergleiche /model, Hooks für neue Sitzungen, Subagenten und Proxys, inklusive Cache, Abrechnung und Konfigurationsprüfung."
image: "https://wavect.io/img/blog/headers/header_claude-model-router-hooks-vs-proxy.png"
---

[**Zurück**](/de/blog/overview/)

[![Kevin Riedl](/img/team/kevin.webp)](/de/team/kevin-riedl/)

[Kevin Riedl](/de/team/kevin-riedl/) https://linkedin.com/in/wsdt

10 Min. Lesezeit · 7. Okt. 2026 Zuletzt geprüft 7. Oktober 2026

[**Weiter**](/de/blog/openai-decisions-api-model-routing/)

# Claude Model Router: Wann wechselt welches Modell?

TL;DR

Claude Model Router kann verschiedene Community-Tools bezeichnen. Der tzachbon-Hook empfiehlt Modelle, setzt optional den Standard der nächsten Sitzung und routet Subagenten. Musistudios Claude Code Router leitet tatsächliche Anfragen an konfigurierte Anbieter weiter. Claude Code bietet außerdem native Modellwahl und Subagentenmodelle. Prüfe das tatsächlich verwendete Modell an der gewünschten Stelle und berücksichtige Cache-Neuaufbau, Klassifikatorverbrauch und weitere Versuche bei der Kostenbewertung.

Du installierst einen Claude Model Router, siehst eine Empfehlung für ein günstigeres Modell und das Hauptgespräch verwendet weiterhin das teure. Das kann genau dem vorgesehenen Verhalten entsprechen. Entscheidend ist, **an welcher Stelle der Router eingreift**: im laufenden Gespräch, bei einer künftigen Sitzung, bei einer delegierten Aufgabe oder bei einer ausgehenden API-Anfrage.

Zwei ähnlich benannte Community-Projekte zeigen den Unterschied. [tzachbon/claude-model-router-hook](https://github.com/tzachbon/claude-model-router-hook) empfiehlt Modelle und steuert die Modellwahl beim Start von Subagenten; sein optionaler automatischer Wechsel für Hauptsitzungen wirkt erst bei neuen Sitzungen. [musistudio/claude-code-router](https://github.com/musistudio/claude-code-router), kurz CCR, ist ein lokales Gateway, das Anfragen an konfigurierte Modelle und Anbieter weiterleitet. Der Repository-Inhaber gehört zur eindeutigen Identität: Hinter dem Suchbegriff „Claude Model Router“ können verschiedene Projekte stehen.

**Geprüft am 7. Oktober 2026.** Dieser Leitfaden vergleicht dokumentiertes Verhalten und schlägt einen Ablauf zur Bewertung vor. Die Konfigurationsbeispiele wurden mit den Quellen abgeglichen. Sie sind kein Live-Benchmark mit Modellanbietern und kein Nachweis eines Kundenprojekts von Wavect mit diesen Tools.

## Was wechselt ein Claude Model Router tatsächlich?

**Frage zuerst, was sich ändert, wann es sich ändert und wie du es nachweisen kannst.** Eine Routing-Empfehlung, eine gespeicherte Einstellung und eine tatsächliche Modellantwort sind unterschiedliche Belege.

| Ebene | Typische Steuerung | Relevanter Nachweis |
| --- | --- | --- |
| Laufendes Gespräch | Native Auswahl über /model | Das aktive Modell nach der Änderung |
| Nächste Sitzung | Ein gespeicherter Standard, auch durch den optionalen Autoswitch des Hooks | Das Modell bei einem neuen Start |
| Delegierte Aufgabe | Modellkonfiguration des Subagenten oder Hook bei dessen Start | Das tatsächlich vom Subagenten verwendete Modell |
| Anfrage an den Anbieter | Gateway-Regel und Konfiguration des Zielanbieters | Aufgelöster Anbieter, Modell und gemeldeter Verbrauch |

Wähle zuerst die Ebene, die du brauchst. Ein Team, das Dateisuchen günstiger machen möchte, benötigt womöglich nur explizite Subagentenmodelle. Mehrere Anbieter, Zugangsdaten und Ausweichmodelle pro Anfrage stellen andere Anforderungen an die Infrastruktur. Unser [Vergleich von LLM-Gateways und Routern](/de/blog/llm-gateway-router-comparison-2026/) behandelt diese übergeordnete Auswahl- und Architekturentscheidung.

## Kann Claude Code ohne Plugin das Modell wechseln?

**Ja.** Anthropics [Referenz zur Modellkonfiguration](https://code.claude.com/docs/en/model-config) dokumentiert den Startparameter, die Auswahl im laufenden Gespräch und `opusplan`. Dieser Alias verwendet Opus im Planungsmodus und Sonnet bei der Umsetzung. Das ist eine konkrete Regel nach Arbeitsphase, kein allgemeiner Klassifikator für jeden Prompt.

Für einen nativen Vergleichslauf startest du eine Sitzung so:

```
claude --model sonnet
```

In einer interaktiven Sitzung wählst du mit `/model opus` Opus oder mit `/model opusplan` die Regel für Planung und Umsetzung. Modellverfügbarkeit und Organisationsvorgaben gelten weiterhin. Aliasse eignen sich für einen schnellen Versuch; für reproduzierbare Vergleiche solltest du die tatsächlich aufgelöste Modellversion festhalten.

Für eine eng begrenzte delegierte Aufgabe legst du `.claude/agents/repo-locator.md` an. Dieses Beispiel folgt Anthropics [Referenz zur Subagentenkonfiguration](https://code.claude.com/docs/en/sub-agents) und ist unser Vorschlag für eine erste Rolle:

```
---
name: repo-locator
description: Finde Dateien und Symbole zu einer klar begrenzten Repository-Frage.
tools: Read, Glob, Grep
model: haiku
---
Finde die angefragten Dateien oder Symbole. Liefere Pfade und kurze Belege.
Bearbeite keine Dateien und leite keinen Fix ab. Melde Unklarheiten dem Hauptagenten.
```

Bitte Claude, `repo-locator` für eine konkrete Suche einzusetzen. Prüfe anschließend das tatsächliche Subagentenmodell. Ein Modellparameter im einzelnen Aufruf kann die Frontmatter-Angabe übersteuern; Organisationsvorgaben können einen Ersatz auslösen. Die Konfiguration beschreibt die gewünschte Ausführung, bestätigt aber noch nicht die tatsächliche.

## Warum wechselt Claude Model Router Hook mein laufendes Modell nicht?

**Für die Hauptsitzung dokumentiert das Projekt Empfehlungen oder eine Konfiguration für die nächste Sitzung.** Das [Changelog des Projekts](https://github.com/tzachbon/claude-model-router-hook/blob/main/CHANGELOG.md) beschreibt, dass Autoswitch den Standard für neue Sitzungen schreibt. Wenn du das aktuelle Gespräch umstellen möchtest, nutze das native `/model`.

Dasselbe Changelog dokumentiert die Änderung der Routing-Standardwerte im August 2026: Mechanische Aufgaben verwenden Haiku, während Implementierung, Fehlersuche und umfangreicheres Denken Opus mit unterschiedlichen Effort-Stufen nutzen. Ein älteres Tutorial, das für gewöhnliche Implementierung automatisch Sonnet verspricht, kann eine frühere Regel beschreiben.

Eine kleine Projektkonfiguration in `.claude/model-router.json` macht das Verhalten ausdrücklich:

```
{
  "version": 2,
  "apply_mode": "warn",
  "subagent_enforcement": "on",
  "classifier": {
    "cli_fallback": false
  }
}
```

**Das ist unsere Konfiguration zur Bewertung, nicht die Standardeinstellung des Projekts.** Sie lässt Hinweise für die Hauptsitzung und das Subagenten-Routing aktiv, deaktiviert aber den optionalen Klassifikator-Fallback über die Claude CLI. `apply_mode: warn` bedeutet nicht, dass Subagenten-Routing ausgeschaltet ist. Das [Projekt-README](#source-hook) dokumentiert diese getrennten Einstellungen und die Protokolldatei `~/.claude/hooks/model-router-hook.log`.

Prüfe den Hook zusammen mit bereits installierten Automatisierungen. Anthropics [Hook-Referenz](https://code.claude.com/docs/en/hooks) beschreibt, wie `PreToolUse` Werkzeugeingaben ändern kann. Command-Hooks laufen außerdem mit den Berechtigungen deines Benutzerkontos. Prüfe installierte Befehle und vorhandene Hooks, bevor eine weitere Komponente Agentenstarts verändert.

## Was ändert Claude Code Router als Proxy?

**Der Weg der Anfrage ändert sich.** CCR empfängt die Modellanfrage und leitet sie entsprechend seiner Konfiguration weiter. „Lokales Gateway“ beschreibt den Betriebsort dieser Komponente; der gewählte Zielanbieter bestimmt, wo die Inferenz stattfindet. Ein Cloud-Anbieter erhält weiterhin die Inhalte, die an sein Modell gesendet werden.

Die aktuelle [CCR-CLI-Anleitung](https://ccrdesk.top/en/guides/cli/) trennt Verwaltungszugriff und Modellzugriff: Management-Token und CCR-Client-Schlüssel sind unabhängige Zugangsdaten. Behandle den Zugriff auf die Verwaltungsoberfläche und die Berechtigung für Modellaufrufe als getrennte Entscheidungen.

Anthropics [Gateway-Dokumentation](https://code.claude.com/docs/en/llm-gateway) erklärt, dass die Abrechnung den weitergereichten Zugangsdaten folgt. `ANTHROPIC_BASE_URL` allein ersetzt keine gespeicherte Anmeldung für ein Abonnement. Ein Router macht die Inferenz eines anderen Anbieters daher nicht zum Bestandteil deines Claude-Abos.

Prüfe außerdem mehr als eine erfolgreiche Begrüßung. Die [offizielle Anleitung zur Gateway-Kompatibilität](https://code.claude.com/docs/en/llm-gateway-protocol) behandelt Streaming, Capability-Header, Anfragefelder und Cache-Marker. Fehler bei der Weiterleitung können Anfragen scheitern lassen oder erwartetes Verhalten entfernen. Teste einen vollständigen Ablauf mit Werkzeugaufruf und prüfe Route und Verbrauch, bevor du einer Anbieterkombination vertraust.

## Warum kann ein günstigeres Claude-Modell die Aufgabe verteuern?

**Ein Modellwechsel kann günstige Cache-Lesezugriffe durch einen neuen Cache-Schreibvorgang ersetzen.** Anthropics [Cookbook zur API-Kostenoptimierung](https://platform.claude.com/cookbook/cost-optimization-cost-optimization) erklärt, dass Caches an das Modell gebunden sind und ein Subagent mit einem frischen Präfix startet. Der übergebene Gesprächsverlauf überträgt nicht zugleich den Cache des Hauptmodells.

Stell dir eine lange Fehlersuche vor, auf die eine kleine Formatierungsaufgabe folgt. Den gesamten Untersuchungsverlauf an ein günstigeres Modell zu schicken, kann teurer sein, als das Ergebnis dort zu formatieren, wo der Cache bereits warm ist. Eine weitere Möglichkeit wäre, nur einen kurzen, eigenständig verständlichen Ausschnitt zu delegieren. Vergleiche beide Varianten anhand desselben abgenommenen Ergebnisses, statt den niedrigeren Tokenpreis automatisch gewinnen zu lassen.

Auch Effort verlangt Aufmerksamkeit. Die [Referenz zum Prompt-Caching](https://platform.claude.com/docs/en/build-with-claude/prompt-caching) unterscheidet zwischen Effort-Änderungen auf Anfrageebene, die gecachte Nachrichtenblöcke ungültig machen, und unterstützten Änderungen pro Nachricht, die das frühere Präfix erhalten. „Gleiches Modell“ bedeutet nicht automatisch „gleicher Cache“.

Unsere Bewertungsregel: Erfasse Klassifikation, Generierung, Cache-Schreibvorgänge, weitere Versuche und manuelle Korrekturen für die gesamte Aufgabe. Wechsle an einem sinnvollen Arbeitsschritt, sofern gemessene Qualität oder Gesamtkosten keinen weiteren Wechsel rechtfertigen. Ein pauschaler Einsparungsprozentsatz sagt wenig über deinen eigenen Aufgabenmix aus.

## Fehlersuche beim Claude Model Router

| Symptom | Zuerst prüfen |
| --- | --- |
| Empfehlung ändert sich, Hauptmodell bleibt gleich | Gibt der Hook nur einen Hinweis, oder konfiguriert er die nächste Sitzung? Für das laufende Gespräch /model verwenden. |
| Neue Sitzungen starten weiterhin mit dem alten Modell | Startparameter, Umgebungsvariablen, Projekteinstellungen und Organisationsvorgaben prüfen, die einen Benutzerstandard übersteuern können. |
| Subagent nutzt ein unerwartetes Modell | Expliziten Modellparameter beim Start, Agenten-Frontmatter, Einschränkungen und tatsächliches Modell vergleichen. |
| Proxy-Chat funktioniert, Werkzeuge oder Streams scheitern | Protokollweiterleitung und Modellfähigkeiten in einem vollständigen Werkzeugablauf prüfen. |
| Niedrigerer Modellpreis, höhere Rechnung | Cache-Schreibvorgänge, zusätzliche Versuche, Klassifikatorverbrauch und doppelten Kontext vergleichen. |

Die Prüfpunkte folgen den oben verlinkten Schnittstellen für [native Konfiguration](#source-model-config), [Subagenten](#source-subagents) und [Gateways](#source-gateway-protocol). Halte das beobachtete Verhalten fest, bevor du mehrere Einstellungen gleichzeitig änderst.

## Wie sollte ein Team automatisches Modell-Routing bewerten?

1. **Einen Aufgabentyp auswählen.** Dateisuchen, begrenzte Änderungen und unklare Fehlerursachen getrennt betrachten und jeweils eine Abnahmeprüfung definieren.
2. **Einen nativen Ausgangswert erfassen.** Repository-Stand und Aufgabenbeschreibung konstant halten. Tatsächliche Modelle, Bearbeitungszeit und Korrekturaufwand protokollieren.
3. **Eine Ebene verändern.** Explizite Subagentenmodelle mit Hook-Routing vergleichen, bevor zusätzlich Anbieterwechsel in denselben Versuch kommen.
4. **Ausnahmen prüfen.** Einen expliziten Modellparameter, eine unklare Anfrage, eine lange Sitzung mit warmem Cache und einen Anbieterausfall in der Testumgebung einbeziehen.
5. **Belege behalten.** Routing-Gründe, tatsächliche Modelle, Verbrauch und Abnahmeergebnisse speichern. Nach Client-, Plugin- oder Modellupdates erneut prüfen.

Beginne mit einem Ablauf, bei dem Fehler gut erkennbar sind. Erweitere den Einsatz, sobald die geroutete Variante das Qualitätsziel erreicht und Gesamtkosten oder Bearbeitungszeit verbessert. Für eigene Agentenschleifen behandelt unser [Leitfaden zum LiteAgents-Routing](/de/blog/liteagents-sdk-per-turn-model-routing/) die SDK-Ebene. Unser [Leitfaden zur OpenAI Decisions API](/de/blog/openai-decisions-api-model-routing/) erklärt Klassifikatorergebnisse und Fallback-Regeln, wenn deine Anwendung die Entscheidung steuert.

## Häufige Fragen zum Claude-Modell-Routing

### Ist Claude Model Router eine offizielle Anthropic-Funktion?

Die hier verglichenen Projekte tzachbon/claude-model-router-hook und musistudio/claude-code-router sind Community-Projekte. Claude Code bietet davon getrennt native Modellwahl, Subagentenkonfiguration und weitere Einstellungen. Prüfe den Repository-Inhaber, bevor du einer Installationsanleitung folgst.

### Kann ich das Claude-Code-Modell ohne Neustart wechseln?

Ja, das native /model ändert die Auswahl der laufenden Sitzung. Der optionale Autoswitch des Hook-Projekts schreibt dagegen einen Standard für neue Sitzungen. Sein Subagenten-Routing arbeitet getrennt davon.

### Deaktiviert der Warnmodus auch das Subagenten-Routing?

Nein. Im Beispiel steht apply_mode auf warn und subagent_enforcement auf on. Die Hauptsitzung erhält Empfehlungen, während delegierte Aufgaben weiterhin geroutet werden können. Konfiguriere beide Einstellungen bewusst.

### Spart Modell-Routing automatisch Tokens?

Nein. Ein günstigeres Modell verändert den Tokenpreis, nicht zwingend die benötigte Tokenmenge. Klassifikation, Cache-Neuaufbau, weitere Versuche und zusätzliche Prüfung können Einsparungen aufheben. Vergleiche vollständige Aufgaben mit gleichen Abnahmekriterien.

### Bleibt mein Code bei einem lokalen Claude-Router auf meinem Rechner?

Nur wenn der gesamte konfigurierte Inferenzweg lokal bleibt. Ein lokales Gateway kann Code an einen Cloud-Anbieter weiterleiten. Prüfe Zielanbieter, Klassifikatoraufrufe, Protokolle und Fallback-Ziele, bevor du vertrauliche Inhalte übermittelst.

Modelle und Infrastruktur

## In diesem Cluster weiterlesen

Modellauswahl, Inferenzkosten, lokaler Betrieb, Kompression und Serving-Architektur.

[Mit dem Grundlagenartikel starten**LLMs in der EU selbst hosten: Wann sich Open Weights wirklich rechnen**](/de/blog/self-hosting-llms-eu-cost/)

- [OpenAI Decisions API: Konfidenz, Ablehnungen und Routing](/de/blog/openai-decisions-api-model-routing/)
- [Cloudflare Clef vs. Jev: Preise, Benchmarks und Migration](/de/blog/cloudflare-clef-vs-jev/)
- [Context Language Models vs. Kompaktierung: Was testen?](/de/blog/context-language-models-vs-compaction/)
- [Caveman 3.0 für Claude Code: Lokale Input-Kompression, Recovery und Benchmarks](/de/blog/caveman-3-claude-code-input-compression/)
- [LiteLLM Lens: Agenten-Traces mit SQL und APIs analysieren](/de/blog/litellm-lens-agent-trace-analysis/)

[**Zurück**](/de/blog/overview/)

[![Kevin Riedl](/img/team/kevin.webp)](/de/team/kevin-riedl/)

[Kevin Riedl](/de/team/kevin-riedl/) https://linkedin.com/in/wsdt

10 Min. Lesezeit · 7. Okt. 2026 Zuletzt geprüft 7. Oktober 2026

[**Weiter**](/de/blog/openai-decisions-api-model-routing/)

## Structured Data

```json
{
  "@context": "https://schema.org",
  "@graph": [
    {
      "@id": "https://wavect.io/#organization",
      "@type": [
        "Organization",
        "ProfessionalService",
        "LocalBusiness"
      ],
      "employee": [
        {
          "@id": "https://wavect.io/team/kevin-riedl/#person",
          "@type": "Person",
          "jobTitle": "Managing Director",
          "name": "Kevin Riedl",
          "url": "https://wavect.io/team/kevin-riedl/",
          "worksFor": {
            "@id": "https://wavect.io/#organization",
            "@type": [
              "Organization",
              "ProfessionalService",
              "LocalBusiness"
            ]
          }
        },
        {
          "@id": "https://wavect.io/team/christof-jori/#person",
          "@type": "Person",
          "jobTitle": "Managing Director",
          "name": "Christof Jori",
          "url": "https://wavect.io/team/christof-jori/",
          "worksFor": {
            "@id": "https://wavect.io/#organization",
            "@type": [
              "Organization",
              "ProfessionalService",
              "LocalBusiness"
            ]
          }
        }
      ],
      "founder": [
        {
          "@id": "https://wavect.io/team/kevin-riedl/#person",
          "@type": "Person",
          "jobTitle": "Managing Director",
          "name": "Kevin Riedl",
          "url": "https://wavect.io/team/kevin-riedl/",
          "worksFor": {
            "@id": "https://wavect.io/#organization",
            "@type": [
              "Organization",
              "ProfessionalService",
              "LocalBusiness"
            ]
          }
        },
        {
          "@id": "https://wavect.io/team/christof-jori/#person",
          "@type": "Person",
          "jobTitle": "Managing Director",
          "name": "Christof Jori",
          "url": "https://wavect.io/team/christof-jori/",
          "worksFor": {
            "@id": "https://wavect.io/#organization",
            "@type": [
              "Organization",
              "ProfessionalService",
              "LocalBusiness"
            ]
          }
        }
      ],
      "legalRepresentative": [
        {
          "@id": "https://wavect.io/team/kevin-riedl/#person",
          "@type": "Person",
          "jobTitle": "Managing Director",
          "name": "Kevin Riedl",
          "url": "https://wavect.io/team/kevin-riedl/",
          "worksFor": {
            "@id": "https://wavect.io/#organization",
            "@type": [
              "Organization",
              "ProfessionalService",
              "LocalBusiness"
            ]
          }
        },
        {
          "@id": "https://wavect.io/team/christof-jori/#person",
          "@type": "Person",
          "jobTitle": "Managing Director",
          "name": "Christof Jori",
          "url": "https://wavect.io/team/christof-jori/",
          "worksFor": {
            "@id": "https://wavect.io/#organization",
            "@type": [
              "Organization",
              "ProfessionalService",
              "LocalBusiness"
            ]
          }
        }
      ],
      "name": "Wavect GmbH",
      "subjectOf": {
        "@id": "https://wavect.io/verified-claims.json#dataset",
        "@type": "Dataset",
        "creator": {
          "@id": "https://wavect.io/#organization",
          "@type": [
            "Organization",
            "ProfessionalService",
            "LocalBusiness"
          ]
        },
        "description": "A machine-readable registry of quantitative and qualitative claims published by Wavect, with review dates, localized page appearances and public third-party citations where available.",
        "inLanguage": "en",
        "isAccessibleForFree": true,
        "license": "https://creativecommons.org/licenses/by/4.0/",
        "name": "Wavect verified publication claims",
        "url": "https://wavect.io/verified-claims.json"
      },
      "url": "https://wavect.io/"
    },
    {
      "@id": "https://wavect.io/team/kevin-riedl/#person",
      "@type": "Person",
      "jobTitle": "Managing Director",
      "name": "Kevin Riedl",
      "sameAs": [
        "https://www.wikidata.org/wiki/Q139796365",
        "https://www.linkedin.com/in/wsdt",
        "https://github.com/wsdt"
      ],
      "url": "https://wavect.io/team/kevin-riedl/",
      "worksFor": {
        "@id": "https://wavect.io/#organization",
        "@type": [
          "Organization",
          "ProfessionalService",
          "LocalBusiness"
        ]
      }
    },
    {
      "@id": "https://wavect.io/team/christof-jori/#person",
      "@type": "Person",
      "jobTitle": "Managing Director",
      "name": "Christof Jori",
      "sameAs": [
        "https://www.wikidata.org/wiki/Q139796367",
        "https://www.linkedin.com/in/jocr77/",
        "https://github.com/jo-chris"
      ],
      "url": "https://wavect.io/team/christof-jori/",
      "worksFor": {
        "@id": "https://wavect.io/#organization",
        "@type": [
          "Organization",
          "ProfessionalService",
          "LocalBusiness"
        ]
      }
    },
    {
      "@id": "https://wavect.io/#website",
      "@type": "WebSite",
      "inLanguage": [
        "en",
        "de",
        "es",
        "zh"
      ],
      "name": "Wavect",
      "potentialAction": {
        "@type": "SearchAction",
        "query-input": "required name=search_term_string",
        "target": {
          "@type": "EntryPoint",
          "urlTemplate": "https://wavect.io/search/?q={search_term_string}"
        }
      },
      "publisher": {
        "@id": "https://wavect.io/#organization",
        "@type": [
          "Organization",
          "ProfessionalService",
          "LocalBusiness"
        ]
      },
      "url": "https://wavect.io/"
    },
    {
      "@id": "https://wavect.io/de/blog/claude-model-router-hooks-vs-proxy/#webpage",
      "@type": "WebPage",
      "dateModified": "2026-10-07",
      "inLanguage": "de",
      "isPartOf": {
        "@id": "https://wavect.io/#website",
        "@type": "WebSite"
      },
      "lastReviewed": "2026-10-07",
      "url": "https://wavect.io/de/blog/claude-model-router-hooks-vs-proxy/"
    }
  ]
}
```

```json
{
  "@context": "https://schema.org",
  "@type": "BlogPosting",
  "abstract": "Claude Model Router kann verschiedene Community-Tools bezeichnen. Der tzachbon-Hook empfiehlt Modelle, setzt optional den Standard der nächsten Sitzung und routet Subagenten. Musistudios Claude Code Router leitet tatsächliche Anfragen an konfigurierte Anbieter weiter. Claude Code bietet außerdem native Modellwahl und Subagentenmodelle. Prüfe das tatsächlich verwendete Modell an der gewünschten Stelle und berücksichtige Cache-Neuaufbau, Klassifikatorverbrauch und weitere Versuche bei der Kostenbewertung.",
  "articleBody": " Blog-Übersicht/AI und Agents/Modelle und Infrastruktur Claude Model Router: Wann wechselt welches Modell? TL;DR Claude Model Router kann verschiedene Community-Tools bezeichnen. Der tzachbon-Hook empfiehlt Modelle, setzt optional den Standard der nächsten Sitzung und routet Subagenten. Musistudios Claude Code Router leitet tatsächliche Anfragen an konfigurierte Anbieter weiter. Claude Code bietet außerdem native Modellwahl und Subagentenmodelle. Prüfe das tatsächlich verwendete Modell an der gewünschten Stelle und berücksichtige Cache-Neuaufbau, Klassifikatorverbrauch und weitere Versuche bei der Kostenbewertung. Du installierst einen Claude Model Router, siehst eine Empfehlung für ein günstigeres Modell und das Hauptgespräch verwendet weiterhin das teure. Das kann genau dem vorgesehenen Verhalten entsprechen. Entscheidend ist, an welcher Stelle der Router eingreift: im laufenden Gespräch, bei einer künftigen Sitzung, bei einer delegierten Aufgabe oder bei einer ausgehenden API-Anfrage. Zwei ähnlich benannte Community-Projekte zeigen den Unterschied. tzachbon/claude-model-router-hook empfiehlt Modelle und steuert die Modellwahl beim Start von Subagenten; sein optionaler automatischer Wechsel für Hauptsitzungen wirkt erst bei neuen Sitzungen. musistudio/claude-code-router, kurz CCR, ist ein lokales Gateway, das Anfragen an konfigurierte Modelle und Anbieter weiterleitet. Der Repository-Inhaber gehört zur eindeutigen Identität: Hinter dem Suchbegriff „Claude Model Router“ können verschiedene Projekte stehen. Geprüft am 7. Oktober 2026. Dieser Leitfaden vergleicht dokumentiertes Verhalten und schlägt einen Ablauf zur Bewertung vor. Die Konfigurationsbeispiele wurden mit den Quellen abgeglichen. Sie sind kein Live-Benchmark mit Modellanbietern und kein Nachweis eines Kundenprojekts von Wavect mit diesen Tools. Was wechselt ein Claude Model Router tatsächlich? Frage zuerst, was sich ändert, wann es sich ändert und wie du es nachweisen kannst. Eine Routing-Empfehlung, eine gespeicherte Einstellung und eine tatsächliche Modellantwort sind unterschiedliche Belege. Die Ebenen des Modell-Routings in Claude Code EbeneTypische SteuerungRelevanter Nachweis Laufendes GesprächNative Auswahl über /modelDas aktive Modell nach der Änderung Nächste SitzungEin gespeicherter Standard, auch durch den optionalen Autoswitch des HooksDas Modell bei einem neuen Start Delegierte AufgabeModellkonfiguration des Subagenten oder Hook bei dessen StartDas tatsächlich vom Subagenten verwendete Modell Anfrage an den AnbieterGateway-Regel und Konfiguration des ZielanbietersAufgelöster Anbieter, Modell und gemeldeter Verbrauch Wähle zuerst die Ebene, die du brauchst. Ein Team, das Dateisuchen günstiger machen möchte, benötigt womöglich nur explizite Subagentenmodelle. Mehrere Anbieter, Zugangsdaten und Ausweichmodelle pro Anfrage stellen andere Anforderungen an die Infrastruktur. Unser Vergleich von LLM-Gateways und Routern behandelt diese übergeordnete Auswahl- und Architekturentscheidung. Kann Claude Code ohne Plugin das Modell wechseln? Ja. Anthropics Referenz zur Modellkonfiguration dokumentiert den Startparameter, die Auswahl im laufenden Gespräch und opusplan. Dieser Alias verwendet Opus im Planungsmodus und Sonnet bei der Umsetzung. Das ist eine konkrete Regel nach Arbeitsphase, kein allgemeiner Klassifikator für jeden Prompt. Für einen nativen Vergleichslauf startest du eine Sitzung so: claude --model sonnet In einer interaktiven Sitzung wählst du mit /model opus Opus oder mit /model opusplan die Regel für Planung und Umsetzung. Modellverfügbarkeit und Organisationsvorgaben gelten weiterhin. Aliasse eignen sich für einen schnellen Versuch; für reproduzierbare Vergleiche solltest du die tatsächlich aufgelöste Modellversion festhalten. Für eine eng begrenzte delegierte Aufgabe legst du .claude/agents/repo-locator.md an. Dieses Beispiel folgt Anthropics Referenz zur Subagentenkonfiguration und ist unser Vorschlag für eine erste Rolle: --- name: repo-locator description: Finde Dateien und Symbole zu einer klar begrenzten Repository-Frage. tools: Read, Glob, Grep model: haiku --- Finde die angefragten Dateien oder Symbole. Liefere Pfade und kurze Belege. Bearbeite keine Dateien und leite keinen Fix ab. Melde Unklarheiten dem Hauptagenten. Bitte Claude, repo-locator für eine konkrete Suche einzusetzen. Prüfe anschließend das tatsächliche Subagentenmodell. Ein Modellparameter im einzelnen Aufruf kann die Frontmatter-Angabe übersteuern; Organisationsvorgaben können einen Ersatz auslösen. Die Konfiguration beschreibt die gewünschte Ausführung, bestätigt aber noch nicht die tatsächliche. Warum wechselt Claude Model Router Hook mein laufendes Modell nicht? Für die Hauptsitzung dokumentiert das Projekt Empfehlungen oder eine Konfiguration für die nächste Sitzung. Das Changelog des Projekts beschreibt, dass Autoswitch den Standard für neue Sitzungen schreibt. Wenn du das aktuelle Gespräch umstellen möchtest, nutze das native /model. Dasselbe",
  "articleSection": "Modell-Routing",
  "author": {
    "@id": "https://wavect.io/team/kevin-riedl/#person",
    "@type": "Person",
    "name": "Kevin Riedl",
    "sameAs": [
      "https://www.wikidata.org/wiki/Q139796365",
      "https://www.linkedin.com/in/wsdt",
      "https://github.com/wsdt"
    ],
    "url": "https://wavect.io/team/kevin-riedl/"
  },
  "citation": [
    {
      "@type": "WebPage",
      "name": "tzachbon/claude-model-router-hook",
      "url": "https://github.com/tzachbon/claude-model-router-hook"
    },
    {
      "@type": "WebPage",
      "name": "musistudio/claude-code-router",
      "url": "https://github.com/musistudio/claude-code-router"
    },
    {
      "@type": "WebPage",
      "name": "Referenz zur Modellkonfiguration",
      "url": "https://code.claude.com/docs/en/model-config"
    },
    {
      "@type": "WebPage",
      "name": "Referenz zur Subagentenkonfiguration",
      "url": "https://code.claude.com/docs/en/sub-agents"
    },
    {
      "@type": "WebPage",
      "name": "Changelog des Projekts",
      "url": "https://github.com/tzachbon/claude-model-router-hook/blob/main/CHANGELOG.md"
    },
    {
      "@type": "WebPage",
      "name": "Hook-Referenz",
      "url": "https://code.claude.com/docs/en/hooks"
    },
    {
      "@type": "WebPage",
      "name": "CCR-CLI-Anleitung",
      "url": "https://ccrdesk.top/en/guides/cli/"
    },
    {
      "@type": "WebPage",
      "name": "Gateway-Dokumentation",
      "url": "https://code.claude.com/docs/en/llm-gateway"
    },
    {
      "@type": "WebPage",
      "name": "offizielle Anleitung zur Gateway-Kompatibilität",
      "url": "https://code.claude.com/docs/en/llm-gateway-protocol"
    },
    {
      "@type": "WebPage",
      "name": "Cookbook zur API-Kostenoptimierung",
      "url": "https://platform.claude.com/cookbook/cost-optimization-cost-optimization"
    },
    {
      "@type": "WebPage",
      "name": "Referenz zum Prompt-Caching",
      "url": "https://platform.claude.com/docs/en/build-with-claude/prompt-caching"
    }
  ],
  "dateModified": "2026-10-07",
  "datePublished": "2026-10-07",
  "description": "Claude Model Router kann verschiedene Community-Tools bezeichnen. Der tzachbon-Hook empfiehlt Modelle, setzt optional den Standard der nächsten Sitzung und routet Subagenten. Musistudios Claude Code Router leitet tatsächliche Anfragen an konfigurierte Anbieter weiter. Claude Code bietet außerdem native Modellwahl und Subagentenmodelle. Prüfe das tatsächlich verwendete Modell an der gewünschten Stelle und berücksichtige Cache-Neuaufbau, Klassifikatorverbrauch und weitere Versuche bei der Kostenbewertung.",
  "headline": "Claude Model Router: Wann wechselt welches Modell?",
  "image": "https://wavect.io/img/blog/headers/header_claude-model-router-hooks-vs-proxy.svg",
  "inLanguage": "de",
  "keywords": "Claude Code, Modell-Routing, KI-Entwicklung",
  "mainEntityOfPage": {
    "@id": "https://wavect.io/de/blog/claude-model-router-hooks-vs-proxy/",
    "@type": "WebPage"
  },
  "publisher": {
    "@id": "https://wavect.io/#organization",
    "@type": [
      "Organization",
      "ProfessionalService",
      "LocalBusiness"
    ]
  },
  "url": "https://wavect.io/de/blog/claude-model-router-hooks-vs-proxy/",
  "wordCount": 1748
}
```

```json
{
  "@context": "https://schema.org",
  "@type": "BreadcrumbList",
  "itemListElement": [
    {
      "@type": "ListItem",
      "item": "https://wavect.io/de/",
      "name": "Startseite",
      "position": 1
    },
    {
      "@type": "ListItem",
      "item": "https://wavect.io/de/blog/overview/",
      "name": "Blog-Übersicht",
      "position": 2
    },
    {
      "@type": "ListItem",
      "item": "https://wavect.io/de/blog/topics/ai-agents/",
      "name": "AI und Agents",
      "position": 3
    },
    {
      "@type": "ListItem",
      "item": "https://wavect.io/de/blog/clusters/models-infrastructure/",
      "name": "Modelle und Infrastruktur",
      "position": 4
    },
    {
      "@type": "ListItem",
      "item": "https://wavect.io/de/blog/claude-model-router-hooks-vs-proxy/",
      "name": "Claude Model Router: Hooks, Subagenten und Proxy",
      "position": 5
    }
  ]
}
```

```json
{
  "@context": "https://schema.org",
  "@type": "FAQPage",
  "mainEntity": [
    {
      "@type": "Question",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Die hier verglichenen Projekte tzachbon/claude-model-router-hook und musistudio/claude-code-router sind Community-Projekte. Claude Code bietet davon getrennt native Modellwahl, Subagentenkonfiguration und weitere Einstellungen. Prüfe den Repository-Inhaber, bevor du einer Installationsanleitung folgst."
      },
      "name": "Ist Claude Model Router eine offizielle Anthropic-Funktion?"
    },
    {
      "@type": "Question",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Ja, das native /model ändert die Auswahl der laufenden Sitzung. Der optionale Autoswitch des Hook-Projekts schreibt dagegen einen Standard für neue Sitzungen. Sein Subagenten-Routing arbeitet getrennt davon."
      },
      "name": "Kann ich das Claude-Code-Modell ohne Neustart wechseln?"
    },
    {
      "@type": "Question",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Nein. Im Beispiel steht apply_mode auf warn und subagent_enforcement auf on. Die Hauptsitzung erhält Empfehlungen, während delegierte Aufgaben weiterhin geroutet werden können. Konfiguriere beide Einstellungen bewusst."
      },
      "name": "Deaktiviert der Warnmodus auch das Subagenten-Routing?"
    },
    {
      "@type": "Question",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Nein. Ein günstigeres Modell verändert den Tokenpreis, nicht zwingend die benötigte Tokenmenge. Klassifikation, Cache-Neuaufbau, weitere Versuche und zusätzliche Prüfung können Einsparungen aufheben. Vergleiche vollständige Aufgaben mit gleichen Abnahmekriterien."
      },
      "name": "Spart Modell-Routing automatisch Tokens?"
    },
    {
      "@type": "Question",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Nur wenn der gesamte konfigurierte Inferenzweg lokal bleibt. Ein lokales Gateway kann Code an einen Cloud-Anbieter weiterleiten. Prüfe Zielanbieter, Klassifikatoraufrufe, Protokolle und Fallback-Ziele, bevor du vertrauliche Inhalte übermittelst."
      },
      "name": "Bleibt mein Code bei einem lokalen Claude-Router auf meinem Rechner?"
    }
  ]
}
```
