Volver
Kevin Riedl

10 min de lectura · 7 oct 2026
Última revisión

Siguiente
Se crea en tu dispositivo, sin conectar con Instagram. Copiamos el enlace para su sticker de enlace.

Claude Model Router: qué modelo cambia y cuándo

Instalas un router de modelos para Claude, aparece una recomendación de usar un modelo más barato y la conversación principal sigue utilizando el caro. Puede ser el comportamiento previsto. La clave es en qué punto interviene el router: en la conversación activa, al abrir otra sesión, al delegar una tarea o al enviar una solicitud a la API.

Dos proyectos de la comunidad con nombres parecidos muestran la diferencia. tzachbon/claude-model-router-hook recomienda modelos y dirige la selección al iniciar subagentes; su cambio automático opcional para la sesión principal se aplica a sesiones nuevas. musistudio/claude-code-router, conocido como CCR, es una pasarela local que envía solicitudes a los modelos y proveedores configurados. El propietario del repositorio forma parte de su identidad: buscar solo “Claude Model Router” puede llevarte a otro software.

Revisado el . Esta guía compara el comportamiento documentado y propone un proceso de evaluación. Los ejemplos de configuración se han contrastado con esas fuentes; no son un benchmark con proveedores en vivo ni prueban que Wavect haya desplegado estos proyectos para un cliente.

¿Qué cambia realmente un Claude Model Router?

Pregunta qué cambia, en qué momento y cómo comprobarlo. Una recomendación de enrutamiento, un ajuste guardado y una respuesta real del modelo son pruebas diferentes.

Ámbitos del enrutamiento de modelos en Claude Code
ÁmbitoControl habitualPrueba que debes revisar
Conversación actualSelección nativa con /modelEl modelo activo después del cambio
Próxima sesiónUn valor predeterminado guardado, incluido el cambio automático opcional del hookEl modelo elegido al iniciar una sesión nueva
Tarea delegadaConfiguración del modelo del subagente o un hook de inicioEl modelo utilizado realmente por ese subagente
Solicitud al proveedorUna regla de la pasarela y su configuración de destinoEl proveedor y modelo resueltos y el consumo de la respuesta

Elige primero dónde necesitas intervenir. Para abaratar búsquedas de archivos quizá baste con asignar modelos explícitos a los subagentes. Gestionar varios proveedores, credenciales y modelos alternativos por solicitud exige otra infraestructura. Nuestra comparativa de pasarelas y routers LLM aborda esa decisión general de selección y arquitectura.

¿Puede Claude Code cambiar de modelo sin un plugin?

Sí. La referencia de configuración de modelos de Anthropic documenta el parámetro de inicio, la selección dentro de la sesión y opusplan. Ese alias utiliza Opus en modo de planificación y Sonnet durante la ejecución. Es una política concreta por fase de trabajo, no un clasificador general para cada prompt.

Para establecer una referencia con las funciones nativas, inicia una sesión así:

claude --model sonnet

Dentro de una sesión interactiva, usa /model opus para seleccionar Opus o /model opusplan para elegir la política de planificación y ejecución. Siguen aplicándose la disponibilidad de modelos y los ajustes de la organización. Los alias facilitan una prueba rápida; registra la versión resuelta del modelo si necesitas reproducir la comparación.

Para una tarea delegada de alcance limitado, crea .claude/agents/repo-locator.md. Este ejemplo sigue la referencia de configuración de subagentes de Anthropic y propone un primer rol:

---
name: repo-locator
description: Localiza archivos y símbolos para una consulta acotada sobre el repositorio.
tools: Read, Glob, Grep
model: haiku
---
Localiza los archivos o símbolos solicitados. Devuelve rutas y pruebas breves.
No edites archivos ni deduzcas una solución. Comunica las dudas al agente principal.

Pide a Claude que use repo-locator para una búsqueda concreta. Después, comprueba el modelo real del subagente. Un parámetro de modelo en la invocación puede prevalecer sobre el frontmatter, y las restricciones de la organización pueden provocar una sustitución. La configuración expresa la ejecución deseada, pero aún no demuestra cuál se produjo.

¿Por qué Claude Model Router Hook no cambia mi sesión actual?

Su comportamiento documentado para la sesión principal consiste en avisar o configurar la siguiente sesión. El registro de cambios del proyecto explica que el cambio automático escribe el valor predeterminado para sesiones nuevas. Utiliza el comando nativo /model para cambiar la conversación actual.

El mismo registro documenta la actualización de los valores de enrutamiento de agosto de 2026: las tareas mecánicas usan Haiku, mientras que la implementación, la depuración y el razonamiento más amplio usan Opus con distintos niveles de esfuerzo. Un tutorial antiguo que asigna automáticamente la implementación habitual a Sonnet puede describir una política anterior.

Una configuración breve en .claude/model-router.json permite explicitar el comportamiento del proyecto:

{
  "version": 2,
  "apply_mode": "warn",
  "subagent_enforcement": "on",
  "classifier": {
    "cli_fallback": false
  }
}

Esta es nuestra configuración para evaluar el comportamiento, no los valores predeterminados del proyecto. Mantiene los avisos de la sesión principal y el enrutamiento de subagentes, pero desactiva el clasificador opcional mediante Claude CLI. apply_mode: warn no significa que el enrutamiento de subagentes esté desactivado. El README del proyecto documenta estos controles independientes y el archivo de registro ~/.claude/hooks/model-router-hook.log.

Revisa el hook junto con las automatizaciones ya instaladas. La referencia de hooks de Anthropic explica cómo PreToolUse puede modificar las entradas de las herramientas. Los hooks de comandos también se ejecutan con los permisos de tu cuenta de usuario. Revisa los comandos instalados y los hooks existentes antes de añadir otro componente que modifique el inicio de los agentes.

¿Qué cambia al usar Claude Code Router como proxy?

Cambia el recorrido de la solicitud. CCR recibe la petición al modelo y la reenvía según su configuración. “Pasarela local” indica dónde se ejecuta ese componente; el proveedor de destino determina dónde se realiza la inferencia. Un proveedor de la nube sigue recibiendo el contenido enviado a su modelo.

La guía actual de CCR CLI separa el acceso de administración del acceso a modelos: el token de administración y las claves de cliente de CCR son credenciales independientes. Trata el acceso a la interfaz de administración y el permiso para invocar modelos como decisiones distintas.

La documentación de pasarelas de Anthropic explica que la facturación sigue la credencial reenviada al proveedor. Configurar solo ANTHROPIC_BASE_URL no sustituye una credencial de suscripción guardada. Por tanto, un router no incluye la inferencia de otro proveedor en tu suscripción a Claude.

Prueba algo más que un saludo que devuelve una respuesta. La guía oficial de compatibilidad de pasarelas cubre streaming, cabeceras de capacidades, campos de solicitud y marcadores de caché. Una transmisión incorrecta puede causar errores o eliminar funciones esperadas. Ejecuta un ciclo completo con una herramienta y revisa la ruta y el consumo antes de confiar en una combinación de proveedores.

¿Por qué un modelo Claude más barato puede encarecer la tarea?

Un cambio de modelo puede sustituir lecturas baratas de caché por una nueva escritura. El cookbook de optimización de costes de la API de Anthropic explica que las cachés pertenecen a cada modelo y que un subagente empieza con un prefijo nuevo. Conservar el texto de la conversación no transfiere la caché del modelo principal.

Imagina una investigación larga seguida de una pequeña tarea de formato. Enviar todo el historial de investigación a un modelo más barato podría costar más que dar formato al resultado donde la caché ya está disponible. Otra opción consiste en delegar solo un fragmento breve y autosuficiente. Compara las alternativas con el mismo resultado aceptado, sin dar por hecho que gana la tarifa menor.

El esfuerzo requiere el mismo cuidado. La referencia de caché de prompts distingue los cambios de esfuerzo a nivel de solicitud, que invalidan bloques de mensajes almacenados, de los cambios por mensaje admitidos que conservan el prefijo anterior. Usar el mismo modelo no garantiza conservar la misma caché.

Nuestra regla de evaluación: cuenta la clasificación, la generación, las escrituras de caché, los reintentos y la corrección humana de toda la tarea. Cambia de modelo en un punto de trabajo útil, salvo que la calidad o el coste total medidos justifiquen otro cambio. Un porcentaje fijo de ahorro no dice si tu combinación de tareas se beneficiará.

Cómo resolver problemas de un Claude Model Router

Síntomas y primera prueba que conviene revisar
SíntomaPrimera comprobación
Cambia la recomendación, pero no el modelo principalComprueba si el hook avisa o configura la próxima sesión. Usa /model para cambiar la sesión activa.
Las sesiones nuevas siguen usando el modelo anteriorRevisa parámetros de inicio, variables de entorno, ajustes del proyecto y políticas que pueden prevalecer sobre el valor del usuario.
El subagente usa un modelo inesperadoCompara el modelo explícito de la invocación, el frontmatter, las restricciones y el modelo resuelto.
El chat por proxy funciona, pero fallan herramientas o streamsComprueba la transmisión del protocolo y las capacidades del modelo con un ciclo completo de herramienta.
Baja la tarifa del modelo, pero sube la facturaCompara escrituras de caché, intentos adicionales, consumo del clasificador y contexto duplicado.

Estas comprobaciones se apoyan en los contratos de configuración nativa, subagentes y pasarelas citados arriba. Registra lo sucedido antes de cambiar varios ajustes a la vez.

¿Cómo debería un equipo evaluar el enrutamiento automático?

  1. Elige un tipo de trabajo. Separa búsquedas de archivos, cambios acotados y depuración ambigua; define una comprobación de aceptación para cada uno.
  2. Registra una referencia nativa. Mantén fijos el estado del repositorio y las instrucciones. Anota modelos reales, tiempo de finalización y trabajo de corrección.
  3. Cambia un solo ámbito. Compara subagentes explícitos con enrutamiento por hooks antes de incorporar cambios de proveedor al mismo experimento.
  4. Examina las excepciones. Incluye un modelo explícito, una solicitud ambigua, una sesión larga con caché disponible y un fallo del proveedor en un entorno de prueba.
  5. Conserva las pruebas. Guarda motivos de enrutamiento, modelos resueltos, consumo y resultados de aceptación. Revisa la política tras actualizar el cliente, el plugin o el modelo.

Empieza por un flujo donde los errores sean fáciles de detectar. Amplía el uso cuando la versión enrutada alcance el objetivo de calidad y mejore el coste total o el tiempo de finalización. Para bucles de agentes gestionados por tu aplicación, nuestra guía de enrutamiento con LiteAgents trata el ámbito del SDK. La guía de la OpenAI Decisions API explica las salidas del clasificador y la política de fallback cuando tu aplicación controla la decisión.

Preguntas frecuentes sobre el enrutamiento de Claude

¿Claude Model Router es una función oficial de Anthropic?

Los proyectos comparados aquí, tzachbon/claude-model-router-hook y musistudio/claude-code-router, pertenecen a la comunidad. Claude Code ofrece por separado selección nativa de modelos, configuración de subagentes y otros controles. Comprueba el propietario del repositorio antes de seguir instrucciones de instalación.

¿Puedo cambiar de modelo en Claude Code sin reiniciar?

Sí, el comando nativo /model cambia la selección de la sesión actual. El cambio automático opcional del proyecto de hooks escribe un valor para sesiones nuevas. El enrutamiento de sus subagentes es un mecanismo independiente.

¿El modo de aviso desactiva el enrutamiento de subagentes?

No. En el ejemplo, apply_mode tiene el valor warn y subagent_enforcement está en on. La sesión principal recibe recomendaciones y las tareas delegadas aún pueden enrutarse. Configura ambos controles de forma deliberada.

¿El enrutamiento de modelos ahorra tokens automáticamente?

No. Elegir un modelo más barato cambia el precio de sus tokens, pero no necesariamente la cantidad requerida. La clasificación, la reconstrucción de caché, los reintentos y la revisión pueden compensar el ahorro. Compara tareas completas con los mismos criterios de aceptación.

¿Un router local de Claude mantiene todo el código en mi ordenador?

Solo si toda la ruta de inferencia configurada es local. Una pasarela local puede enviar código a un proveedor de la nube. Revisa el proveedor de destino, las llamadas al clasificador, los registros y los destinos de fallback antes de enviar contenido confidencial.

Ayuda para IA en producción

Si estás construyendo un producto de IA y te preocupan el coste de inferencia, la arquitectura o la preparación para producción, Wavect ayuda a fundadores a convertir prototipos de IA en sistemas fiables.

Ruta de servicio:

Tu bandeja, sin ruido

Sigue el trabajo que te importa

Recibe un correo breve cuando publiquemos algo nuevo. Sigue todo el blog o solo los temas que te interesan.

¿Qué quieres recibir?
Elige tus temas

Gratis, doble opt-in y sin píxeles de seguimiento.

Volver
Kevin Riedl

10 min de lectura · 7 oct 2026
Última revisión

Siguiente

Recibe la próxima nota de campo sobre IA y agentes

Un correo breve cuando publiquemos. Sin píxeles de seguimiento ni contenido de relleno.

Gratis, doble opt-in y sin píxeles de seguimiento.