En este artículo
Cloudflare Clef vs. Jev: precios, pruebas y migración
Cloudflare Clef es una alternativa a Jev para equipos que necesitan decisiones de IA tipadas, pesos abiertos y entradas multimodales. No es un chatbot de propósito general. La aplicación aporta evidencia y respuestas permitidas; el modelo puntúa esas respuestas en lugar de redactar texto libre. Cloudflare anunció Clef y Clef-flash el 1 de octubre de 2026. El nombre oficial es Clef, no «Clev». Cloudflare: lanzamiento de Clef
Nuestra valoración: merece un piloto serio cuando las imágenes, el control del despliegue o la latencia limitan una integración existente. No es una mejora automática frente a Jev, y ninguna variante de Cloudflare tiene una tarifa publicada de entrada inferior. El hallazgo más importante para migrar es menos evidente: compartir campos JSON no garantiza compartir la semántica de confianza.
Revisado el 4 de octubre de 2026. Este artículo analiza documentación primaria y código publicado. No presenta benchmarks ejecutados por Wavect ni afirma que hayamos desplegado Clef para un cliente. Los precios y contratos alojados corresponden a esta fecha; las recomendaciones son nuestra evaluación técnica.
Clef, Clef-flash y Jev: ¿qué cambia realmente?
Clef combina una base Qwen3.8-27B con un cabezal de decisión conjunto. Este puntúa respuestas permitidas a través del esquema de preguntas, sin generar una explicación. Clef-flash utiliza Qwen3.5-9B. Ambas versiones de Cloudflare publican sus pesos bajo Apache-2.0. Cloudflare: ficha y evaluación de Clef Cloudflare: ficha de Clef-flash
TypeSafe identifica actualmente jev-1.13.0, con entradas de texto y una API System One alojada. Distingue un presupuesto total de 64k tokens por solicitud de un límite de 32k para el estado más la pregunta más larga. Describir Jev simplemente como «32k» y Clef como «el doble de contexto» ocultaría esa diferencia. TypeSafe: modelos, precios y límites de Jev
| Factor de decisión | Clef | Clef-flash | Jev 1.13 |
|---|---|---|---|
| Precio publicado por millón de tokens de entrada | 0,24 USD | 0,09 USD | 0,042 USD |
| Despliegue | Workers AI o pesos autoalojados | Workers AI o pesos autoalojados | API alojada de TypeSafe |
| Evidencia visual nativa | Sí; las interfaces alojada y local difieren | Sí; las interfaces alojada y local difieren | No; convertir previamente en texto |
| Motivo para un piloto | Decisiones con imágenes y control del despliegue | Decisiones acotadas y sensibles a latencia | Comportamiento validado y menor coste publicado de entrada |
Las tarifas de Cloudflare proceden de la tabla de precios de Workers AI, no de una estimación promocional. Los motivos para hacer un piloto son recomendaciones nuestras, no garantías de rendimiento. Cloudflare: precios de Workers AI
Para entender la interfaz original, consulta nuestro análisis técnico de Jev. La discusión sobre modelos abiertos y procedencia de benchmarks está en Laya frente a Jev. Aquí abordamos una pregunta más concreta: si sustituir una integración existente de Jev por Cloudflare Clef compensa el riesgo de migración.
Lo interesante no es «otro chatbot». Piensa en un proceso de devoluciones con un mensaje del cliente y una foto del paquete dañado. Un piloto de Clef podría evaluar ambas evidencias y elegir entre damage_review, delivery_review y manual_review. Una ruta solo de texto necesita antes una etapa explícita de imagen a texto. Es un diseño ilustrativo, no un despliegue de Clef medido. El reembolso sigue dependiendo de las reglas y aprobaciones de la aplicación.
La interfaz tipada admite noul para una probabilidad de sí/no, choice para alternativas con nombre y score para niveles ordenados. Esto hace interesante a Clef como paso de decisión dentro de un agente, no como sustituto de todo el razonamiento o la redacción. Tipos de entrada publicados.
¿Es Cloudflare Clef más barato que Jev?
No según las tarifas publicadas de tokens de entrada. Supongamos un millón de decisiones con 2.000 tokens facturados por decisión: dos mil millones de tokens facturables. Aplicando las tarifas de Cloudflare y la tarifa de TypeSafe, el ejemplo de inferencia queda así:
| Modelo | Cargo ilustrativo de entrada | Respecto a Jev |
|---|---|---|
| Jev | 84 USD | 1,00× |
| Clef-flash | 180 USD | 2,14× |
| Clef | 480 USD | 5,71× |
Es un cálculo nuestro, no un presupuesto comercial. Supone el mismo número de tokens de entrada facturables, no la misma tokenización de un texto idéntico. Incluye el esquema, los reintentos y el procesamiento de imágenes en las mediciones reales. Este ejemplo excluye cuotas gratuitas, descuentos, ejecución de Workers, almacenamiento y revisión humana. Jev declara gratuitos los tokens de salida; Cloudflare no publica una tarifa de salida para estos modelos.
Pagar más por token puede compensar si la nueva ruta reduce errores costosos, elimina un paso separado de imagen a texto o resuelve una decisión urgente con mayor fiabilidad. Hay que demostrarlo en el flujo completo. «Más barato que un modelo de chat grande» no significa «más barato que Jev». Nuestra guía de procesos y ROI con modelos de decisión desarrolla el caso de negocio general.
Benchmarks: Clef gana en unas tareas y Jev en otras
Los resultados de Cloudflare justifican evaluar cada tarea, no declarar un ganador universal. Estas filas proceden de la ejecución de Decision Index 0.2.1 publicada en la ficha de Clef. Son resultados del proveedor, no mediciones independientes de Wavect. Las métricas de calidad son porcentajes: más es mejor. En latencia, menos es mejor.
| Benchmark / métrica | Clef | Clef-flash | Jev |
|---|---|---|---|
| BANKING77, F1 macro | 94.2 | 90.9 | 79.7 |
| CLINC150 + OOS, F1 macro | 97.4 | 66.8 | 89.3 |
| RAGTruth, F1 de alucinación | 79.4 | 35.6 | 76.5 |
| GPQA Diamond, exactitud | 48.0 | 51.0 | 78.3 |
| When2Call MCQ, exactitud | 72.4 | 65.6 | 81.0 |
| Latencia mediana, milisegundos | 209.3 | 38.8 | 524.1 |
| Latencia p95, milisegundos | 238.6 | 122.4 | 536.0 |
Nuestra interpretación: incluye Clef en un piloto de clasificación de intenciones, pero prueba también las intenciones desconocidas. Trata Flash como un perfil de calidad distinto, no como el mismo modelo acelerado. Sus resultados en CLINC150 + OOS y RAGTruth contradicen una sustitución indiscriminada. Los resultados de Jev en GPQA y When2Call también impiden afirmar que Clef es mejor para cualquier decisión.
Las latencias corresponden a ese entorno de evaluación. No equivalen al tiempo de respuesta de tu producción, a un SLA ni al rendimiento de una GPU propia. Mide el p95 de extremo a extremo con concurrencia, tamaños de solicitud, red y mecanismos de respaldo representativos. Tampoco atribuyas la columna «Jev» del benchmark a una versión actual que la tabla no identifica.
La trampa al migrar: la confianza no significa lo mismo
No copies directamente los umbrales de confianza de Jev a Clef. TypeSafe define la confianza de Choice como (p_max - 1/n) / (1 - 1/n), donde n es el número de opciones. No equivale a devolver la probabilidad de la opción ganadora. TypeSafe: fórmulas de confianza
En el código de Cloudflare revisado, systemone_answer asigna a la confianza de Choice la propia probabilidad ganadora. Revisamos la versión del repositorio a20e258. Este hallazgo corresponde a la implementación publicada, no demuestra que todos los despliegues alojados utilicen exactamente esa versión. Hay que verificar por separado el comportamiento del servicio. Cloudflare: código de Clef revisado
En nuestro ejemplo, tres opciones tienen probabilidades 0.80, 0.15, 0.05. La fórmula documentada de Jev devuelve 0.70; el auxiliar de Clef revisado devuelve 0.80. Una regla existente confidence >= 0.75 rechazaría la primera respuesta y aceptaría la segunda, con una distribución idéntica. Es una diferencia de contrato, no evidencia de mayor certeza ni de mayor precisión de Clef.
Conserva la distribución de probabilidades y define explícitamente en tu adaptador la estadística usada para decidir. Reajusta los umbrales con ejemplos de validación etiquetados y comprueba errores aceptados y cobertura de revisión en un conjunto de prueba intacto. Unificar la fórmula no iguala la calibración. Nuestra guía de calibración y orden de opciones de AnyJev trata ese problema específico.
También conviene probar la solicitud completa: TypeSafe describe preguntas evaluadas de forma independiente, mientras que Clef puntúa el esquema conjuntamente. Nuestra recomendación derivada es repetir decisiones con el paquete completo de preguntas de producción y añadiendo o quitando preguntas irrelevantes. Es una inferencia arquitectónica, no un fallo de Clef observado por nosotros. TypeSafe: evaluación independiente de preguntas
Migrar la API: conserva el esquema, verifica la interfaz
El endpoint documentado de Jev es POST https://api.typesafe.ai/v1/systemone. Compartir state, questions e identificadores de respuesta facilita el trabajo, pero migrar a Cloudflare sigue requiriendo otras credenciales, selección de modelo y un adaptador para el transporte utilizado. TypeSafe: API HTTP de System One
La API alojada de Clef documenta 65.536 tokens de contexto, entre 1 y 64 preguntas y truncamiento del estado textual largo. Acepta hasta cuatro imágenes PNG, JPEG o WebP incorporadas en la solicitud, no direcciones remotas de imágenes. Los límites publicados son 4 MiB y 16 megapíxeles por imagen, 8 MiB decodificados en total y 13 MiB para el cuerpo completo. Cloudflare: contrato de la API alojada de Clef
Clef-flash utiliza otra ruta y el selector correspondiente model: "clef-flash". Mantén alineados ambos al cambiar de variante. La interfaz de imágenes alojada no debe confundirse con los ejemplos de fotogramas de vídeo del modelo local. Cloudflare: contrato de la API alojada de Clef-flash
Una prueba pequeña que no ejecuta acciones de negocio
Guarda lo siguiente como clef-request.json. Clasifica un mensaje ficticio en inglés dentro de una cola de revisión. No emite reembolsos, modifica cuentas ni autoriza acciones.
{
"model": "clef",
"state": {
"message": "The package arrived with a broken seal. I am not sure whether anything is missing."
},
"questions": {
"review_queue": {
"type": "choice",
"instructions": "Select a review queue. Use manual_review when the evidence does not support a specific queue.",
"criteria": {
"damage_review": "Possible physical package damage.",
"delivery_review": "Delivery timing or location issue.",
"manual_review": "Missing or ambiguous evidence; a person should review."
}
},
"needs_more_evidence": {
"type": "noul",
"instructions": "Is more information needed before a refund decision can be considered?"
}
}
}Configura en la shell el identificador de cuenta y un token de API de Cloudflare del lado del servidor con permiso de Workers AI. Envía la solicitud con curl 7.76 o posterior:
set -eu
: "${CLOUDFLARE_ACCOUNT_ID:?Set your Cloudflare account ID}"
: "${CLOUDFLARE_API_TOKEN:?Set a server-side Workers AI token}"
curl --fail-with-body --silent --show-error \
--connect-timeout 10 --max-time 60 \
"https://api.cloudflare.com/client/v4/accounts/${CLOUDFLARE_ACCOUNT_ID}/ai/run/@cf/cloudflare/clef" \
--header "Authorization: Bearer ${CLOUDFLARE_API_TOKEN}" \
--header "Content-Type: application/json" \
--data-binary @clef-request.json \
--output clef-response.jsonEl ejemplo utiliza la ruta REST documentada. Comprobamos localmente el JSON y la sintaxis de shell, pero no ejecutamos inferencia de pago. Inspecciona clef-response.json, incluidos los errores de API. No conectes acciones directamente a la salida sin validar. Prueba el envoltorio de respuesta REST por separado del resultado de un binding de Workers; valida identificadores, opciones permitidas y probabilidades finitas en el adaptador.
Conserva la revisión manual ante etiquetas desconocidas, respuestas malformadas, tiempos de espera y límites de solicitudes. Una petición de Clef basada en imágenes no debe pasar silenciosamente a Jev perdiendo la evidencia visual. Utiliza una representación textual expresamente validada o detén el proceso para revisarlo. Rechaza o divide deliberadamente entradas demasiado largas, en lugar de descubrir tras un incidente que se truncó el párrafo decisivo.
Pesos abiertos, despliegue propio y límites de privacidad
Los pesos abiertos ofrecen una opción de despliegue, no un servicio de producción terminado. Las instrucciones de Clef cargan tanto el modelo base como el cabezal de decisión conjunto. Servir únicamente una ruta genérica de generación de chat no demuestra que estés ejecutando el modelo de decisión publicado. Fija juntos los pesos, el procesador, el cabezal y el código del servidor.
El auxiliar local revisado utiliza max_length=16384 por defecto, distinto del límite alojado de 65.536 tokens. La H200 individual de la ficha describe el entorno probado, no un requisito mínimo de GPU. Para una estimación inicial, 27.000 millones de parámetros a dos bytes requieren unos 54 GB de pesos y 9.000 millones unos 18 GB, antes del consumo adicional en ejecución. Son cálculos orientativos, no mediciones de memoria ni garantías sobre una cuantización en tu hardware.
Separa además los pesos descargables de la personalización gestionada. El anuncio de lanzamiento describe inicialmente fine-tuning con el equipo de ingeniería desplegada de Cloudflare, y un acceso autoservicio más amplio previsto para después. No presupuestes un proyecto suponiendo que ya existe un producto de ajuste de un clic sin confirmar el acceso.
La política de Workers AI indica que el contenido del cliente no se usa para entrenar o mejorar modelos sin consentimiento explícito. Eso no resuelve por sí solo la persistencia ni la ubicación del procesamiento de tu aplicación. Cloudflare: uso de datos en Workers AI
Por ejemplo, los registros de AI Gateway están activados por defecto y pueden incluir entradas y respuestas. Revisa registros, almacenamiento, accesos y retención en toda tu arquitectura. «No se usa para entrenamiento» no es una garantía de inferencia exclusiva en la UE ni de retención cero. Confirma los requisitos contractuales y técnicos del despliegue concreto. Cloudflare: registros predeterminados de AI Gateway
Una lista de migración de Jev a Clef que detecta regresiones reales
Empieza con una decisión reversible. Congela la implementación anterior como referencia y ejecuta Clef en paralelo, sin modificar acciones reales. Define límites de aceptación antes de revisar el conjunto final de prueba. El registro de aprobación debería responder estas preguntas:
| Criterio | Evidencia que conservar | No aprobar cuando |
|---|---|---|
| API y esquema | Ejemplos HTTP reales, opciones permitidas, errores y configuración de variante | El procesamiento solo funciona en el caso ideal |
| Calidad de decisión | Errores aceptados, revisión humana y clases raras por idioma desplegado | La exactitud agregada oculta decisiones aceptadas perjudiciales |
| Semántica de confianza | Estadístico explícito, umbrales versionados y resultados independientes | Cambiar de proveedor altera silenciosamente la política de aceptación |
| Integridad de la evidencia | Pruebas de estados largos, imágenes y preguntas completas | El truncado o respaldo pierde evidencia necesaria |
| Operaciones | p95 de extremo a extremo, reintentos, coste medido y reversión probada | La mejora desaparece con carga representativa |
Mantén autorización, idempotencia y comprobaciones de transacciones en código determinista. Respetar el esquema no convierte el juicio del modelo en permiso para actuar. Durante el despliegue, registra la variante, la revisión del esquema, la política de aceptación y el resultado para poder investigar cambios posteriores sin almacenar datos personales innecesarios.
Recomendamos elegir Clef cuando una mejora medida de capacidad o despliegue justifique la migración, Flash solo cuando su calidad sea aceptable para la tarea y Jev cuando el comportamiento validado ya cumpla el requisito de forma más económica. Mantener el modelo existente también es una decisión técnica válida.
El servicio de ingeniería de IA de Wavect ayuda a convertir esta comparación en un plan de evaluación e integración. Utiliza la lista de QA previa al lanzamiento y comparte tu flujo de decisiones mediante ejemplos representativos sin datos sensibles.
El caso de Twinsoft AI aporta contexto sobre implementación de IA. No constituye evidencia de un despliegue de Clef.
Preguntas sobre la migración a Clef
¿Cloudflare Clev es lo mismo que Clef?
El nombre oficial es Cloudflare Clef. Clef y Clef-flash se anunciaron el 1 de octubre de 2026. Utiliza Clef para buscar documentación, pesos y endpoints de Workers AI. Anuncio original.
¿Puede Clef sustituir directamente a Jev?
Comparte una estructura tipada compatible, pero hay que probar transporte, selección de modelo, límites y semántica de confianza. El código local revisado no calcula la confianza de Choice con la fórmula documentada de Jev. Compatibilidad de API no implica equivalencia de políticas. Hallazgo de migración.
¿Es Clef más barato que Jev?
No por token de entrada publicado al 4 de octubre de 2026: Clef cuesta 0,24 dólares, Clef-flash 0,09 y Jev 0,042 por millón de tokens de entrada. El coste completo depende de errores, revisión, reintentos e infraestructura medidos. Cálculo y supuestos.
¿Conviene usar Clef o Clef-flash?
Prueba Clef para la decisión concreta que exige calidad o evidencia visual. Evalúa Flash por separado para tareas sensibles a la latencia. Los resultados publicados muestran diferencias importantes según la tarea; Flash no debe heredar automáticamente los umbrales ni la aprobación de Clef. Contraejemplos del benchmark.
¿Clef admite imágenes y vídeo?
El esquema alojado documenta imágenes incorporadas con límites de cantidad y tamaño. El modelo local también muestra entradas de fotogramas de vídeo. Son interfaces diferentes: confirma el contrato utilizado, sin asumir que un ejemplo local de vídeo funciona por el endpoint alojado de imágenes. Límites de entrada.
¿Tiene Clef el doble de contexto que Jev?
Es una descripción engañosa. Clef alojado documenta 65.536 tokens. Jev documenta 64k para la solicitud completa y 32k para el estado más la pregunta más larga. El auxiliar local de Clef revisado tiene un valor predeterminado de 16.384. Evalúa la estructura real de tu solicitud. Diferencia de contexto.
¿Puedo alojar Clef por mi cuenta?
Cloudflare publica pesos Apache-2.0, un cabezal de decisión conjunto y código de lanzamiento. El despliegue propio requiere componentes compatibles, capacidad suficiente y una capa operativa de servicio. El entorno H200 publicado no garantiza un requisito mínimo de hardware. Límites del despliegue.
¿Una confianza alta autoriza una acción?
No. La confianza resume una salida del modelo, no permisos ni corrección demostrada. Valida los errores aceptados, conserva una ruta de revisión y aplica autorización y reglas transaccionales fuera del modelo. Criterios de aprobación.
Reflexiones finales
Cloudflare Clef amplía la interfaz de decisiones similar a Jev con pesos abiertos y entradas visuales. El motivo para cambiar debe ser una mejora medida en tu flujo, no un titular. Revalida la confianza, conserva la evidencia y prueba la reversión antes de aprobar cualquiera de las variantes.
