Tema

IA y agentes

Ingeniería, operación y evaluación de sistemas de IA, agentes de código e infraestructura de modelos.

Artículos del blog
127
Clústeres enfocados
02

Clústeres enfocados

Empieza por el artículo fundamental

Tu bandeja, sin ruido

Recibe la próxima nota de campo sobre IA y agentes

Un correo breve cuando publiquemos. Sin píxeles de seguimiento ni contenido de relleno.

Lo último en esta colección

Nodo de enrutamiento turquesa conectado a tres destinos sobre un fondo oscuro de Wavect, con una ruta seleccionada resaltada IA y agentes

El router multiagente de Valyu de 0,6B: resultados, límites y adopción

Qwen3-0.6B entrenado supera a Haiku y Nova Lite con prompts en un estudio de selección de agentes de búsqueda. Qué demuestra la medición y qué falta para llevarlo a producción.

Núcleo de código geométrico y cuatro nodos de herramientas dentro de marcos de ejecución superpuestos sobre un fondo oscuro de Wavect IA y agentes

Agents API de OpenAI: migración, costes y controles de datos

Qué sustituye el harness gestionado de Codex, qué sigue siendo tu responsabilidad y cómo validar las cifras antes de migrar un flujo real.

Los archivos grandes se envían a un modelo auxiliar; Claude recibe resúmenes concretos y conserva el razonamiento IA y agentes

Spotify shunt: instalación, ahorro de tokens y límites

Qué mide el 90 % de Spotify, qué necesitas para usar Portal y cómo evaluar la delegación de archivos sin trasladar el ahorro a correcciones y revisión.

Tres compañeros de IA pasan por una pasarela de políticas y auditoría antes de usar navegador, archivos y MCP; las conversaciones se almacenan por separado IA y agentes

OpenBot: agentes autoalojados, costes y controles

Evaluación documental de OpenBot: qué aporta la pasarela de acciones, qué valores iniciales cambiar y cuándo conviene autoalojar en lugar de comprar un asistente gestionado.

Un móvil y un portátil reparten un gran modelo de lenguaje entre pestañas del navegador mientras WebRTC mueve activaciones entre ambos IA y agentes

SwarmLLM Review 2026: Inferencia LLM P2P entre móvil y portátil

Review para compradores de SwarmLLM: inferencia 27B en navegador, WebGPU/WebRTC, límites de benchmark, confianza entre peers, seguridad y plan de piloto.

Un agente de código en background recibe un prompt, restaura un snapshot de desarrollo preparado, trabaja dentro de un sandbox aislado, verifica el cambio y abre un pull request IA y agentes

Arquitectura de Ramp Inspect 2026: agentes de código en background

Cómo Ramp Inspect usa sandboxes de Modal, snapshots, coordinación y verificación, y qué controles necesita un equipo regulado antes de escalar agentes de código.

Directorio completo de artículos

  1. El router multiagente de Valyu de 0,6B: resultados, límites y adopción
  2. Agents API de OpenAI: migración, costes y controles de datos
  3. Spotify shunt: instalación, ahorro de tokens y límites
  4. OpenBot: agentes autoalojados, costes y controles
  5. SwarmLLM Review 2026: Inferencia LLM P2P entre móvil y portátil
  6. Arquitectura de Ramp Inspect 2026: agentes de código en background
  7. Model Hardware Standard: guía empresarial para IA física
  8. Fonio AI 2026: precios, API, RGPD y build vs buy
  9. Mosaic (YC S26): Memoria Compartida para Agentes de Código
  10. Ripwire Review 2026: contexto de repositorio para agentes sin embeddings
  11. Ediciones multarchivo atómicas para agentes de programación: la lección de Semaprax
  12. Review de Phonely Alma: ¿Está listo el LLM de voz para producción?
  13. Utopia: evaluar un grafo bitemporal empresarial
  14. Transferencia de conocimiento entre agentes de IA: descubre una vez y escala por menos
  15. claude-rotate: Un proxy para varias cuentas Claude Max
  16. NVIDIA PAIR: Routing de IA Local y la Brecha de AMD
  17. Feynman: análisis del agente de investigación IA open source
  18. Obscura Browser: análisis, límites y uso en producción
  19. Sistema de diseño para Claude Code: 4 piezas para una UI de marca
  20. Análisis de Tencent Hy4 Preview: ¿Merece un piloto con contexto de 1M?
  21. PageLM: autoalojamiento y uso comercial
  22. ChatGPT inicia sesión sin ver tu contraseña
  23. Mac mini M6 vs Mac Studio M5 para IA local: guía de compra
  24. Harness de agentes de IA: la capa de fiabilidad alrededor del LLM
  25. Análisis de FreeToken AI: ¿modelos MoE frontier en una GPU doméstica?
  26. Darkbloom AI: Inferencia Privada en Macs Inactivos
  27. Ox Alpha era GLM-5.3-Flash: qué ha cambiado
  28. Por qué las ediciones de agentes necesitan identidad semántica: SEMAPRAX en Rust
  29. LangChain Deep Agents: análisis del agent harness para producción
  30. Precios de Pika Audio API: ¿SFX cuesta de verdad 20 veces menos?
  31. La apuesta de $13M de Thunder Compute por virtualizar GPUs: guía de compra
  32. Análisis de OpenViking 2026: ¿Memoria de archivos lista para producción?
  33. LLM-as-a-Verifier: arquitectura, costes y uso en producción
  34. AirLLM con 4 GB de VRAM: cómo funciona la inferencia por capas
  35. TrueForge: análisis del agent harness open source para producción
  36. Webs legibles por agentes: llms.txt, espejos en Markdown y qué se rompe
  37. Qwen3.8-27B: agentes de computer use autoalojados sin exportar capturas
  38. Slugs localizados y hreflang: por qué mantenemos uno en inglés
  39. ¿Puede un agente de IA usar tu producto, o solo leer sobre él?
  40. Graft Review 2026: ¿el mapa del repo debe ir en Git?
  41. Cómo controlar los costes de agentes de código con compresión de salida
  42. Uso de tokens más inteligente con tu agente de programación IA
  43. DeepSeek Harness: análisis del stack de plugins para producción
  44. El stack vLLM y Triton de Netflix: 7 lecciones de producción
  45. Review de OpenSandbox: ¿Compensa el self-hosting?
  46. Transformers.js en el navegador: cuándo llevar la IA local a tu producto
  47. Cloudflare Kitesurf: costes, límites y producción
  48. Análisis de GitHub Spec Kit: ¿merece el proceso?
  49. Marketplace interno de agentes de IA: guía empresarial 2026
  50. Cómo autoalojar LiteLLM en producción: guía 2026
  51. Wiki empresarial preparada para IA: arquitectura e implementación
  52. ¿Es Linux el mejor sistema operativo para agentes de IA? Guía 2026
  53. ¿Claude añade marcas de agua al texto? Respuesta API 2026
  54. Review de OpenKB: compilador de conocimiento vs RAG
  55. Unsloth Desktop: ¿workstation privada de IA local?
  56. NeMo Switchyard 0.2: ¿routing de agentes sin entrenar?
  57. Firecrawl AnyDoc: 14 formatos a Markdown
  58. MCP Cloud vs Manufact Cloud: guía de hosting MCP
  59. Muse Glimmer 30B: ¿está listo el agente local de Meta para producción?
  60. Cómo hacer que la IA escriba como una persona con Agent Skills
  61. Análisis de NVIDIA NOOA: ¿están listos para producción sus agentes?
  62. Routing de IA con OmniRoute: Setup y Checklist de Producción
  63. Strix AI Pentesting: piloto de 30 días y guía de compra 2026
  64. Análisis de Hyperagent: agentes de IA sin servidor propio
  65. Gemini Robotics 2: control corporal completo y decisión de piloto
  66. Hark Handoff: el agente que sí hace clic
  67. Precio de Meta Muse Code: ¿Contributor es seguro para código de clientes?
  68. pdf-inspector: parser PDF local antes del OCR
  69. Ocultar PII antes del prompt: una pipeline práctica
  70. Agent Reach: costes, seguridad y límites reales
  71. Cloudflare Wallets para agentes de IA: ¿qué está activo?
  72. Asistente de programación con IA local multimodal: voz, OCR y privacidad
  73. DeepSeek V4 Flash 0731 en un PC de IA: ¿qué funciona?
  74. Review de YC QM Agent: ¿está listo Quartermaster?
  75. jcode vs Claude Code: ¿Merece la pena cambiar al harness en Rust?
  76. Lightpanda para agentes de IA: guía de producción
  77. Ingeniería de grafos para agentes de IA: ¿Cuándo compensa un knowledge graph?
  78. Stack multimodelo de agentes de código: guía de compra para equipos
  79. ¿MCP ahora es stateless? Checklist para migrar tu servidor
  80. MCP no es un límite de seguridad: protege los datos
  81. Cómo afinar Gemma 4 gratis con Unsloth y Colab
  82. ¿Pueden comunicarse dos agentes de IA? Guía de Band
  83. Taalas HC1 a examen: ¿compensa un ASIC para un solo LLM?
  84. LeanCTX en una Agencia: Informe Técnico con Datos Reales
  85. ¿Qué LLM local puedes ejecutar? Guía de llmfit para tu hardware
  86. Cómo usar GPT-5.6 Sol en Claude Code con CLIProxyAPI
  87. Miso TTS autoalojado vs API: coste, latencia y VRAM
  88. Arquitectura de autorización MCP para empresas
  89. Comprime vectores RAG a 2 bits: ¿está lista para producción la cuantización sin datos?
  90. LMCache reportó un TTFT medio 13,7x menor con una caché KV compartida
  91. Compresión LLM sin Pérdida vs 8-bit GGUF: ¿Qué Está Listo?
  92. Escape de la Sandbox de OpenAI: 12 Controles para Agentes de Ciberseguridad
  93. Review de Cisco Antares: IA local 1B para localizar vulnerabilidades
  94. Análisis de Meterless 2026: ¿Está listo su context layer?
  95. NVIDIA Nemotron 3.5 ASR: ¿Está listo el STT self-hosted para voice agents?
  96. Claude Code vs OpenCode: ¿Cuál cuesta menos a un equipo en 2026?
  97. Kimi K3 para Empresas de la UE: Coste API, Datos y Plan de Piloto
  98. Mesh LLM: ¿Puede un LLM Ejecutarse en Varios Ordenadores?
  99. Review de Graphify 2026: ¿Merece la pena un grafo de conocimiento del código?
  100. Review de Bonsai 27B: ¿Puede un LLM de 27B Ejecutarse en un Móvil?
  101. Scorecard para Cancelar o Escalar un Piloto de IA: 12 Métricas Tras 30 Días
  102. Soofi S: ¿Está listo para empresas el LLM soberano de Alemania?
  103. Review de T3MP3ST 2026: ¿Sustituye una prueba de penetración?
  104. Colibri Ejecuta GLM-5.2 en Hardware de Consumo. Esta Es la Trampa.
  105. Open Knowledge Format (OKF): guía para empresas
  106. AI Agent Cost per Action: Por Qué los Flujos Agentic Disparan la Factura de Tokens
  107. Cuándo los Modelos Locales Superan a las APIs: Calculadora Break-Even para Empresas de la UE
  108. Calculadora de Costes LLM 2026: Coste por Tarea, No por Token
  109. Review de Pxpipe: ¿reduce un 60% el coste de Claude Code?
  110. Más barato por token todavía puede costar más por tarea
  111. Cómo usar Claude Fable 5.1 en Claude Code
  112. Anthropic rechaza prohibir pesos abiertos. La guerra de costes sigue.
  113. Cuánto cuesta de verdad un asistente de IA interno en la región DACH (2026)
  114. Gateways LLM Comparados 2026: LiteLLM vs OpenRouter vs Portkey vs RouteLLM
  115. Alojar LLMs en la UE: Cuándo Salen a Cuenta los Open Weights
  116. Mejores LLM de pesos abiertos 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama
  117. El cuello de botella nunca fue la inteligencia. Fue el contexto.
  118. ChatGPT Enterprise vs. Copilot vs. RAG propio en DACH
  119. ¿MCP, RAG, Agent Skills o Custom GPTs?
  120. Cómo Reducir los Costes de Tokens LLM en 2026
  121. Piloto de agente de IA en 30/60/90 días: el plan
  122. RAG sobre SharePoint, Confluence y Drive: permissions-first
  123. Checklist de Production-Readiness de RAG para Empresas de la UE
  124. ¿Cuándo vale la pena construir un eval de LLM? Coste, ROI y confiar en el juez
  125. Por qué se cancelan los proyectos de agentes de IA
  126. ¿RAG, fine-tuning o contexto largo? Comparativa 2026
  127. Costes de APIs LLM 2026. Cambio de Arquitectura