Tema

IA y agentes

Ingeniería, operación y evaluación de sistemas de IA, agentes de código e infraestructura de modelos.

Artículos del blog
101
Clústeres enfocados
02

Clústeres enfocados

Empieza por el artículo fundamental

Lo último en esta colección

Modelo de IA stealth gratuito Ox Alpha mediante OpenCode Zen y OpenRouter con controles de privacidad y costes IA y agentes

Ox Alpha Free: configuración, privacidad y guía de compra

Usa el modelo stealth de programación con contexto de 1M en OpenCode u OpenRouter. Compara IDs, privacidad, costes extra y un piloto seguro.

Grafo de compilador Rust que conecta identidades persistentes con parches semánticos verificados IA y agentes

Por qué las ediciones de agentes necesitan identidad semántica: SEMAPRAX en Rust

Un recorrido de ingeniería por IDs persistentes, HIR comprobado, grafos deterministas y parches reproducibles en el lenguaje experimental SEMAPRAX.

LangChain Deep Agents conecta planificación, subagentes, archivos, aprobaciones, sandboxes y trazas de producción IA y agentes

LangChain Deep Agents: análisis del agent harness para producción

Análisis orientado a compra de arquitectura, cambios de v0.7, límites de seguridad, costes operativos y un piloto medible.

Cuatro modelos de la API Pika Audio para efectos, voz, música y bandas sonoras sincronizadas con controles de coste IA y agentes

Precios de Pika Audio API: ¿SFX cuesta de verdad 20 veces menos?

Pika publica SFX a 0,0002 USD por segundo y otros tres modelos de audio. Calcula el umbral, los límites y el encaje en producción antes de migrar.

Cargas GPU compartiendo una flota de aceleradores mediante una capa de virtualización IA y agentes

La apuesta de $13M de Thunder Compute por virtualizar GPUs: guía de compra

Thunder Compute afirma que el pooling de GPU recupera capacidad ociosa. Compara virtualización de red, MIG, vGPU y passthrough y diseña un piloto empresarial medible.

OpenViking conecta memoria de agentes, recursos RAG y skills mediante rutas viking en un sistema de archivos IA y agentes

Análisis de OpenViking 2026: ¿Memoria de archivos lista para producción?

Review para compradores de OpenViking para memoria y RAG: arquitectura, riesgo AGPL, seguridad, coste operativo y piloto medible de dos semanas.

Directorio completo de artículos

  1. Ox Alpha Free: configuración, privacidad y guía de compra
  2. Por qué las ediciones de agentes necesitan identidad semántica: SEMAPRAX en Rust
  3. LangChain Deep Agents: análisis del agent harness para producción
  4. Precios de Pika Audio API: ¿SFX cuesta de verdad 20 veces menos?
  5. La apuesta de $13M de Thunder Compute por virtualizar GPUs: guía de compra
  6. Análisis de OpenViking 2026: ¿Memoria de archivos lista para producción?
  7. LLM-as-a-Verifier: arquitectura, costes y uso en producción
  8. AirLLM con 4 GB de VRAM: cómo funciona la inferencia por capas
  9. TrueForge: análisis del agent harness open source para producción
  10. Webs legibles por agentes: llms.txt, espejos en Markdown y qué se rompe
  11. Qwen3.8-27B: agentes de computer use autoalojados sin exportar capturas
  12. Las URLs traducidas rompen hreflang: usa un solo slug en inglés
  13. ¿Puede un agente de IA usar tu producto, o solo leer sobre él?
  14. Graft Review 2026: ¿el mapa del repo debe ir en Git?
  15. Cómo controlar los costes de agentes de código con compresión de salida
  16. Uso de tokens más inteligente con tu agente de programación IA
  17. DeepSeek Harness: análisis del stack de plugins para producción
  18. El stack vLLM y Triton de Netflix: 7 lecciones de producción
  19. Review de OpenSandbox: ¿Compensa el self-hosting?
  20. Transformers.js en el navegador: cuándo llevar la IA local a tu producto
  21. Cloudflare Kitesurf: costes, límites y producción
  22. Análisis de GitHub Spec Kit: ¿merece el proceso?
  23. Marketplace interno de agentes de IA: guía empresarial 2026
  24. Cómo autoalojar LiteLLM en producción: guía 2026
  25. Wiki empresarial preparada para IA: arquitectura e implementación
  26. ¿Es Linux el mejor sistema operativo para agentes de IA? Guía 2026
  27. ¿Claude añade marcas de agua al texto? Respuesta API 2026
  28. Review de OpenKB: compilador de conocimiento vs RAG
  29. Unsloth Desktop: ¿workstation privada de IA local?
  30. NeMo Switchyard 0.2: ¿routing de agentes sin entrenar?
  31. Firecrawl AnyDoc: 14 formatos a Markdown
  32. MCP Cloud vs Manufact Cloud: guía de hosting MCP
  33. Muse Glimmer 30B: ¿está listo el agente local de Meta para producción?
  34. Cómo hacer que la IA escriba como una persona con Agent Skills
  35. Análisis de NVIDIA NOOA: ¿están listos para producción sus agentes?
  36. Routing de IA con OmniRoute: Setup y Checklist de Producción
  37. Strix AI Pentesting: piloto de 30 días y guía de compra 2026
  38. Análisis de Hyperagent: agentes de IA sin servidor propio
  39. Gemini Robotics 2: control corporal completo y decisión de piloto
  40. Hark Handoff: el agente que sí hace clic
  41. Precio de Meta Muse Code: ¿Contributor es seguro para código de clientes?
  42. pdf-inspector: parser PDF local antes del OCR
  43. Ocultar PII antes del prompt: una pipeline práctica
  44. Agent Reach: costes, seguridad y límites reales
  45. Cloudflare Wallets para agentes de IA: ¿qué está activo?
  46. Asistente de programación con IA local multimodal: voz, OCR y privacidad
  47. DeepSeek V4 Flash 0731 en un PC de IA: ¿qué funciona?
  48. Review de YC QM Agent: ¿está listo Quartermaster?
  49. jcode vs Claude Code: ¿Merece la pena cambiar al harness en Rust?
  50. Lightpanda para agentes de IA: guía de producción
  51. Ingeniería de grafos para agentes de IA: ¿Cuándo compensa un knowledge graph?
  52. Stack multimodelo de agentes de código: guía de compra para equipos
  53. ¿MCP ahora es stateless? Checklist para migrar tu servidor
  54. MCP no es un límite de seguridad: protege los datos
  55. Cómo afinar Gemma 4 gratis con Unsloth y Colab
  56. ¿Pueden comunicarse dos agentes de IA? Guía de Band
  57. Taalas HC1 a examen: ¿compensa un ASIC para un solo LLM?
  58. LeanCTX en una Agencia: Informe Técnico con Datos Reales
  59. ¿Qué LLM local puedes ejecutar? Guía de llmfit para tu hardware
  60. Cómo usar GPT-5.6 Sol en Claude Code con CLIProxyAPI
  61. Miso TTS autoalojado vs API: coste, latencia y VRAM
  62. Arquitectura de autorización MCP para empresas
  63. Reduce 16x la memoria de vectores de tu RAG: ¿está lista para producción la cuantización sin datos?
  64. Una caché KV compartida redujo 14x la latencia de inferencia de un LLM, sin GPUs nuevas
  65. Compresión LLM sin Pérdida vs 8-bit GGUF: ¿Qué Está Listo?
  66. Escape de la Sandbox de OpenAI: 12 Controles para Agentes de Ciberseguridad
  67. Review de Cisco Antares: IA local 1B para localizar vulnerabilidades
  68. Análisis de Meterless 2026: ¿Está listo su context layer?
  69. NVIDIA Nemotron 3.5 ASR: ¿Está listo el STT self-hosted para voice agents?
  70. Claude Code vs OpenCode: ¿Cuál cuesta menos a un equipo en 2026?
  71. Kimi K3 para Empresas de la UE: Coste API, Datos y Plan de Piloto
  72. Mesh LLM: ¿Puede un LLM Ejecutarse en Varios Ordenadores?
  73. Review de Graphify 2026: ¿Merece la pena un grafo de conocimiento del código?
  74. Review de Bonsai 27B: ¿Puede un LLM de 27B Ejecutarse en un Móvil?
  75. Scorecard para Cancelar o Escalar un Piloto de IA: 12 Métricas Tras 30 Días
  76. Soofi S: ¿Está listo para empresas el LLM soberano de Alemania?
  77. Review de T3MP3ST 2026: ¿Sustituye una prueba de penetración?
  78. Colibri Ejecuta GLM-5.2 en Hardware de Consumo. Esta Es la Trampa.
  79. Open Knowledge Format (OKF): guía para empresas
  80. AI Agent Cost per Action: Por Qué los Flujos Agentic Disparan la Factura de Tokens
  81. Cuándo los Modelos Locales Superan a las APIs: Calculadora Break-Even para Empresas de la UE
  82. Calculadora de Costes LLM 2026: Coste por Tarea, No por Token
  83. Review de Pxpipe: ¿reduce un 60% el coste de Claude Code?
  84. Más barato por token. Más caro por respuesta.
  85. Cómo usar Claude Fable 5 en Claude Code
  86. Dario Le Declaró la Guerra al Código Abierto. La Guerra Real Es Por Tu Factura de IA.
  87. Cuánto cuesta de verdad un asistente de IA interno en la región DACH (2026)
  88. Gateways LLM Comparados 2026: LiteLLM vs OpenRouter vs Portkey vs RouteLLM
  89. Alojar LLMs en la UE: Cuándo Salen a Cuenta los Open Weights
  90. Mejores LLM de pesos abiertos 2026: DeepSeek vs Qwen vs Kimi vs GLM vs Llama
  91. El cuello de botella nunca fue la inteligencia. Fue el contexto.
  92. ChatGPT Enterprise vs. Copilot vs. RAG propio en DACH
  93. ¿MCP, RAG, Agent Skills o Custom GPTs?
  94. Cómo Reducir los Costes de Tokens LLM en 2026
  95. Piloto de agente de IA en 30/60/90 días: el plan
  96. RAG sobre SharePoint, Confluence y Drive: permissions-first
  97. Checklist de Production-Readiness de RAG para Empresas de la UE
  98. ¿Cuándo vale la pena construir un eval de LLM? Coste, ROI y confiar en el juez
  99. Por Qué el 40% de los Proyectos de Agentes IA Mueren
  100. ¿RAG, fine-tuning o contexto largo? Comparativa 2026
  101. Costes de APIs LLM 2026. Cambio de Arquitectura