DESDE LAS TRINCHERAS Número №164

Opiniones, No Comunicados de Prensa

Una portada seleccionada conduce a temas y clústeres enfocados para que los artículos antiguos no pierdan visibilidad solo por su edad.

Explorar por tema
06
Clústeres enfocados
12
Artículos del blog
164

Artículos recientes

Nueve artículos por página, ordenados por fecha de publicación.

Comparativa de Floci, LocalStack y AWS SAM para pruebas de integración locales Entrega y QA

Floci vs LocalStack: análisis del emulador AWS en 2026

Guía de compra verificada sobre Floci, LocalStack, AWS SAM y AWS real: fidelidad, cobertura, licencia, encaje en CI y migración con poco riesgo.

Una onda de voz que se divide entre la API gestionada de Miso TTS y una GPU privada autoalojada IA y agentes

Miso TTS autoalojado vs API: coste, latencia y VRAM

Miso TTS es expresivo y tiene pesos abiertos, pero los 110 ms corresponden a la API alojada en H100, no a la inferencia local. Compara hardware, precio, licencia y riesgo.

Un cliente MCP presenta un token vinculado a una audiencia a un resource server que lo valida contra un proveedor de identidad antes de ejecutar cualquier herramienta IA y agentes

Arquitectura de autorización MCP para empresas

OAuth 2.1, tokens vinculados a una audiencia y prohibir el token passthrough son las reglas duras de la especificación. El resto, aislamiento multi-tenant, scopes por herramienta, acceso delegado y auditoría, es diseño de referencia. Aquí tienes toda la frontera de confianza en dos diagramas.

Las obligaciones de transparencia del Artículo 50 de la Ley de IA como checklist de implementación para chatbots SaaS, agentes de IA y contenido generado Negocio y regulación

Checklist del Artículo 50 de la Ley de IA para SaaS y agentes de IA

El Artículo 50 aplica el 2 de agosto de 2026. La checklist técnica de implementación: aviso de chatbot y agente, marcado C2PA, etiquetas de deepfake, texto de interés público, logging y las evidencias para una auditoría.

Cuantización de vectores independiente de los datos que comprime un campo denso de embeddings float32 en una rejilla compacta de 2 bits con 16x menos memoria IA y agentes

Reduce 16x la memoria de vectores de tu RAG: ¿está lista para producción la cuantización sin datos?

Un nuevo índice Rust reduce 10M embeddings de 31 GB a 4 GB con el TurboQuant sin entrenamiento de Google. Qué prueba el método, dónde gana a FAISS, el compromiso de recall y cómo pilotarlo.

Ocho cachés KV aisladas por rank en un mismo servidor colapsando en una unica capa de caché compartida del lado del host que cualquier proceso de servicio puede leer IA y agentes

Una caché KV compartida redujo 14x la latencia de inferencia de un LLM, sin GPUs nuevas

Una capa de caché KV de codigo abierto redujo el time-to-first-token medio de 3.98s a 0.29s en un modelo de 235B. Las mismas GPUs, la misma memoria. Evito que ocho procesos acapararan cachés privadas. Que cambio y si te ayuda a ti.

Compresión sin pérdida de pesos BF16 frente a 8-bit GGUF en exactitud, evidencia de runtime y preparación para producción IA y agentes

Compresión LLM sin Pérdida vs 8-bit GGUF: ¿Qué Está Listo?

Decisión contrastada sobre GLM-5.2, decodificación BF16 exacta, quantization Q8, evidencia de runtime, economía de flota y piloto de 14 días.

Piloto de pago, prueba de concepto y design partner comparados por su evidencia comercial Producto y MVP

Piloto de Pago vs PoC vs Design Partner: ¿Qué Valida Demanda?

Guía para elegir entre viabilidad técnica, aprendizaje con clientes o disposición a pagar, con scorecard de siete condiciones y brief contractual.

Sandbox anidada para evaluar agentes de IA con cómputo aislado, egress controlado, credenciales efímeras y monitorización externa IA y agentes

Escape de la Sandbox de OpenAI: 12 Controles para Agentes de Ciberseguridad

Análisis verificado y checklist de compra sobre aislamiento anidado, egress, credenciales, separación del control plane, integridad del benchmark, monitorización y forense.

Tu bandeja, sin ruido

Sigue el trabajo que te importa

Recibe un correo breve cuando publiquemos algo nuevo. Sigue todo el blog o solo los temas que te interesan.

¿Qué quieres recibir?
Elige tus temas

Gratis, doble opt-in y sin píxeles de seguimiento.