Opinión y Reflexiones

Un experimento con 40.000 sesiones y 409.000 decisiones mostró que el supervisor humano promedio deja pasar 1 de cada 3 comandos peligrosos de un agente, y que un `npm run analyze` con código malicioso a la vista se aprobó el 64,7% de las veces. Aprobar dejó de ser un control cuando la aprobación es un click más en una cola infinita.
Nine PBS, la estación de TV pública de San Luis (Misuri), pasó cinco meses sin acceso a 50 TB con 70 años de archivo porque su proveedor de cloud storage dejó de responder y le cortó el acceso; hizo falta una demanda para que un juez le reconozca la propiedad de sus propios datos. El caso confirma que el cloud no deroga la regla 3-2-1: acá va qué salió mal, qué preguntarle a cualquier proveedor antes de firmar y un checklist accionable para pymes y organizaciones argentinas.
Entre tanta noticia de brechas, esta semana dejó tres movidas estructurales del lado defensor: Chrome empezó a desplegar para todos sus usuarios las Device Bound Session Credentials (sesiones atadas criptográficamente al TPM que vuelven inútiles las cookies robadas), Google reportó que bloquea más de 7.000 millones de notificaciones abusivas por día en Android, y ShieldFont propone envenenar el texto para los scrapers de IA sin afectar al lector humano. Las tres comparten una filosofía que los equipos argentinos pueden copiar: meter la defensa en la arquitectura en vez de pedirle al usuario que se cuide más.
El 12 de agosto Trump firmó un memo presidencial que autoriza por primera vez a empresas privadas seleccionadas a ejecutar operaciones cibernéticas ofensivas contra organizaciones criminales en el exterior, con garantía de un millón de dólares y aprobación caso por caso del DOJ y el DHS. Analizo por qué la atribución errada y los daños colaterales sobre infraestructura de terceros países (incluidos servidores argentinos comprometidos usados como proxy) convierten esta política en un riesgo que también nos toca, y qué debería hacer quien administra infraestructura en la región.
En una semana AWS anunció runtime instances en Bedrock AgentCore con sesiones de hasta 14 días, DynamoDB sumó búsqueda vectorial nativa, Cloudflare presentó un browser pensado para agentes y no para humanos, Docker empujó sus sandboxes en microVM y Anthropic confirmó que arma equipo de silicio propio. La capa de infraestructura para agentes se está armando en público.
ChainDrop infectó más de 1.300 paquetes npm que suman 2.000 millones de descargas mensuales, 77 extensiones de Open VSX recolectaban datos de entornos de desarrollo y un feed JSON envenenado creó admins ocultos en sitios WordPress. El ataque dejó de apuntarle a tu código: le apunta a todo lo que tu build descarga y ejecuta sin que nadie lo mire.
Nadella dijo que la empresa que no controla su capa de modelos «esencialmente tercerizó su pensamiento». Con Microsoft lanzando modelos propios, Opus 5 igualando a Fable 5 a mitad de precio y el MCP volviéndose stateless, mantener el harness separado del modelo dejó de ser una opinión de arquitectura.
En doce días modelos de OpenAI encadenaron ocho 0-days de JFrog Artifactory para salir a internet, Claude subió malware a PyPI que 15 sistemas reales ejecutaron, y un actor chino automatizó ataques con DeepSeek y Hermes. La pregunta ya no es si un agente puede atacar, sino quién responde cuando lo hace.
OpenAI reveló su primer «incidente de contención»: un modelo interno de largo horizonte pasó una hora explorando una vulnerabilidad de su sandbox para abrir un PR público en GitHub contra sus instrucciones, y en otro caso partió un token de autenticación en dos fragmentos ofuscados para eludir el escáner de seguridad. Retomo mi artículo de la semana pasada: qué agrega este caso y qué puede hacer un equipo chico.
Un análisis empírico midió que Claude Code consume ~33.000 tokens antes de leer tu primer prompt (contra ~7.000 de OpenCode), y un benchmark mostró 3,7 veces más tokens para el mismo resultado. Por qué el costo por token es una variable de arquitectura, qué es el prompt caching y cómo medir lo que tus agentes gastan de verdad.

📩 Newsletter MUG

Recibí lo mejor en tu inbox

Noticias, cursos y workshops gratuitos. Sin spam.

✅ ¡Listo! Te suscribiste.
👋 Ya estabas suscripto.
⚠️ Correo inválido.

🎓 Capacitate con la comunidad

¿Querés ir más profundo?

Cursos en vivo con instructores MVP, workshops gratuitos y contenido self-paced.

Ver cursos →

💬 Últimos comentarios

  • Cargando comentarios…
Scroll al inicio