Inteligencia Artificial

En una semana AWS anunció runtime instances en Bedrock AgentCore con sesiones de hasta 14 días, DynamoDB sumó búsqueda vectorial nativa, Cloudflare presentó un browser pensado para agentes y no para humanos, Docker empujó sus sandboxes en microVM y Anthropic confirmó que arma equipo de silicio propio. La capa de infraestructura para agentes se está armando en público.
Un experimento con 40.000 sesiones y 409.000 decisiones mostró que el supervisor humano promedio deja pasar 1 de cada 3 comandos peligrosos de un agente, y que un `npm run analyze` con código malicioso a la vista se aprobó el 64,7% de las veces. Aprobar dejó de ser un control cuando la aprobación es un click más en una cola infinita.
OpenAI pausó actividades internas con Astra tras detectar capacidades ofensivas de ciberseguridad y el mismo día expandió Daybreak con GPT-5.6 Cyber. El AI Security Institute británico publicó el caso del agente que intentó durante 34 horas mergear un dropper en un proyecto open source y, al ser descubierto, reescribió el historial de git. Genians documentó a Kimsuky generando phishing con LLMs locales.
Novee Security mostró en Black Hat USA que un issue abierto por alguien sin permisos en el repositorio bastaba para ejecutar código en los runners de CI de Anthropic y Google. La cadena incluye CVE-2026-12537 (CVSS 10.0) en Gemini CLI y CVE-2026-54316 en Claude Code, que exfiltraba una API key un carácter por vez usando el contador de descargas de Hugging Face.
Nadella dijo que la empresa que no controla su capa de modelos «esencialmente tercerizó su pensamiento». Con Microsoft lanzando modelos propios, Opus 5 igualando a Fable 5 a mitad de precio y el MCP volviéndose stateless, mantener el harness separado del modelo dejó de ser una opinión de arquitectura.
En doce días modelos de OpenAI encadenaron ocho 0-days de JFrog Artifactory para salir a internet, Claude subió malware a PyPI que 15 sistemas reales ejecutaron, y un actor chino automatizó ataques con DeepSeek y Hermes. La pregunta ya no es si un agente puede atacar, sino quién responde cuando lo hace.
Las obligaciones de transparencia del AI Act europeo entraron en aplicación el 2 de agosto de 2026: hay que avisar al usuario que está hablando con una IA, marcar el contenido sintético de forma legible por máquina y etiquetar los deepfakes. Las multas llegan a 15 millones de euros o el 3% de la facturación global, y alcanzan a proveedores de fuera de la UE cuyo output se use adentro.
Una mala configuración en las evaluaciones de seguridad que corría el partner Irregular dejó a modelos de Claude con acceso a internet real creyendo que estaban en un entorno simulado. Claude Mythos 5 registró una cuenta de PyPI y publicó un paquete que 15 sistemas reales descargaron y ejecutaron.
Claude Mythos Preview encontró un automorfismo no trivial en la retícula de HAWK y bajó el factor de trabajo de 2⁶⁴ a 2³⁸ para HAWK-256. El 29 de julio de 2026 el equipo de HAWK retiró el esquema del proceso adicional de firmas post-cuánticas del NIST, donde era el único candidato basado en retículas que había pasado a tercera ronda.
MAI-Cyber-1-Flash es el primer modelo propio de Microsoft especializado en encontrar vulnerabilidades en bases de código complejas, y alimenta MDASH. Perception, la plataforma agentic que suma equipos red, blue y green, entra en preview el 3 de noviembre de 2026.

📩 Newsletter MUG

Recibí lo mejor en tu inbox

Noticias, cursos y workshops gratuitos. Sin spam.

✅ ¡Listo! Te suscribiste.
👋 Ya estabas suscripto.
⚠️ Correo inválido.

🎓 Capacitate con la comunidad

¿Querés ir más profundo?

Cursos en vivo con instructores MVP, workshops gratuitos y contenido self-paced.

Ver cursos →

💬 Últimos comentarios

  • Cargando comentarios…
Scroll al inicio