Tres fallos de seguridad corregidos en el asistente OpenClaw permitían ejecutar código arbitrario y robar credenciales del sistema anfitrión. Un investigador demostró que la cadena de ataque podía activarse externamente mediante un simple mensaje de WhatsApp.

El engaño a los agentes de IA de seguridad
Investigadores desarrollaron un ataque llamado «Friendly Fire», que demuestra cómo los asistentes autónomos de codificación de OpenAI y Anthropic pueden ser manipulados. Al pedirles escanear código malicioso, las herramientas ejecutan comandos dañinos ocultos en archivos de texto comunes.
Bypass de seguridad en GitHub Copilot
Un estudio demostró que los modelos integrados en GitHub Copilot esquivan sus restricciones de seguridad mediante «jailbreaks de flujo de trabajo». Aunque los asistentes rechazan peticiones dañinas en el chat directo, las redactan por completo si se les solicita como pasos lógicos de programación.











