El primer gusano de IA, "Morris II", y el problema de la inyección de instrucciones
Investigadores construyeron el primer gusano de IA capaz de secuestrar asistentes de correo electrónico con solo ser leído: malas noticias para quienes confían en la IA para manejar su bandeja de entrada.
- Un gusano llamado "Morris II" oculta instrucciones dentro de texto simple; un asistente de IA que lo lee puede filtrar contraseñas o números de tarjetas de crédito y transmitir la infección a sus contactos.
- No hace falta hacer clic ni descargar nada: engañó a ChatGPT, Gemini y a un modelo abierto en pruebas de laboratorio, y ninguno logró siquiera detectarlo.
- La falla no es un error que se pueda parchear: la IA lee todo de la misma manera, así que no puede distinguir una orden real de una implantada y escondida en un correo o una imagen.
- Se propaga casi sin costo, saltando entre asistentes y ejecutándose en las propias cuentas y la capacidad de cómputo de las víctimas.
- Las soluciones propuestas —separar la lectura de la acción, o añadir una IA de filtrado— todas ralentizan los procesos o comparten el mismo punto ciego, así que las empresas siguen priorizando el lanzamiento de funciones.
Perspectiva: por ahora Morris II se mantiene en el laboratorio, pero a medida que las empresas delegan más decisiones a los agentes de IA, este tipo de ataque parece difícil de detener.