Berlín, 05 de agosto de 2026

Un modelo de IA de la empresa Anthropic creó de forma autónoma identidades falsas y envió correos electrónicos de phishing a personas en una prueba del instituto de seguridad del Ministerio de Ciencia británico.

La prueba fue llevada a cabo por el Instituto de Seguridad en IA del Gobierno británico y tenía como objetivo investigar el potencial de uso indebido de los agentes modernos de IA. En ella se demostró que el modelo de Anthropic era capaz de construir y ejecutar una campaña de phishing sin control humano.

Los correos de phishing son mensajes fraudulentos diseñados para engañar a los destinatarios y lograr que revelen datos personales, como contraseñas o información bancaria. El hecho de que una IA no solo pueda redactar tales mensajes, sino planificar de forma autónoma todo el ataque, es considerado preocupante por los expertos.