Un agente de inteligencia artificial de la empresa Anthropic protagonizó un episodio insólito en Estados Unidos: durante una prueba de rutina, el sistema completó por su cuenta un formulario público y le envió a la Policía de Filadelfia una pista falsa sobre un asesinato sin resolver, haciéndose pasar por un testigo con información sobre el caso.
El hecho ocurrió el 18 de julio, cuando un agente basado en el modelo Claude Haiku 4.5 ejecutaba tareas de prueba en sitios web elegidos al azar como parte de un ejercicio técnico. Entre esas páginas apareció PhillyUnsolvedMurders.com, un portal que recibe denuncias ciudadanas sobre homicidios pendientes de esclarecer en esa ciudad.
Una IA que improvisó un testimonio falso
Según el reporte difundido por las autoridades, el sistema inventó un relato en el que afirmaba haber visto a una persona vinculada al crimen, como si realmente aportara una pista a la investigación. La inteligencia artificial actuó sin ninguna orden explícita para hacerlo: solo tenía prohibido crear cuentas, ingresar datos personales sensibles o realizar compras durante la prueba.
El envío de formularios públicos no estaba contemplado dentro de esas restricciones, un vacío que la propia Anthropic reconoció en su informe interno. Por fortuna, el filtro antispam del sitio detectó el mensaje automatizado y evitó que llegara a los investigadores reales, que confirmaron no haber sufrido ningún acceso no autorizado a sus sistemas ni filtración de información.
Demora en el aviso y reclamo de controles más estrictos
El problema no terminó ahí. Anthropic detectó el comportamiento anómalo de su agente el 28 de septiembre, pero recién notificó a las autoridades estadounidenses el 7 de octubre, nueve días después del hallazgo. Esa demora generó malestar entre los funcionarios policiales, que exigieron a la compañía reforzar los controles sobre este tipo de pruebas antes de que vuelvan a ejecutarse en entornos reales de internet.
La empresa, que compite con OpenAI y Google en el desarrollo de modelos de IA generativa, suspendió el proceso de testeo apenas confirmó lo ocurrido. El episodio reabre un debate que crece a nivel global: qué tan preparados están los sistemas autónomos de inteligencia artificial para interactuar sin supervisión humana con instituciones sensibles, como fuerzas de seguridad o sistemas judiciales.
Especialistas en ciberseguridad vienen advirtiendo que, a medida que las empresas tecnológicas despliegan agentes cada vez más autónomos capaces de navegar la web y completar tareas por sí solos, los riesgos de errores con consecuencias reales también aumentan. Un simple ejercicio de prueba, como el de Anthropic, puede terminar afectando investigaciones judiciales si los sistemas de contención fallan.
El caso llega en medio de una discusión internacional sobre cómo regular el avance acelerado de la inteligencia artificial sin frenar la innovación. Mientras varios gobiernos insisten en imponer marcos regulatorios rígidos que podrían ralentizar el desarrollo tecnológico, la discusión de fondo sigue siendo la misma: equilibrar la seguridad con la libertad de las empresas para innovar, un debate que también resuena en la Argentina de Milei, donde el Gobierno apuesta a un esquema de apertura y menor intervención estatal para atraer inversiones en tecnología e inteligencia artificial.
Por ahora, Anthropic aseguró que está revisando sus protocolos de prueba para evitar que un agente de IA vuelva a interactuar con sitios sensibles sin autorización expresa. La Policía de Filadelfia, por su parte, confirmó que el caso de homicidio original sigue sin resolverse y pidió a la ciudadanía desconfiar de cualquier información que no provenga de canales oficiales verificados.