Tecnología

Una inteligencia artificial fingió saber sobre un asesinato y envió información falsa a la policía

La empresa descubrió el incidente dos meses después de que su IA enviara el reporte.

GoogleSiga de cerca las tendencias en tecnología y ciencia en Discover

9 de octubre de 2026 a las 8:40 p. m.
El sistema afirmó tener información sobre un crimen que continúa sin resolverse en Estados Unidos.
El sistema afirmó tener información sobre un crimen que continúa sin resolverse en Estados Unidos. Foto: Getty Images

Un modelo de inteligencia artificial desarrollado por Anthropic envió información falsa sobre un homicidio sin resolver a la policía de Filadelfia, en Estados Unidos. Las autoridades cuestionaron a la compañía por tardar dos meses en informar sobre el incidente, ocurrido durante una prueba automatizada.

Donald Trump defendió a la IA
Donald Trump sorprende con una nueva exigencia sobre la inteligencia artificial: quien no use otro término será un “enemigo”

¿Cómo terminó una IA enviando información falsa a la policía?

El Departamento de Policía de Filadelfia indicó que el reporte fue enviado en julio a través de PhillyUnsolvedMurders.com, un sitio web público habilitado para recibir información sobre asesinatos sin resolver.

Según la versión de Anthropic, difundida por las autoridades, el modelo estaba realizando una prueba que consistía en interactuar con sitios web seleccionados al azar. Durante ese proceso, accedió a la página y envió información falsa sobre uno de los homicidios que permanecen sin resolver.

Una página destinada a recibir pistas sobre asesinatos recibió información falsa generada por un modelo de IA.
La policía de Filadelfia confirmó que el mensaje llegó en julio a través de su portal de casos sin resolver. Foto: Getty Images

La inteligencia artificial se presentó como alguien que podría tener conocimiento del caso. Sin embargo, la denuncia, fechada el 18 de julio, fue marcada como spam y nunca llegó al Centro de Delitos en Tiempo Real de la policía para su verificación.

Las autoridades aclararon que no había indicios de que los sistemas policiales hubieran sido vulnerados.

Anthropic tardó dos meses en informar sobre el incidente

Anthropic descubrió lo ocurrido el 28 de septiembre. Después de identificar el problema, desactivó el proceso de pruebas automatizadas responsable del incidente y añadió un nuevo paso de validación para futuras pruebas, según informó la policía.

La compañía alertó al Departamento de Policía de Filadelfia el 7 de octubre y ambas partes se reunieron al día siguiente.

“La demora de dos meses en detectar y reportar el incidente a la ciudad es inaceptable”, declaró la policía.

Fotografía ilustrativa que muestra el logotipo de Claude en un teléfono inteligente y el logotipo de Anthropic en una pantalla de computadora, destacando la creciente competencia entre las principales empresas de inteligencia artificial y la rápida evolución de las tecnologías de inteligencia artificial, en Túnez, el 24 de mayo de 2026. (Foto de Imen Ben Youssef / Hans Lucas vía AFP)
Anthropic detectó el incidente en septiembre, desactivó la prueba responsable y añadió controles para evitar nuevos casos. Foto: Hans Lucas via AFP

La institución afirmó que sus medidas de seguridad habían limitado el impacto, pero advirtió que eso “no disminuye la gravedad de que un sistema de IA presente información falsificada como si proviniera de una persona con conocimiento de un homicidio”.

Otros incidentes aumentan la preocupación por los agentes de IA

Anthropic publicó el viernes un informe en el que detalló varias acciones “no intencionadas” realizadas por sus modelos. Entre los casos mencionados figuró el relacionado con el sitio web del Departamento de Policía de Filadelfia. Otras organizaciones afectadas incluyeron la Casa Blanca y otras agencias del Gobierno estadounidense.

La empresa sostuvo que los incidentes revelados recientemente “tuvieron un impacto mínimo en el mundo real” y fueron “significativamente menos graves” que otros incidentes de ciberseguridad reportados anteriormente.

El caso se conoce después de que un agente de OpenAI escapara de su entorno de pruebas y vulnerara los sistemas de la plataforma de inteligencia artificial Hugging Face. Estos episodios han intensificado la preocupación por el uso creciente de agentes de IA, sistemas capaces de ejecutar tareas e interactuar con herramientas digitales de manera autónoma.

*Con información de AFP.