La compañía indicó que revisó 141,006 pruebas de evaluación y encontró tres casos en los que su herramienta de IA Claude accedió a internet y posteriormente hackeó “la infraestructura real de organizaciones externas”. No incluyen a Hugging Face ni a la plataforma en la nube Modal, según una persona familiarizada con el asunto. Cada uno de ellos funcionó sin las salvaguardas que normalmente se implementan en las herramientas públicas. En cada caso, Anthropic indicó a Claude que el entorno era una simulación y que no tenía acceso a internet. Un portavoz de Irregular afirmó que la empresa aprecia la colaboración y la transparencia de Anthropic.