Anthropic publicó un informe que documenta el uso de sus modelos, incluidos Claude Haiku, Sonnet, Opus y Claude Code, en actividades de abuso que abarcaron desde el desarrollo de software relacionado con armas convencionales hasta el espionaje, el fraude y las operaciones de influencia política. El informe cubre el periodo entre diciembre de 2025 y agosto de 2026, y señala la participación de entidades sospechosas de estar vinculadas a Estados, delincuentes que buscaban beneficios económicos y organizaciones gubernamentales de propaganda.
Uso de Claude en programas de armamento
Anthropic afirmó que su equipo de inteligencia sobre amenazas investigó a varias entidades que utilizaron Claude para desarrollar software destinado al diseño de armas o para apoyar la recopilación de inteligencia y las cadenas de suministro vinculadas a programas de armamento. La empresa indicó que tres de estas entidades estaban en China, dos en Rusia y una en Yemen.
En un caso relacionado con un grupo activo en el norte de Yemen, la empresa detectó el uso de Claude Code en tres programas de desarrollo de armas, incluidos misiles guiados y otros misiles. Los usos abarcaron el desarrollo de software de guiado, navegación y estabilización, así como la realización de simulaciones y pruebas, pero el informe afirmó que no encontró pruebas de que el grupo hubiera logrado desarrollar un arma operativa. Anthropic también declaró que desactivó las cuentas relacionadas y compartió la información recopilada con instituciones de los sectores público y privado.
En otro caso, una entidad con sede en China utilizó Claude para desarrollar partes del software de control del lanzamiento de un sistema antitorpedos, preparar planes de prueba y comparar el sistema con programas estadounidenses de lucha contra torpedos y defensa antisubmarina. La empresa evaluó que la actividad estaba relacionada con un fabricante del sector de defensa chino.
Del espionaje a la vigilancia y la influencia
El informe incluyó ejemplos de operaciones de espionaje rusas dirigidas, en su mayoría, contra los servicios de inteligencia militar de los Gobiernos de Ucrania y Europa, así como intentos de reconocimiento de redes gubernamentales en Oriente Medio, Europa y el Sudeste Asiático, atribuidos a entidades que se cree que tienen su sede en China. Anthropic también detectó el uso de Claude en ataques de extorsión y delitos cibernéticos con motivaciones financieras.
En junio de 2026, la empresa prohibió una cuenta que utilizó Claude para crear una plataforma que vigilaba, analizaba y clasificaba la actividad de usuarios en redes sociales en Irán y la región del Golfo. La investigación concluyó que la cuenta era operada por una entidad llamada S2T Unlocking Cyberspace o en su nombre, mientras que investigaciones de fuentes abiertas señalaron su relación con un proveedor de inteligencia israelí-singapurense. El informe también detectó una herramienta china para vigilar la opinión pública y preparar informes gubernamentales que clasificaban a disidentes, activistas, minorías étnicas, la diáspora china y medios de comunicación extranjeros como amenazas para la estabilidad política.
Imitación de modelos y redes de contenido sintético
Anthropic afirmó que un estudio chino de aplicaciones creó, con la ayuda de Claude, una red de más de 20 aplicaciones de citas, con más de 4700 personajes de inteligencia artificial que hablaron con al menos 25 000 personas durante dos semanas. La empresa también registró lo que describió como el mayor ataque de destilación ilegal que ha detectado hasta la fecha: entidades vinculadas a Alibaba utilizaron más de 3500 cuentas falsas para realizar unos 3 millones de operaciones diarias con el objetivo de copiar las capacidades de sus modelos sin autorización.
La empresa indicó asimismo que Moonshot AI y DeepSeek, según la investigación, derivaron a Claude solicitudes de usuarios sin informarles, mientras que las conversaciones de usuarios de los modelos Xiaomi MiMo fueron transferidas a Claude en el marco de una actividad que el informe describió como destilación ilegal.
¿Por qué importa esta noticia?
Los casos muestran que los riesgos no se limitan a la producción de textos dañinos, sino que también incluyen la integración de modelos en software, pruebas, operaciones de inteligencia y estructuras de propaganda. Al mismo tiempo, el informe presenta los resultados y las investigaciones de Anthropic, no una evaluación independiente de cada caso; además, algunos hechos se refieren a usos que no han demostrado haber producido un arma práctica. Por ello, el material deja abiertas preguntas sobre los mecanismos para verificar las afirmaciones de las empresas, los límites de su capacidad para detectar usos no declarados y la manera de coordinar el intercambio de información con entidades públicas y privadas.