Anthropic advirtió el 11 de septiembre de 2026 que ciberdelincuentes y actores patrocinados por Estados utilizaron sus modelos Claude en operaciones de ciberataque, diseño de armas, propaganda y vigilancia masiva. La compañía agrupó a los responsables bajo la denominación Generative Threat Groups (GTGs), que incluye operadores estatales, delincuentes con motivación económica, proveedores de spyware comercial, instituciones de propaganda y actores políticamente motivados.
Según Anthropic, las operaciones superaron el uso conversacional de un chatbot. Algunas emplearon arquitecturas multiagente capaces de ejecutar reconocimiento, explotación y exfiltración contra varias víctimas en paralelo durante horas o días, con una supervisión humana mínima.
Entre los casos descritos figura GTG-20006, un actor patrocinado por Rusia con coincidencias tácticas y de procedimientos con Midnight Blizzard, también conocido como APT29 y Cozy Bear. GTG-50014, asociado a ShinyHunters, operó una cadena distribuida de obtención de credenciales con 10 trabajadores AWS EC2, desde los que descargó 1,8 millones de APK de Android y buscó secretos integrados mediante TruffleHog antes de enviar los hallazgos a un grupo de Telegram.
Anthropic también atribuyó a GTG-10007, un operador de habla china probablemente situado en la provincia de Hunan, intentos de intrusión contra sistemas de producción, reconocimiento de redes gubernamentales extranjeras, investigación de vulnerabilidades y desarrollo de exploits contra productos de seguridad para endpoints. El grupo habría dirigido sus actividades contra unas 50 organizaciones de sectores como educación, energía, tecnología, sanidad, finanzas, manufactura y administración pública.
Otros grupos descritos incluyen GTG-50020, que habría atacado a unos 30 proveedores de inteligencia artificial en cuatro días para robar claves API e intentar acceder a modelos previos a su lanzamiento, y GTG-50029, que apuntó contra partidos políticos, medios, think tanks y proveedores SaaS europeos. Este último explotó una condición de carrera no documentada en la reinstalación de WordPress para crear cuentas de administrador sin credenciales válidas y abusó de un endpoint de búsqueda expuesto para sustraer datos.
La empresa afirmó asimismo haber desmantelado operaciones de influencia en las que Claude generaba y editaba contenidos a escala. Entre ellas mencionó una red vinculada a LKM Company que produjo contenidos políticos para unos 70 sitios de noticias ficticios, además de campañas asociadas a actores de Rusia, Irán y Bangladesh. Anthropic indicó que ninguna de estas operaciones consiguió reunir una interacción auténtica y que fueron interrumpidas antes de crear una audiencia.
Fuente: The Hacker News.