Anthropic detalla el uso indebido de Claude en operaciones maliciosas

Anthropic informa de operaciones disruptidas entre diciembre de 2025 y agosto de 2026 en las que distintos actores intentaron usar Claude para actividades cibernéticas, vigilancia, fraude, influencia y otros daños.

Noticias
Anthropic detalla el uso indebido de Claude en operaciones maliciosas

En septiembre de 2026, Anthropic publicó un informe sobre operaciones maliciosas detectadas y desarticuladas por su equipo de Threat Intelligence entre diciembre de 2025 y agosto de 2026. Los casos abarcan operaciones cibernéticas, influencia, vigilancia, estafas y fraude, uso indebido biológico, desarrollo de armas convencionales y destilación ilícita.

La compañía señala que los actores identificados incluyen grupos presuntamente patrocinados por Estados, delincuentes motivados económicamente, proveedores comerciales de spyware, instituciones de propaganda estatal e individuos con motivaciones políticas. Entre los casos figuran una red de aplicaciones de citas falsas para defraudar a usuarios y sistemas de vigilancia destinados a identificar y controlar a disidentes.

Anthropic afirma que los modelos Claude Haiku, Sonnet y Opus fueron utilizados en los casos descritos. No detectó actividad indebida relacionada con Claude Fable o los modelos de clase Mythos, salvo en un caso de destilación ilícita.

En el ámbito cibernético, la empresa sostiene que la inteligencia artificial está reduciendo la diferencia de recursos y conocimientos entre operaciones patrocinadas por Estados y operadores individuales. Según el informe, los actores emplearon Claude y marcos multiagente para automatizar tareas de reconocimiento, explotación y extracción de datos, aunque las personas siguieron definiendo los objetivos y revisando la información exfiltrada.

Anthropic también describe el caso GTG-20006, atribuido de forma consistente con informaciones públicas a Midnight Blizzard. La compañía relaciona al actor con operaciones de espionaje contra objetivos de inteligencia militar de Ucrania y gobiernos europeos, además de entidades diplomáticas y de defensa. Uno de los operadores utilizaba el alias “JackPoterz” y empleó un flujo de trabajo capaz de reconstruir y volver a desplegar automáticamente sus herramientas cuando eran detectadas por productos de seguridad.

La compañía asegura que interrumpió las actividades descritas, reforzó sus medidas de protección a partir de lo aprendido y compartió información con autoridades y socios del sector cuando correspondía. Anthropic publicó el informe para ayudar a otros desarrolladores, gobiernos y organizaciones civiles a reconocer patrones similares y reforzar sus defensas. Fuente: Anthropic.

Compartir

WhatsApp X Telegram Email