Juanma Aranda

INVESTIGACION

Anthropic detecta uso de Claude para “guerras cognitivas” y posibles fines biológicos

Anthropic ha publicado un informe de inteligencia de amenazas que detalla usos maliciosos de sus modelos Claude (Haiku, Sonnet y Opus) en siete áreas de riesgo. Incluye cinco casos ligados a investigaciones biológicas y dos campañas de “guerra cognitiva” vinculadas a actores iraníes. La empresa bloqueó y desvió solicitudes, y advierte que el riesgo crecerá con la capacidad.

Audio con ElevenLabs

Qué ha ocurrido

Anthropic ha divulgado un informe de su equipo de inteligencia de amenazas que, durante los últimos ocho meses, identificó y desarticuló operaciones que intentaron emplear Claude (Haiku, Sonnet y Opus) con fines maliciosos en siete ámbitos: campañas de influencia y vigilancia, uso indebido de sistemas biológicos, estafas y fraude, intentos de ciberataques autónomos y a gran escala, consultas sobre armas convencionales y destilación ilícita de modelos. La compañía bloqueó o redirigió peticiones hacia modelos menos avanzados. Entre cinco casos vinculados a investigación biológica figuran la evasión de restricciones regionales para virólogos que trabajaban en ganancia de función del chikungunya, el uso desde una ubicación no autorizada para planificar estudios sobre adaptación de gripe aviar a mamíferos, una propuesta redactada con Claude Opus 5 para obtener financiación sobre evasión inmune de ortopoxvirus, la creación de un atlas de péptidos de veneno junto a un sistema generativo para optimizar moléculas con efectos paralizantes o analgésicos, y el rediseño computacional de toxinas con solicitudes de mantener ambigüedad sobre los agentes implicados. Además, se documentan dos casos de “guerra cognitiva” vinculados a actores iraníes: preparación de campañas por parte de personas relacionadas con la Organización de Cultura y Comunicaciones Islámicas y, en Mashhad, el desarrollo con Claude de manuales, perfiles, bases de datos de objetivos y coordinación de una red denominada “Manjanegh” o “Catapulta” para difundir contenidos.

Qué significa para creadores

Para creadores y agencias, este hallazgo implica mayor escrutinio de encargos que pidan manuales operativos, guiones de propaganda, perfiles de audiencia o bases de datos de objetivos, ya que pueden integrar campañas coordinadas. Exige trazabilidad de cliente, objetivos y financiación, y rechaza trabajos que intenten ocultar fuentes o agentes, como ocurrió con informes ambiguos. Evita intermediarios que prometan accesos eludiendo restricciones regionales y respeta las salvaguardas del proveedor. Si trabajas con temas científicos o de salud, no uses IA para consultas sobre ganancia de función, toxinas o rediseño de compuestos. Documenta el uso de IA, etiqueta contenidos sensibles y define políticas internas para encargos políticos o de influencia, con criterios claros de rechazo ante peticiones relacionadas con “guerra cognitiva/blanda” o la creación de estructuras y bases de datos de objetivos.

Fuente y contexto

El informe fue compartido en el blog de Anthropic y atribuido a su equipo de inteligencia de amenazas; la empresa afirma que podría ser la primera vez que una compañía privada de IA detalla públicamente posible uso indebido de sus productos para fines biológicos. Andrew Weber, del Consejo de Riesgos Estratégicos, calificó los casos como ejemplos preocupantes, según The New York Times. La evaluación cubre ocho meses y coincide con declaraciones del responsable de ciencia de alineación de Anthropic, Evan Hubinger, quien estima más del 10% de probabilidad de extinción humana causada por la IA en la próxima década. Información publicada por WIRED en Español el 10 de septiembre de 2026.