A glowing green biohazard container with a
IA

Anthropic interrumpe el uso indebido de Claude en bioweapons

El informe de amenazas abarca de diciembre de 2025 a agosto de 2026 y se presenta en medio de una división política en EE. UU. sobre la desaceleración de la IA frente a "ganarla".

Por Elliot Marsh7 min de lectura

Anthropic dijo que un nuevo informe de inteligencia sobre amenazas identificó y interrumpió intentos de usar sus modelos Claude para "actividades maliciosas" que podrían apoyar el desarrollo de armas biológicas, incluyendo cinco estudios de caso relacionados con armas biológicas.

La divulgación llega en un momento en que los líderes estadounidenses divergen públicamente entre llamados a pausar o prohibir la "superinteligencia" y un impulso competitivo para acelerar el desarrollo de la IA para obtener ventaja estratégica.

Puntos Clave

  • Anthropic dijo que identificó e interrumpió intentos de usar Claude para "actividades maliciosas" que podrían apoyar el desarrollo de armas biológicas, documentando cinco estudios de caso relacionados con armas biológicas.
  • La compañía estableció la ventana de interrupción para el uso malicioso de Claude Haiku, Sonnet y Opus desde diciembre de 2025 hasta agosto de 2026.
  • El mismo informe describió seis casos de Claude siendo utilizado para construir software para armas convencionales, incluyendo municiones y sus sistemas de orientación y control.
  • Anthropic también vinculó el uso indebido a la ciberespionaje y operaciones de influencia, incluyendo actividades relacionadas con una campaña basada en Rusia y una institución de propaganda iraní.

Anthropic dice que interrumpió el uso indebido de Claude relacionado con armas biológicas en cinco estudios de caso.

Anthropic dijo que su último informe de inteligencia sobre amenazas identificó e interrumpió intentos de usar sus modelos de IA Claude para "actividades maliciosas" que podrían apoyar el desarrollo de armas biológicas. La compañía dijo que el informe destacó "cinco estudios de caso de actores que utilizan nuestros modelos de maneras que podrían apoyar el desarrollo de armas biológicas."

Mecánicamente, un informe de inteligencia sobre amenazas es una divulgación periódica de cómo una empresa detecta, investiga y bloquea actividades abusivas que involucran sus productos.

En este caso, Anthropic enmarcó el uso biológico indebido como "uno de los riesgos más serios de los modelos de IA de frontera", utilizando "frontera" para referirse a un sistema altamente capaz cerca del estado del arte que puede crear nuevos riesgos de uso indebido.

Anthropic dijo que interrumpió el "uso malicioso" de Claude Haiku, Sonnet y Opus entre diciembre de 2025 y agosto de 2026. También dijo que ninguno de los casos de uso indebido involucró a Claude Fable o los poderosos modelos de clase Mythos, excepto un caso de destilación, una técnica donde un modelo más pequeño es entrenado para imitar las salidas de un modelo más grande y puede transferir capacidades a un costo menor.

La tensión central del informe es el uso dual. Anthropic dijo: “La misma información que se puede utilizar para desarrollar un arma biológica también podría utilizarse para desarrollar, por ejemplo, una vacuna o un tratamiento para una enfermedad”, y advirtió que sin salvaguardias tales capacidades “podrían tener consecuencias catastróficas.”

Lo que el informe alega además: ciberespionaje, propaganda, estafas, vigilancia y software de armas.

El informe de Anthropic amplió el marco de uso indebido más allá de la bioseguridad hacia un conjunto mixto de categorías de seguridad nacional y criminal. Dijo que Claude fue utilizado por actores vinculados a una campaña de ciberespionaje basada en Rusia y por una institución de propaganda iraní, colocando operaciones de influencia junto a actividades de intrusión.

Las operaciones de influencia son esfuerzos coordinados para moldear la opinión pública o los resultados políticos, a menudo a través de propaganda y mensajes dirigidos.

Anthropic dijo que los casos que detectó en los últimos ocho meses variaron desde aplicaciones de citas falsas y estafas de WiFi en hoteles hasta vigilancia diseñada para identificar disidentes, y describió el uso indebido sospechoso por parte de “grupos patrocinados por el estado, criminales, vendedores de spyware, instituciones de propaganda estatal e individuos motivados políticamente.”

En el ámbito cibernético, Anthropic dijo que un grupo de hackers cuyo trabajo es consistente con el grupo ruso Midnight Blizzard supuestamente utilizó IA para construir un sistema que detectaba automáticamente cuando el malware era señalado por las defensas de seguridad y reescribía el código hasta evadir la detección.

Midnight Blizzard es un nombre de clúster vinculado a Rusia utilizado por investigadores de seguridad para describir un conjunto específico de actividad de ciberespionaje, y la redacción del informe señala una atribución que es sugestiva más que definitiva.

El informe también nombró al grupo de hackers ShinyHunters y mencionó laboratorios con sede en China entre los involucrados en la actividad de uso indebido descrita en el informe. Anthropic además acusó a empresas chinas de IA de intentar replicar las capacidades de Claude, aunque los detalles extraídos no especificaron qué laboratorios o qué métodos de replicación se utilizaron más allá de la mención de la destilación.

Anthropic también dijo que el informe señaló seis casos en los que Claude fue utilizado “para desarrollar software para armas convencionales, incluyendo armas de fuego, misiles, drones armados, bombas y otras municiones, así como los sistemas de orientación y control que las operan.” Eso es importante porque desplaza la conversación política de la abstracta “seguridad de la IA” hacia la habilitación concreta de flujos de trabajo de armas, lo que tiende a atraer la atención del gobierno incluso cuando las atribuciones subyacentes son probabilísticas.

La pantalla dividida de Washington: el impulso de pausa y prohibición de Sanders frente al marco de “ganar IA” de Trump.

El informe llegó a un entorno de políticas de EE. UU. que ahora es explícitamente bipartidista. El senador Bernie Sanders exigió una pausa en el desarrollo de IA avanzada e introdujo legislación para prohibir la superinteligencia de IA, diciendo en Newsnight de la BBC: “Cuando los científicos te dicen que hay una posibilidad, una posibilidad de que podría tener un impacto catastrófico en la humanidad, tienes que ser un idiota para no decir, desaceléralo.”

El presidente Donald Trump rechazó ese marco y argumentó que el riesgo estratégico va en la otra dirección. “Si no ganamos en IA, vamos a estar en una posición muy mala”, dijo el jueves.

La división importa para los mercados porque mantiene el tape de titulares ruidoso sin producir un único caso base claro para las reglas. Los traders que observan el sentimiento de riesgo adyacente a la IA tienden a ser sacudidos por narrativas alternantes, una que trata la capacidad del modelo fronterizo como un pasivo de seguridad nacional que debería ser restringido, y otra que trata la restricción como un auto-desacierto competitivo.

El debate también está siendo reforzado por líderes de seguridad dentro de los laboratorios. El científico jefe de OpenAI, Jakub Pachocki, escribió el 2026-09-06 que la industria debería implementar “ralentizaciones voluntarias” hasta que se establezcan salvaguardias, añadiendo: “Me preocupa que nadie esté preparado para las consecuencias de un aumento rápido continuo en la inteligencia de las máquinas.”

Señales a monitorear: salvaguardias, endurecimiento del acceso, y si la charla de “ralentización” se convierte en reglas.

La primera señal es si la divulgación de Anthropic se traduce en controles de acceso más estrictos en lugar de solo una mejor detección. La compañía dijo que incorporó sus hallazgos en sus procesos “para prevenir, detectar y interrumpir mejor estas actividades en el futuro,” y dijo que compartió inteligencia con autoridades y socios de la industria donde fuera apropiado. Eso apunta a operaciones iterativas, monitoreo, bloqueo y compartición de información, no a una solución única.

La segunda es si la legislación propuesta por Sanders para prohibir la superinteligencia de IA avanza más allá de la introducción en acción de comité, co-patrocinadores o audiencias. En un entorno de pantalla dividida, los hitos del proceso importan más que la retórica porque son lo único que obliga a un cronograma.

La tercera es si otros laboratorios importantes expanden sus propias divulgaciones adyacentes a armas biológicas o endurecen las salvaguardias de maneras que sean visibles para los usuarios.

Google dijo el martes que alguien intentó usar Gemini para obtener una “guía técnica completa, paso a paso, para sintetizar agentes biológicos armados,” y divulgaciones paralelas pueden crear un ritmo político incluso si cada caso individual se enmarca como un uso indebido “intentado.”

Una cuarta señal, más técnica, es si la transferencia de capacidad a través de destilación se convierte en un enfoque más grande. Anthropic dijo que ninguno de los casos de uso indebido involucró modelos de Claude Fable o de clase Mythos, excepto un caso de destilación, lo que recuerda que restringir el modelo superior no necesariamente restringe la capacidad descendente si se pueden entrenar modelos más pequeños para imitarlo.

Mi lectura: el comercio a corto plazo es la volatilidad narrativa, no un único interruptor regulatorio.

La parte que decide esta historia no es si un informe impacta a Washington para imponer una prohibición. Es si las divulgaciones repetidas y operativamente específicas de uso indebido empujan a los laboratorios hacia un acceso y monitoreo más estrictos por defecto, porque ese es el camino de menor resistencia cuando los legisladores están divididos entre “ralentizarlo” y “ganar en IA.”

El umbral que importa es procedimental, no retórico: si las “ralentizaciones voluntarias” y las propuestas de pausa y prohibición comienzan a convertirse en audiencias, reglas de acceso y expectativas de informes ejecutables, el tape de políticas de IA deja de ser un catalizador de sentimiento y comienza a ser una restricción sobre cómo se envían los modelos fronterizos y quién tiene acceso a ellos.

Ahí es cuando el riesgo se mueve de los titulares a la superficie del producto y, por extensión, a una mayor apetito de riesgo.

Fuentes