Anthropic aseguró que detectó intentos de usar su IA para desarrollar armas biológicas

La empresa presentó un informe sobre amenazas en el que detalló cinco casos de uso indebido de sus modelos para investigaciones biológicas de riesgo. Aclaró que no detectó la creación directa de armas y que bloqueó las cuentas involucradas.
domingo 13 de septiembre de 2026

Anthropic, la empresa desarrolladora de Claude, publicó su informe de amenazas de septiembre de 2026 y aseguró haber detectado varios intentos de utilizar sus modelos de inteligencia artificial para realizar actividades vinculadas con el desarrollo de armas biológicas.

El reporte analiza incidentes registrados entre diciembre de 2025 y agosto de 2026 y advierte sobre el denominado “doble uso de la biología”: investigaciones científicas legítimas que pueden ser desviadas hacia aplicaciones peligrosas.

Según la compañía, se identificaron cinco casos en los que usuarios intentaron utilizar Claude como apoyo para actividades relacionadas con investigaciones biológicas de riesgo. Anthropic aclaró que “no hubo creación directa de armas biológicas ejecutadas”.

Entre los casos detectados, la empresa mencionó solicitudes relacionadas con investigaciones destinadas a modificar características de agentes infecciosos, consultas sobre variantes de virus y pedidos vinculados con toxinas y otros materiales biológicos. También encontró intentos de obtener información sobre proveedores y sistemas de síntesis biológica que contaran con mecanismos de verificación menos estrictos.

Otro conjunto de consultas buscaba asistencia para optimizar procedimientos de cultivo, aislamiento y manipulación de patógenos peligrosos sin las credenciales o el contexto institucional correspondiente.

Ante estas situaciones, Anthropic informó que suspendió las cuentas y las claves API involucradas y reforzó los sistemas de seguridad de sus modelos más avanzados para restringir consultas relacionadas con investigaciones biológicas de doble uso.

El informe también abordó otro frente de preocupación para la compañía: la destilación ilícita de modelos de inteligencia artificial. Según Anthropic, esta práctica permite utilizar las respuestas de un modelo avanzado para entrenar o mejorar sistemas desarrollados por otras empresas.

La compañía señaló a actores vinculados con DeepSeek, Xiaomi, Moonshot y Alibaba, y afirmó que detectó operaciones destinadas a extraer capacidades de Claude mediante grandes volúmenes de consultas automatizadas.

En particular, Anthropic calificó como “el mayor ataque de destilación” detectado hasta el momento una campaña que, según su informe, involucró más de 151 millones de transacciones entre mayo y julio de 2026, con picos cercanos a los 3 millones de consultas diarias y más de 3.500 cuentas fraudulentas.

El informe fue difundido en una semana en la que Anthropic también quedó en el centro del debate sobre los riesgos de la inteligencia artificial tras las declaraciones de su exinvestigador Jacob Coxon, quien había advertido públicamente sobre los potenciales peligros del desarrollo acelerado de esta tecnología.