Anthropic frena usos de Claude para armas biológicas y destilación china

La empresa de inteligencia artificial Anthropic ha logrado desarticular múltiples operaciones maliciosas que buscaban aprovechar su modelo Claude para actividades peligrosas, incluyendo la creación de armas biológicas y la destilación ilícita de sus capacidades.

Según el informe de amenazas correspondiente a septiembre, que abarca las acciones registradas entre diciembre de 2025 y agosto de 2026, la compañía detalla lo que considera «ejemplos de las amenazas más notables e innovadoras» identificadas hasta la fecha.

Un apartado completo del documento se dedica al uso indebido biológico, es decir, los intentos de actores maliciosos por emplear los modelos de Anthropic para desarrollar o perfeccionar armas biológicas, práctica que está expresamente prohibida en sus términos de uso.

Estos intentos buscaban explotar las capacidades de investigación científica de Claude, en lo que Anthropic denomina «el doble uso de la biología»: avances legítimos que pueden ser desviados para crear patógenos más peligrosos.

Modelos anteriores como Claude Opus 4 y Claude Sonnet 4.5 no alcanzan un nivel que permita «ayudar de manera significativa a un usuario avanzado a llevar a cabo investigaciones biológicas peligrosas». Sin embargo, la situación cambia con las versiones más recientes, como Claude Fable y Mythos, lo que ha motivado la implementación de medidas de seguridad adicionales que «restringen el acceso a una amplia gama de consultas de investigación biológica de doble uso».

El informe recoge cinco casos concretos de actores que utilizaron Claude como apoyo para el desarrollo de armas biológicas, aunque aclara que «no hubo creación directa de armas biológicas ejecutadas».

Uno de los casos incluye el bloqueo de una solicitud para redactar una petición de subvención destinada a financiar experimentos que buscaban aumentar la transmisibilidad o virulencia del virus del Chikunguña, transmitido por mosquitos.

Otro caso identificó consultas e itinerarios de investigación orientados a analizar cómo variantes de la gripe aviar (H5N1) podrían adaptarse biológicamente para propagarse eficientemente entre mamíferos.

También se detectaron intentos de modificar estructuras de toxinas conocidas, con el objetivo de aumentar su estabilidad, resistencia a tratamientos o capacidad de penetración celular.

Además, se observaron consultas dirigidas a identificar proveedores de síntesis de ADN/ARN y sintetizadores biológicos con mecanismos de detección laxos o vulnerabilidades en sus protocolos de verificación de pedidos.

Un quinto caso refiere solicitudes de asistencia para optimizar protocolos de cultivo, aislamiento y manipulación de patógenos peligrosos sin contar con las credenciales o el contexto institucional adecuado.

Ante estas detecciones, Anthropic procedió a suspender de inmediato las cuentas implicadas y las claves API, además de implementar clasificadores y filtros más estrictos en sus modelos más avanzados para restringir el acceso a un espectro más amplio de consultas de investigación biológica de doble uso.

Destilación ilícita

El informe también destaca los intentos de destilación ilícita por parte de empresas rivales, una práctica normalmente aceptada que permite usar las respuestas de un modelo de IA avanzado para entrenar o replicar sus capacidades en otro.

«La destilación ilícita permite a laboratorios no autorizados extraer e imitar de forma ilícita capacidades de modelos de vanguardia, en una fracción del tiempo, la potencia computacional y el coste que supondría desarrollarlos de forma independiente», denuncia la compañía.

En este contexto, el informe señala a laboratorios de inteligencia artificial de China, mencionando directamente a DeepSeek, Xiaomi, Moonshot y Alibaba. Actores vinculados a esta última habrían protagonizado «el mayor ataque de destilación» jamás visto por Anthropic.

La campaña de destilación tuvo como objetivo las transcripciones del razonamiento de la cadena de pensamiento de Claude Opus 4.6 y 4.7 para entrenar los modelos Qwen e introducir nuevas capacidades en Qwen 3.5, 3.6 y 3.7.

Entre mayo y julio de 2026, Anthropic observó más de 151 millones de transacciones, con picos diarios que se acercaron a los 3 millones de transacciones, lanzadas desde más de 3500 cuentas fraudulentas.

Fuente: Infobae

COMPARTIR ESTA NOTICIA

Facebook
Twitter

FACEBOOK