Tiempo de lectura aprox: 2 minutos, 47 segundos
La carrera por desarrollar modelos de inteligencia artificial más avanzados está abriendo un nuevo frente para las empresas tecnológicas: evitar que esas mismas capacidades terminen siendo utilizadas con fines indebidos.
Anthropic reveló que durante los últimos meses detectó y desarticuló diversos intentos de utilizar Claude de Anthropic para investigaciones relacionadas con agentes biológicos peligrosos, además de identificar campañas dirigidas a copiar capacidades de sus modelos mediante técnicas conocidas como destilación.
Las conclusiones forman parte del informe de amenazas publicado por la compañía, que analiza actividades detectadas entre diciembre de 2025 y agosto de 2026. El documento ofrece una visión poco habitual sobre la forma en que actores maliciosos están intentando aprovechar modelos de inteligencia artificial cada vez más sofisticados.
Claude fue utilizado para consultas relacionadas con patógenos y toxinas
De acuerdo con Anthropic, algunos usuarios intentaron aprovechar las capacidades científicas de Claude para realizar consultas asociadas con investigaciones biológicas de alto riesgo.
La empresa señala que detectó actividades relacionadas con el análisis de variantes de virus, toxinas y procedimientos científicos sensibles. Entre los casos identificados aparecen búsquedas vinculadas con el virus de Chikungunya, variantes de influenza aviar H5N1 y procesos destinados a modificar estructuras biológicas con el objetivo de aumentar estabilidad o capacidad de transmisión.
También fueron detectadas consultas orientadas a localizar proveedores de síntesis de ADN y ARN con controles de verificación potencialmente vulnerables, así como solicitudes relacionadas con protocolos de manipulación de agentes biológicos peligrosos.
Anthropic indicó que ninguno de estos casos derivó en la creación directa de armas biológicas, pero destacó que todas las actividades violaban las políticas de uso de la plataforma.
La biología se convierte en un desafío para la IA avanzada
La compañía reconoce que el avance de los modelos de inteligencia artificial genera nuevas oportunidades para la investigación científica, pero también aumenta el riesgo de usos no autorizados.
Anthropic describe este escenario como un problema de “doble uso”, donde herramientas desarrolladas para aplicaciones legítimas pueden ser aprovechadas en contextos distintos a los previstos originalmente.
Según la empresa, los modelos más recientes de su portafolio poseen capacidades científicas superiores a las generaciones anteriores, lo que ha obligado a reforzar mecanismos de seguridad para restringir consultas relacionadas con investigaciones biológicas sensibles.
La compañía confirmó que suspendió las cuentas involucradas y revocó las claves de acceso asociadas con estos casos.
La destilación se convierte en otro frente de batalla
Además de los intentos relacionados con biología, el informe dedica una parte importante a una práctica que preocupa cada vez más a los desarrolladores de inteligencia artificial: la destilación.
Esta técnica permite utilizar las respuestas generadas por un modelo avanzado para entrenar sistemas propios, reduciendo significativamente los recursos necesarios para desarrollar nuevas capacidades.
Para Anthropic, el problema surge cuando esta actividad se realiza sin autorización y se utiliza para replicar el comportamiento de modelos comerciales.
“La destilación ilícita permite a laboratorios no autorizados extraer e imitar capacidades de modelos de vanguardia en una fracción del tiempo, la potencia computacional y el costo que supondría desarrollarlos de forma independiente”, señaló la empresa en su reporte.
Anthropic apunta a laboratorios chinos de inteligencia artificial
Uno de los elementos más sensibles del informe es la referencia directa a compañías chinas vinculadas al desarrollo de inteligencia artificial.
Anthropic menciona actividades relacionadas con laboratorios asociados a DeepSeek, Xiaomi, Moonshot y Alibaba, señalando que algunos intentos de destilación tuvieron como objetivo extraer conocimientos de versiones avanzadas de Claude.
La empresa asegura haber identificado lo que considera el mayor ataque de destilación detectado hasta ahora contra sus modelos.
De acuerdo con la investigación, los actores involucrados buscaban acceder a los procesos de razonamiento internos de Claude Opus 4.6 y Claude Opus 4.7 para fortalecer futuras versiones de la familia Qwen.
Aunque Anthropic no informó sobre afectaciones directas a sus sistemas, el caso refleja el creciente valor estratégico que están adquiriendo los modelos de inteligencia artificial y el conocimiento que contienen.
La seguridad se convierte en prioridad para los desarrolladores de IA
El reporte muestra cómo las empresas de inteligencia artificial están entrando en una etapa donde ya no basta con mejorar rendimiento, velocidad o capacidades de razonamiento.
La protección de modelos avanzados comienza a ocupar un lugar cada vez más importante dentro de las estrategias de desarrollo.
Mientras los sistemas de IA adquieren mayores conocimientos en áreas científicas, médicas y técnicas, también aumenta el interés de actores que buscan utilizar esas capacidades para fines distintos a los previstos por sus creadores.
Por ello, Anthropic anunció que fortalecerá los filtros de seguridad, ampliará los sistemas de clasificación de riesgo y mantendrá restricciones adicionales en las consultas relacionadas con investigación biológica de doble uso.
La decisión refleja una realidad que empieza a consolidarse en todo el sector: la siguiente generación de inteligencia artificial no solo deberá ser más capaz, sino también más segura frente a quienes intenten utilizarla para propósitos que van más allá de la innovación tecnológica.
