Anthropic interrumpe intentos de uso malicioso de su modelo de IA
La empresa Anthropic ha revelado que ha identificado y detenido intentos de utilizar su modelo de inteligencia artificial para actividades maliciosas, las cuales podrían facilitar el desarrollo de armas biológicas. Este hallazgo se presenta en el reciente informe de inteligencia sobre amenazas de la compañía, que forma parte de una creciente serie de advertencias emitidas por investigadores y expertos en la industria acerca de los riesgos potenciales que conlleva esta tecnología.
Las preocupaciones han llevado a llamados a la acción, como el del senador estadounidense Bernie Sanders, quien exige una pausa en el desarrollo avanzado de la IA y un veto sobre la superinteligencia artificial. En contraste, el expresidente Donald Trump ha desestimado tales temores, afirmando que si no se lidera en inteligencia artificial, Estados Unidos podría enfrentarse a graves consecuencias.
Informes sobre amenazas y casos detectados
En su último informe publicado el jueves, Anthropic destacó que otras empresas del sector también están emitiendo reportes similares. Por ejemplo, Google informó recientemente que un individuo había intentado usar su herramienta de IA Gemini para obtener una "guía técnica completa para sintetizar agentes biológicos armados".
Además, el modelo Claude de Anthropic fue utilizado por actores vinculados a campañas de ciberespionaje basadas en Rusia y por instituciones dedicadas a la propaganda iraní. El informe detalla casos preocupantes detectados en los últimos ocho meses, incluyendo aplicaciones fraudulentas y sistemas de vigilancia diseñados para identificar disidentes.
Riesgos asociados al uso malicioso
Anthropic también ha acusado a empresas chinas de intentar replicar las capacidades de Claude. El extenso informe enumera situaciones en las que grupos sospechosos respaldados por estados, criminales y otros individuos motivados políticamente han abusado de su tecnología.
Entre diciembre de 2025 y agosto de 2026, se interrumpió el "uso malicioso" de sus modelos Claude Haiku, Sonnet y Opus. Sin embargo, no se registraron casos similares con Claude Fable o los poderosos modelos Mythos-class, salvo una instancia relacionada con la destilación, un proceso para entrenar modelos más pequeños utilizando modelos más grandes y costosos.
Casos alarmantes sobre armas biológicas
Aparte del uso detectado en operaciones cibernéticas y fraudes, Anthropic señaló que bloqueó a científicos que empleaban su IA en formas que podrían contribuir al desarrollo de armas biológicas. El informe destaca cinco estudios de caso relacionados con actores que utilizaron sus modelos para este fin.
Según la compañía, el uso biológico indebido representa "uno de los riesgos más serios" asociados con los modelos avanzados de IA. Sin las salvaguardias adecuadas, estas capacidades podrían tener "consecuencias catastróficas". Como advirtió Anthropic: "La misma información que puede ser utilizada para desarrollar un arma biológica también podría servir para crear una vacuna o un tratamiento contra una enfermedad".
Análisis sobre el contexto actual
Jacob Klein, jefe de inteligencia sobre amenazas en Anthropic, describió la situación como "increíblemente matizada". Aclaró que no se trata del típico villano buscando construir un arma biológica para aniquilar a todos.
El informe también documenta seis casos donde Claude fue empleado para desarrollar software destinado a armas convencionales como firearms, misiles y drones armados.