En un momento en que la inteligencia artificial avanza más rápido que los marcos éticos y legales que deberían contenerla, Anthropic ha revelado que sus sistemas bloquearon cinco intentos de utilizar modelos de lenguaje para desarrollar armas biológicas, incluyendo modificaciones de virus como el chikungunya y la gripe aviar. Los actores detrás de estos intentos —desde institutos militares hasta grupos con motivaciones políticas— accedieron a las herramientas a través de métodos encubiertos, lo que subraya una paradoja fundamental: las mismas tecnologías diseñadas para expandir el conocimiento
Anthropic bloquea cinco intentos de usar su IA para fabricar armas biológicas
Podría emplearse para vacunas o para hacer el patógeno más peligroso
¿Por qué Anthropic publica estos informes si no puede ni siquiera confirmar si los intentos eran maliciosos o científicos?
Porque la ambigüedad es precisamente el problema. No pueden saber si alguien en un instituto militar está buscando una vacuna o un arma. Así que publican para ser transparentes sobre lo que ven y lo que bloquean.
Pero espera: si no saben la intención real, ¿cómo saben que bloquearon algo genuinamente peligroso? ¿O simplemente bloquearon consultas que parecían sospechosas por su origen?
El caso del chikungunya suena como investigación legítima. ¿Cómo dibuja Anthropic la línea?
No la dibuja claramente. Dicen que podría servir para vacunas o para armas. Lo que los alertó fue el contexto: un instituto militar pidiendo ayuda para diseñar mutaciones más dañinas.
Entonces el bloqueo se basó en quién preguntaba, no en qué preguntaba. Eso es importante aclararlo.
¿Y los otros casos? ¿Gripe aviar más contagiosa, viruela resistente?
Esos sí parecen claramente peligrosos. No hay ambigüedad real en hacer un patógeno más transmisible o resistente.
Aunque tampoco sabemos si esos intentos llegaron lejos o si Claude simplemente rechazó las primeras consultas. El informe no dice cuánto progreso hicieron.
¿Qué tan nuevo es este problema? ¿Anthropic es la única que lo enfrenta?
No es nuevo, pero sí se está volviendo más visible. Otros laboratorios de IA probablemente ven lo mismo. Anthropic solo es más transparente al reportarlo.
O es la única que lo reporta porque tiene incentivos de relaciones públicas. No sabemos si OpenAI o Google enfrentan lo mismo y simplemente no lo dicen.
El Pulso
- Anthropic confirmó que cinco actores distintos —incluyendo grupos con respaldo gubernamental, bandas criminales e individuos con motivaciones políticas— intentaron usar su modelo Claude para investigaciones que habrían podido derivar en armas biológicas.
- Los intentos incluían diseñar mutaciones para hacer el virus chikungunya más dañino en animales vivos, aumentar la contagiosidad de la gripe aviar, analizar variantes de la viruela resistentes al sistema inmune y catalogar toxinas de animales venenosos.
- La compañía enfrenta una tensión irresoluble: no puede distinguir con certeza si quienes hacen estas consultas son científicos legítimos o actores maliciosos, lo que complica cualquier respuesta definitiva.
- El informe coincidió con la renuncia pública de un ingeniero de Anthropic que advirtió sobre riesgos de extinción civilizatoria, amplificando la urgencia del debate sobre seguridad en la industria.
- Anthropic reconoce que sus modelos más recientes incorporan salvaguardas más avanzadas, pero los casos documentados ocurrieron con versiones anteriores, lo que revela una ventana de vulnerabilidad ya explotada.
En un momento en que la inteligencia artificial avanza más rápido que los marcos éticos y legales que deberían contenerla, Anthropic ha revelado que sus sistemas bloquearon cinco intentos de utilizar modelos de lenguaje para desarrollar armas biológicas, incluyendo modificaciones de virus como el chikungunya y la gripe aviar. Los actores detrás de estos intentos —desde institutos militares hasta grupos con motivaciones políticas— accedieron a las herramientas a través de métodos encubiertos, lo que subraya una paradoja fundamental: las mismas tecnologías diseñadas para expandir el conocimiento humano pueden convertirse en vectores de destrucción masiva. Este informe, publicado en septiembre de 2026, llega en un momento de creciente alarma interna dentro de la propia industria sobre los riesgos existenciales que la IA podría representar para la humanidad.
Anthropic ha revelado que bloqueó cinco intentos de utilizar sus modelos de inteligencia artificial para investigaciones que habrían podido desembocar en la creación de armas biológicas. La compañía publicó un informe en septiembre de 2026 reconociendo que, en varios casos, no puede determinar con certeza si quienes realizaban las consultas tenían intenciones científicas legítimas o claramente maliciosas. El anuncio llegó un día después de que un ingeniero de la empresa renunciara públicamente y advirtiera sobre los riesgos existenciales que la IA podría representar para la humanidad.
Este es el cuarto informe de este tipo que publica Anthropic, y abarca un espectro amplio de usos peligrosos: desde ciberseguridad hasta armas convencionales y operaciones de influencia. Los actores identificados van desde grupos respaldados por gobiernos hasta bandas criminales e individuos con motivaciones políticas, muchos de los cuales accedieron a Claude a través de métodos encubiertos —revendedores no autorizados o cuentas falsas— desde países donde Anthropic no ofrece sus servicios.
Uno de los casos más perturbadores involucra a un científico afiliado a un instituto de investigación militar que solicitó ayuda para redactar una propuesta de becas sobre el virus chikungunya, buscando diseñar mutaciones que lo hicieran más dañino al infectar repetidamente animales vivos. Anthropic bloqueó la consulta precisamente por el origen institucional militar de la solicitud, aunque reconoció que ese tipo de investigación también podría orientarse legítimamente hacia el desarrollo de vacunas.
Otros casos documentados incluyen intentos de hacer más contagiosa la gripe aviar, el análisis de variantes de la viruela más resistentes al sistema inmunológico, y la elaboración de un catálogo de toxinas animales con potencial uso armamentístico. La compañía señala que todos estos intentos utilizaron versiones anteriores de sus modelos, menos sofisticadas que las generaciones actuales, que incorporan salvaguardas más avanzadas. El paralelismo con los informes que publicaban las redes sociales sobre desinformación y operaciones encubiertas resulta inevitable, aunque el daño potencial de la IA en este contexto sería considerablemente mayor.
Anthropic ha detenido cinco intentos distintos de utilizar sus modelos de inteligencia artificial para investigaciones de laboratorio que habrían podido desembocar en la creación de armas biológicas. La compañía publicó un informe detallando estos casos el pasado mes de septiembre, aunque reconoce que desconoce si quienes estaban detrás de estos accesos buscaban avance científico legítimo o tenían intenciones claramente maliciosas. El anuncio llegó apenas un día después de que uno de los ingenieros de la empresa renunciara públicamente y advirtiera sobre los riesgos existenciales que la IA podría representar para la humanidad en los próximos años.
El informe de Anthropic es el cuarto de su clase que la compañía publica, y abarca un espectro más amplio de usos peligrosos: desde ciberseguridad hasta armas convencionales y operaciones de influencia. Todos los ejemplos documentados ocurrieron durante este año y utilizaron versiones anteriores de los modelos de la empresa, menos sofisticados que las generaciones más recientes de su familia Fable o Mythos, que incorporan salvaguardas más avanzadas diseñadas para dificultar el uso malintencionado. Los actores identificados detrás de estos intentos van desde grupos respaldados por gobiernos hasta bandas mafiosas e individuos movidos por motivaciones políticas.
Uno de los casos más preocupantes documentados en el informe involucra a un grupo terrorista en el norte de Yemen que intentó usar Claude, el modelo de lenguaje de Anthropic, para desarrollar tres tipos de armas convencionales: un cohete guiado que utilizaría como ordenador de vuelo un chip de teléfono móvil, y dos variantes de misiles, una de las cuales tendría un alcance superior a dos mil kilómetros. Este tipo de aplicación por parte de grupos terroristas figura entre los peligros más inmediatos y ampliamente citados en debates sobre seguridad de la IA.
Las armas biológicas representan, sin embargo, la amenaza más grave incluida en el reporte. En estos casos, Anthropic optó por no identificar a quienes realizaban las consultas, en parte porque la compañía no puede determinar con certeza si la intención era realmente maliciosa. Estos intentos provenían de países donde Anthropic no ofrece sus servicios, por lo que los actores accedían a Claude a través de métodos encubiertos: revendedores no autorizados o cuentas falsas. En un ejemplo específico, Anthropic bloqueó las consultas porque se originaban desde un instituto de investigación militar. Un científico afiliado a esa institución solicitaba ayuda a Claude para redactar una propuesta de becas destinada a investigar el virus chikungunya, una enfermedad transmitida por mosquitos. Aunque este tipo de investigación puede ser legítima cuando se orienta hacia el desarrollo de vacunas, también podría servir para crear versiones más peligrosas de patógenos. En este caso particular, el científico buscaba diseñar mutaciones que hicieran el virus más dañino a medida que infectara repetidamente a animales vivos. Anthropic concluyó que aunque tal investigación podría contribuir a mejores vacunas y tratamientos, también podría utilizarse para hacer el patógeno más letal.
Los otros casos documentados incluyen intentos de hacer más contagiosa la gripe aviar, análisis de variantes del virus de la viruela más resistentes al sistema inmunológico, y la creación de un catálogo de toxinas de animales venenosos que podría servir tanto para desarrollar nuevos fármacos como para fabricar armas biológicas. El timing del informe resulta significativo: su publicación coincidió con la renuncia de un joven empleado de Anthropic que alertó públicamente en redes sociales sobre el riesgo de extinción civilizatoria que la IA podría provocar en los próximos años, incluyendo precisamente el uso malintencionado por actores humanos. Este tipo de informe que Anthropic ahora publica guarda similitud con los reportes que Facebook y otras redes sociales publicaban hace años sobre operaciones encubiertas e información peligrosa circulando en sus plataformas, aunque con la IA el daño potencial sería considerablemente mayor.
Citas Notables
Estos ejemplos ilustran las tareas para las que se utilizan nuestros modelos, y los juicios que debemos tomar al evaluar si un determinado uso biológico es peligroso— Anthropic en su informe
Este tipo de investigación podría emplearse para desarrollar mejores vacunas y tratamientos contra el virus, pero también podría utilizarse para hacer el patógeno más peligroso— Conclusión de Anthropic sobre el caso del chikungunya