Anthropic bloquea cuentas que intentaron usar Claude para investigaciones de armas biológicas

La biología avanzada se mueve en una zona ambigua donde lo médico y lo peligroso convergen
Anthropic reconoce que la misma investigación puede servir para vacunas o para crear patógenos letales.
Mark

¿Por qué Anthropic decidió publicar este informe ahora? ¿Qué ganan siendo transparentes sobre estos intentos de mal uso?

Mimi

Creo que es una apuesta a la credibilidad. Si Anthropic oculta estos casos y luego se descubren, la confianza se desmorona. Al publicarlo, dicen: "Tenemos sistemas, detectamos amenazas, actuamos." Es también una señal a reguladores y gobiernos de que la industria puede autorregularse.

Luke

Pero hay que ser precisos: Anthropic no dice cuántas cuentas bloqueó en total, solo que documentó cinco casos. ¿Cuántos intentos fallidos hubo que no llegaron a ser "casos"? ¿Cuántos pasaron desapercibidos? El informe no lo dice.

Mark

¿Qué tan sofisticados eran realmente estos intentos? ¿Estamos hablando de actores estatales o de investigadores individuales?

Mimi

El uso de intermediarios, la evasión de controles regionales, la fragmentación de consultas... eso sugiere coordinación y conocimiento de cómo funcionan los sistemas de seguridad. No parece amateur. Pero Anthropic no lo especifica.

Luke

Exacto. Anthropic dice que algunos usuarios "accedieron desde regiones no autorizadas mediante intermediarios," pero no define qué es una "región no autorizada" ni quién decide eso. ¿Es una decisión de Anthropic o hay regulación internacional detrás?

Mark

¿Qué tan útil es realmente Claude para este tipo de investigaciones? ¿O estos intentos fueron más bien exploratorios?

Mimi

Claude puede sintetizar información, responder preguntas técnicas, ayudar con redacción de propuestas. Para alguien que busca información sobre virus o toxinas, un modelo de lenguaje es una herramienta de investigación legítima. El problema es que la misma herramienta que sirve para medicina sirve para lo contrario.

Luke

Pero el informe no dice si los usuarios realmente obtuvieron información útil antes de ser bloqueados, o si fueron detenidos antes de llegar a nada sustancial. Eso importa para entender el riesgo real.

  • Entre diciembre de 2025 y agosto de 2026, al menos cinco actores intentaron usar Claude para investigaciones sobre virus, toxinas y moléculas con potencial letal, algunos fragmentando sus consultas deliberadamente para burlar los filtros automáticos.
  • La sofisticación de las evasiones —accesos desde regiones no autorizadas mediante intermediarios, ocultamiento de propósitos y división de sesiones— revela que el riesgo no proviene solo de actores torpes, sino de usuarios con conocimiento técnico y coordinación.
  • Los casos abarcan un espectro que va desde virus transmitidos por mosquitos y gripe aviar hasta viruela, mpox y rediseño computacional de moléculas, todos ellos en la zona gris donde la medicina y el daño comparten la misma información.
  • Anthropic bloqueó las cuentas, incorporó los hallazgos a sus protocolos de seguridad y admitió que sus clasificadores automáticos tienen límites reales frente a consultas biológicas avanzadas.
  • El informe advierte que a medida que los modelos de IA ganen capacidad, la tensión entre utilidad científica y riesgo de mal uso se volverá más aguda y más difícil de gestionar para toda la industria.

En el cruce entre el conocimiento científico y el potencial de destrucción, Anthropic ha documentado cinco casos en los que usuarios intentaron convertir a Claude en un instrumento para investigaciones biológicas de alto riesgo. La compañía bloqueó las cuentas involucradas y publicó un informe que no solo revela la sofisticación de quienes buscan evadir los controles, sino también la fragilidad inherente de cualquier sistema que intente separar la ciencia que salva vidas de la que podría arrebatarlas. Este episodio sitúa a la industria de la inteligencia artificial ante una pregunta que no tiene respuesta sencilla: ¿cómo custodiar el conocimiento sin asfixiar el progreso?

Anthropic anunció esta semana la detección y bloqueo de varias cuentas que intentaron usar Claude para investigaciones con potencial de contribuir al desarrollo de armas biológicas. La compañía documentó cinco casos específicos ocurridos entre diciembre de 2025 y agosto de 2026, y los hizo públicos en un informe de inteligencia de amenazas que describe tanto los patrones de mal uso como las limitaciones de sus propios sistemas de seguridad.

Lo que distingue estos intentos es su sofisticación. Algunos usuarios accedieron a la plataforma desde regiones no autorizadas valiéndose de intermediarios; otros ocultaron el propósito real de sus consultas o las fragmentaron en múltiples sesiones para eludir la detección automática. Anthropic no reveló identidades ni países de origen, pero dejó claro que la evasión fue intencional.

Los cinco casos cubren un espectro inquietante: un virus transmitido por mosquitos, semanas de planificación experimental sobre gripe aviar, una solicitud de financiamiento vinculada a la familia de virus que incluye viruela y mpox, y dos investigaciones sobre toxinas y rediseño computacional de moléculas con usos tanto terapéuticos como potencialmente dañinos. En todos ellos, la misma información que podría salvar vidas también podría servir para arrebatarlas.

La empresa reconoce en su informe que la biología de doble uso existe en una zona gris inevitable, y que no todos los investigadores identificados tenían necesariamente intención de causar daño. Aun así, bloqueó las cuentas asociadas e integró los hallazgos a sus procesos de monitoreo. El documento concluye con una advertencia que trasciende a Anthropic: conforme los modelos de IA se vuelvan más capaces, la tensión entre capacidad y seguridad será uno de los desafíos más persistentes de toda la industria.

Anthropic anunció esta semana que había detectado y bloqueado varias cuentas de usuarios que intentaban utilizar Claude, su modelo de inteligencia artificial, para investigaciones que podrían facilitar el desarrollo de armas biológicas. La compañía publicó un informe de inteligencia de amenazas en el que documentó cinco casos específicos de mal uso potencial, ocurridos entre diciembre de 2025 y agosto de 2026, en los que investigadores emplearon o intentaron emplear la plataforma para tareas de biología de alto riesgo.

Lo que distingue estos intentos es la sofisticación con la que algunos usuarios trataron de evadir los controles de seguridad de Anthropic. Según el reporte, ciertos actores accedieron desde regiones no autorizadas utilizando intermediarios o infraestructura de terceros. Otros ocultaron deliberadamente el propósito real de sus investigaciones o fragmentaron sus consultas en múltiples sesiones, esperando que los sistemas de detección automática no identificaran el patrón completo de lo que estaban buscando. La empresa no reveló la identidad de los investigadores, las instituciones involucradas ni los países de origen, pero dejó claro que la evasión de controles fue intencional y coordinada.

Los cinco casos que activaron las alarmas de seguridad abarcaban un espectro preocupante de investigaciones biológicas. En uno, investigadores de una región no autorizada utilizaron una plataforma intermediaria para acceder a Claude y trabajar en una propuesta relacionada con un virus transmitido por mosquitos. En otro, un investigador pasó semanas planificando experimentos sobre gripe aviar, aunque los filtros de Anthropic limitaron su acceso a versiones menos potentes del modelo. Un tercer caso involucró a un intermediario que permitió a múltiples usuarios utilizar Claude para redactar una solicitud de financiamiento vinculada a una familia de virus que incluye enfermedades como viruela y mpox. Los dos casos restantes se relacionaron con investigaciones sobre venenos, toxinas y rediseño computacional de moléculas que podrían tener aplicaciones tanto terapéuticas como dañinas.

Anthropicreconoce en su informe una realidad incómoda: la biología de doble uso existe en una zona gris. La misma información que permite desarrollar vacunas o tratamientos médicos puede servir para crear patógenos más letales o sustancias tóxicas. Por eso la empresa fue cuidadosa al aclarar que no afirma que todos los investigadores identificados tuvieran intención deliberada de causar daño. Lo que sí quedó establecido es que la detección de estos usos problemáticos fue posible, pero que también reveló las limitaciones de los clasificadores automáticos para identificar consultas avanzadas de biología de doble uso.

Tras investigar estos casos, Anthropic bloqueó las cuentas asociadas e incorporó los hallazgos a sus procesos de seguridad y monitoreo. En algunos casos, sus sistemas de seguridad ya habían impedido el acceso a modelos más potentes o bloqueado solicitudes de mayor riesgo. Pero la compañía reconoce que conforme sus modelos de IA se vuelven más capaces y versátiles, también crece la posibilidad de que sean utilizados por investigadores con intenciones ambiguas, grupos estatales, actores criminales o personas cuyas motivaciones no son claras. El informe sugiere que esta tensión entre capacidad y seguridad seguirá siendo uno de los desafíos centrales de la industria de la IA en los próximos años.

Conforme los modelos de IA se vuelven más capaces, también aumenta la posibilidad de que sean usados por investigadores, grupos estatales, actores criminales o personas con intenciones ambiguas en áreas sensibles
— Anthropic, en su informe de inteligencia de amenazas
Quer a matéria completa? Leia o original em Excélsior ↗
Fale Conosco FAQ