Anthropic frustra complots que usaban IA para desarrollar armas biológicas

Si es mucho más inteligente que nosotros, tendría innumerables formas de acabar con nosotros
Geoffrey Hinton advierte sobre los riesgos de crear inteligencia artificial que supere la capacidad humana.
Mark

¿Qué significa exactamente que Anthropic "frustró" estos complots? ¿Detectaron algo antes de que sucediera algo real, o bloquearon algo que ya estaba en marcha?

Mimi

Detectaron intentos de uso indebido de sus modelos de IA durante ocho meses. Bloquearon el acceso y lo reportaron. No hay indicación de que se haya construido un arma biológica real o que se haya lanzado un ataque.

Luke

Eso es importante aclarar. El comunicado de Anthropic dice que "frustró posibles complots". Eso significa que identificaron patrones de uso sospechoso, no necesariamente que desmantelaron operaciones completas. No sabemos cuán avanzados estaban estos intentos.

Mark

¿Y qué tan fácil es usar Claude o modelos similares para investigar armas biológicas? ¿Realmente pueden hacer eso?

Mimi

Según el informe, sí. Los modelos de IA que son lo suficientemente capaces para ayudar en investigación biológica legítima también pueden ser utilizados para fines peligrosos. Es el problema del uso dual.

Luke

Pero aquí hay un matiz. No sabemos exactamente qué preguntas hicieron estos actores o qué tan útiles fueron las respuestas. Anthropic no ha publicado detalles específicos sobre cómo intentaron usar Claude. Podría haber sido desde consultas muy básicas hasta intentos sofisticados.

Mark

Geoffrey Hinton dice que hay un 10 por ciento de probabilidad de catástrofe por IA en la próxima década. ¿Eso es una cifra real o es especulación?

Mimi

Hinton mismo admite que nadie sabe realmente cómo calcular eso. Es su estimación personal basada en su experiencia en el campo.

Luke

Exactamente. Eva Hubinger de Anthropic citó ese 10 por ciento, y Hinton lo respalda como "no descabellado", pero ambos reconocen que es fundamentalmente incierto. Es una probabilidad que refleja la incertidumbre profunda, no una medición precisa.

Mark

¿Entonces el riesgo real es que una IA superinteligente podría decidir matarnos?

Mimi

Sí, ese es el riesgo existencial que Hinton describe. Si creamos una IA mucho más inteligente que nosotros, tendría capacidades que no podemos predecir completamente.

Luke

Pero hay algo importante aquí: Hinton habla de "si quisiera hacerlo". Eso introduce una cuestión de intención o motivación. ¿Cómo sabemos qué "querría" una IA superinteligente? Eso es todavía más especulativo que la probabilidad del 10 por ciento.

  • Anthropic detectó usos maliciosos de Claude en ocho meses en China, Rusia, Yemen e Irán
  • Actores iraníes utilizaron los modelos para planificar operaciones de vigilancia y ataques potenciales
  • Eva Hubinger estima un 10% de probabilidad de catástrofe por IA en la próxima década
  • Geoffrey Hinton advierte que una IA superinteligente podría diseñar virus biológicos y ciberataques devastadores

Anthropic detectó y bloqueó usos maliciosos de Claude en ocho meses, incluyendo complots para armas biológicas y operaciones de vigilancia vinculadas a regímenes hostiles. Expertos como Geoffrey Hinton estiman un 10% de probabilidad de catástrofe por IA en la próxima década, alertando sobre capacidades de ciberataques y diseño de virus.

Anthropic ha frustrado intentos de uso indebido de sus modelos de IA para investigaciones de armas biológicas en China, Rusia, Yemen e Irán, mientras expertos advierten sobre riesgos existenciales de la IA.

Anthropic ha detectado y bloqueado múltiples intentos de uso indebido de sus modelos de inteligencia artificial para investigaciones que podrían haber conducido al desarrollo de armas biológicas. La empresa de seguridad de IA identificó estos complots durante los últimos ocho meses en operaciones que involucraban a actores en China, Rusia, Yemen e Irán. En algunos casos, grupos vinculados al régimen iraní utilizaron los sistemas de Anthropic, incluido el chatbot Claude, para planificar operaciones de vigilancia y posibles ataques contra objetivos estadounidenses, además de coordinar campañas de propaganda.

El descubrimiento pone de relieve una preocupación creciente en el sector tecnológico: el uso dual de la inteligencia artificial. Los mismos modelos que pueden acelerar investigaciones científicas legítimas en biología también pueden ser desviados hacia fines destructivos. Anthropic ha respondido desarrollando sistemas de detección diseñados para identificar y bloquear usos potencialmente peligrosos de sus modelos antes de que causen daño.

La tensión sobre estos riesgos se intensificó esta semana cuando Jacob Coxon, exempleado tanto de Anthropic como de OpenAI, acusó a ambas empresas de "jugar" con las vidas de las personas. Eva Hubinger, responsable de Ciencia de Alineamiento en Anthropic, respondió con una declaración inquietante: la inteligencia artificial podría aniquilar a toda la humanidad. Según Hubinger, existe actualmente una probabilidad del 10 por ciento de que ocurra una catástrofe generada por IA que afecte a la humanidad en la próxima década.

Geoffrey Hinton, ganador del Premio Nobel y figura central en la historia de la inteligencia artificial, respalda esta estimación en términos generales. En una entrevista con la BBC, Hinton señaló que un 10 por ciento no le parece una estimación descabellada para la posibilidad de que la IA acabe con toda la humanidad. Sin embargo, advirtió contra la falsa precisión: afirmar una probabilidad concreta sería una insensatez porque nadie sabe realmente cómo calcularla.

Lo que preocupa profundamente a Hinton es que la humanidad nunca ha creado seres que pronto podrían ser más inteligentes que nosotros. Una vez que eso es posible, los riesgos se multiplican exponencialmente. Si una IA fuera significativamente más inteligente que los humanos, tendría innumerables formas de causar daño. No necesitaría actuar en el mundo físico para provocar estragos; podría sembrar caos absoluto simplemente interactuando con las personas. Pero también podría diseñar virus biológicos y ciberataques devastadores. Hinton enumera las posibilidades con una frialdad que subraya la magnitud del riesgo: si una IA superinteligente quisiera deshacerse de la humanidad, tendría formas prácticamente ilimitadas de hacerlo.

Esta realidad ha llevado a Hinton a una conclusión sobre dónde debe enfocarse la investigación: no en si la IA puede matarnos, sino en cómo diseñarla para que no quiera hacerlo. Es una pregunta que va al corazón de lo que significa construir sistemas de inteligencia artificial seguros en un mundo donde esos sistemas podrían pronto superarnos en capacidad cognitiva. Los esfuerzos de Anthropic para detectar y bloquear usos maliciosos son un paso en esa dirección, pero el desafío más profundo permanece sin resolver.

La inteligencia artificial podría aniquilar a toda la humanidad
— Eva Hubinger, responsable de Ciencia de Alineamiento de Anthropic
Nunca hemos creado seres que pronto podrían ser más inteligentes que nosotros. Una vez que es posible, si es mucho más inteligente que nosotros, tendría muchas formas distintas de acabar con nosotros
— Geoffrey Hinton, Premio Nobel y pionero de la IA
Vuoi la storia completa? Leggi l'originale su RTVE.es ↗
Contattaci Domande frequenti