Anthropic desmantelada campaña de IA para manipular opinión sobre guerra de Sudán

Fragmentaron su trabajo para que ninguna sesión revelara sus verdaderas intenciones
Cómo los operadores eludieron los controles de seguridad de Anthropic dividiendo tareas entre múltiples sesiones.
Mark

¿Cómo descubrió Anthropic esta operación? ¿Fue porque alguien denunció algo o porque detectaron patrones anormales en el uso de Claude?

Mimi

El informe no especifica exactamente cómo fue descubierta. Sabemos que Anthropic investigó a fondo y vinculó la operación con funcionarios emiratíes, pero el mecanismo de detección inicial no está claro en lo que publicaron.

Luke

Eso es importante. Si fue por denuncia externa, eso significa que alguien dentro del ecosistema vio algo. Si fue por monitoreo interno, eso sugiere que sus sistemas funcionan. Pero no lo sabemos, y eso importa para evaluar qué tan vulnerable es la plataforma.

Mark

¿Qué tan efectiva fue realmente la campaña? ¿Logró influir en las decisiones del Consejo de Derechos Humanos?

Mimi

El informe no dice si los testimonios fueron presentados exitosamente o si influyeron en las votaciones. Solo dice que fueron diseñados para ser presentados ante dos personas específicas.

Luke

Eso es un vacío importante. Podría ser que la operación fue interceptada antes de tener impacto real, o podría ser que ya había influido en decisiones. Anthropic no está siendo completamente transparente sobre el daño real que se causó.

Mark

¿Por qué Anthropic no nombra explícitamente a los hutíes en la parte de Yemen?

Mimi

Probablemente por precaución legal o diplomática. Dicen "actores" en el norte de Yemen, pero la implicación es clara dado el contexto del conflicto.

Luke

Pero eso también es un problema de precisión. Si fueron los hutíes, dilo. Si no estás seguro, di que no estás seguro. La vaguedad aquí debilita el informe.

Mark

¿Qué tan comunes son estos intentos de evadir los controles de seguridad de Claude?

Mimi

Anthropic no lo dice. Este es un caso que detectaron, pero no sabemos si es la punta del iceberg o una excepción rara.

Luke

Exacto. Un informe responsable habría incluido contexto sobre la frecuencia. ¿Esto ocurre cientos de veces al mes? ¿Una vez al año? Sin eso, no podemos evaluar realmente qué tan grave es el problema de seguridad.

Mark

¿Qué significa que "muchas" pero no "todas" las solicitudes fueron bloqueadas?

Mimi

Significa que los controles funcionaron parcialmente. Los operadores tuvieron que ser creativos y fragmentar su trabajo, pero eventualmente lograron hacer lo que querían.

Luke

Y eso es lo más inquietante del informe. No es que los controles fallaran completamente, sino que un adversario determinado puede trabajar alrededor de ellos con suficiente paciencia y sofisticación. Eso sugiere que estos sistemas no son una barrera real contra actores estatales bien financiados.

  • Una red de 300 influencers ficticios y una ONG clonada de una organización suiza legítima operaban en silencio para moldear la percepción global sobre el papel de Emiratos Árabes Unidos en la guerra de Sudán.
  • La operación llegó hasta los pasillos de la ONU: dos testimonios redactados con precisión quirúrgica para la 62ª sesión del Consejo de Derechos Humanos, diseñados para no mencionar jamás a Abu Dabi y así borrar cualquier rastro de autoría.
  • Dieciocho eurodiputados, periodistas y relatores especiales de la ONU fueron investigados y fichados en dosieres detallados, convirtiendo la campaña en una operación de inteligencia política además de desinformación.
  • En paralelo, desde Yemen, actores no identificados usaban Claude para desarrollar cohetes y misiles balísticos, fragmentando sus solicitudes en múltiples sesiones para que ningún control de seguridad pudiera ver el cuadro completo.
  • Anthropic suspendió las cuentas y compartió la información con socios públicos y privados, pero el episodio deja una pregunta abierta: ¿pueden los sistemas de seguridad de la IA mantenerse al ritmo de quienes aprenden a hablarles en fragmentos?

En el cruce entre la tecnología y la geopolítica, Anthropic reveló que funcionarios emiratíes utilizaron su inteligencia artificial Claude para tejer una red invisible de influencia sobre la guerra de Sudán: perfiles falsos, ONG de fachada y testimonios fabricados para foros de la ONU. Al mismo tiempo, desde el norte de Yemen, actores desconocidos empleaban la misma herramienta para desarrollar software de guiado para misiles, fragmentando sus peticiones para burlar los controles de seguridad. El hallazgo ilumina una verdad incómoda de nuestra era: las mismas herramientas que prometen democratizar el conocimiento pueden convertirse en instrumentos de guerra y manipulación cuando caen en manos que saben cómo disfrazar sus intenciones.

El viernes, Anthropic anunció el desmantelamiento de una operación de desinformación coordinada por funcionarios de alto nivel en Emiratos Árabes Unidos, que utilizaba su asistente de IA Claude para proteger la reputación emiratí en el contexto de la guerra de Sudán y desacreditar al movimiento de los Hermanos Musulmanes ante la opinión pública global.

Un único operador, identificado como 'Deadshot', ejecutó la estrategia desde la plataforma privada de Anthropic, repitiendo secuencias de instrucciones a través de múltiples sesiones simultáneas. La operación construyó una red de aproximadamente 300 perfiles de influencers ficticios en diversas redes sociales y creó una ONG de fachada que imitaba la identidad de una organización suiza legítima para publicar informes de derechos humanos redactados en realidad por el Estado.

La sofisticación de la campaña alcanzó los foros internacionales: se redactaron testimonios para la 62ª sesión del Consejo de Derechos Humanos de la ONU, cuidadosamente diseñados para no mencionar a Emiratos Árabes Unidos en ningún momento, haciendo que la influencia operara de forma indirecta e imposible de rastrear. Además, se compilaron dosieres detallados sobre dieciocho eurodiputados, periodistas y relatores especiales de la ONU críticos con Abu Dabi.

En un hallazgo paralelo, Anthropic identificó actores desde el norte de Yemen utilizando Claude para desarrollar software de guiado para un cohete, un misil balístico de más de dos mil kilómetros de alcance y un misil de la serie R2000. Para eludir los controles de seguridad, fragmentaban su trabajo en múltiples sesiones, impidiendo que ninguna solicitud individual revelara sus verdaderas intenciones.

Aunque los sistemas de Anthropic bloquearon muchas de estas solicitudes, no todas fueron interceptadas. La compañía suspendió las cuentas involucradas y compartió la información con socios públicos y privados, dejando expuesto un desafío que va más allá de este caso: cómo prevenir que las herramientas de IA sean utilizadas simultáneamente para manipular la opinión pública y acelerar el desarrollo de armamento, por actores que han aprendido a hablarle a la máquina en fragmentos.

Anthropic anunció el viernes que había desmantelado una operación de desinformación coordinada por funcionarios de alto nivel en Emiratos Árabes Unidos. La campaña utilizaba su asistente de inteligencia artificial Claude para manipular la opinión pública global sobre el papel de Abu Dabi en la guerra de Sudán, específicamente para desacreditar al movimiento de los Hermanos Musulmanes y proteger la reputación emiratí en foros internacionales.

Un único operador, identificado como 'Deadshot' y alojado en la plataforma privada de Anthropic, ejecutó la estrategia replicando las mismas secuencias de instrucciones una y otra vez a través de múltiples sesiones simultáneas. La escala de la operación fue considerable: construyeron y administraron una red de aproximadamente 300 perfiles de influencers completamente ficticios distribuidos en varias plataformas de redes sociales. Crearon además una organización no gubernamental de fachada que copiaba la identidad de una organización suiza legítima, utilizándola para publicar reportes sobre derechos humanos que en realidad fueron redactados por el Estado.

La sofisticación de la campaña se extendía más allá de las redes sociales. Los operadores redactaron testimonios oficiales diseñados específicamente para ser presentados ante dos personas en la 62ª sesión del Consejo de Derechos Humanos de las Naciones Unidas. El contenido fue cuidadosamente estructurado con restricciones muy precisas: ninguno de los dos discursos mencionaría a Emiratos Árabes Unidos, lo que permitía que la influencia operara de manera indirecta y menos rastreable.

La operación también incluyó un componente de inteligencia dirigido contra actores políticos y mediáticos occidentales. Anthropic identificó que se investigó a profundidad a dieciocho miembros del Parlamento Europeo y periodistas prominentes, compilando dosieres detallados sobre sus actividades y posiciones. Simultáneamente, los operadores recopilaron expedientes sobre relatores especiales de la ONU que habían sido críticos con la conducta de Abu Dabi en Sudán. Aunque la operación fue construida deliberadamente para no dejar rastros que la vincularan con actores específicos, la investigación de Anthropic la conectó con total seguridad a funcionarios del gobierno emiratí.

En un hallazgo paralelo igualmente preocupante, Anthropic identificó una célula de actores operando desde el norte de Yemen —sin nombrar explícitamente a los rebeldes hutíes— que utilizaba Claude para ejecutar tres programas de desarrollo de armamento. Los proyectos incluían un cohete guiado, un misil balístico con alcance superior a dos mil kilómetros y un misil de la serie R2000. En lugar de contratar ingenieros de software, estos actores utilizaron Claude Code para desarrollar el software de guiado, navegación y control que dirige y estabiliza vehículos voladores. Un ejemplo específico: utilizaron Claude para integrar un piloto automático de código abierto en una computadora de vuelo del tamaño de un teléfono, escribiendo el software de control y estimación de posición.

Los sistemas de seguridad de Anthropic bloquearon muchas de las solicitudes, aunque no todas. Los operadores emplearon diversas tácticas para eludir las medidas de protección: ocultaban sus objetivos reales y los productos finales para los que estaba destinado el software, y fragmentaban su trabajo en múltiples sesiones para que ninguna sesión individual revelara sus verdaderas intenciones. Esta estrategia de compartimentación permitió que continuaran avanzando en el desarrollo incluso cuando enfrentaban resistencia de los controles de seguridad.

Anthropic suspendió las cuentas involucradas y compartió la información con socios en los sectores público y privado para mitigar los riesgos. El descubrimiento subraya un desafío emergente en la seguridad de la inteligencia artificial: cómo las herramientas de IA pueden ser utilizadas simultáneamente para operaciones de desinformación política sofisticadas y para acelerar el desarrollo de armamento avanzado, todo mientras los operadores trabajan activamente para evadir los controles de seguridad diseñados precisamente para prevenir estos usos.

Aunque la operación fue construida de manera que no se pudiera remontar a actores, nuestra investigación la ha vinculado con total seguridad a funcionarios del Gobierno de EAU
— Informe de Anthropic
Emplearon diversas tácticas para eludir las medidas de seguridad, como ocultar sus objetivos y fragmentar su trabajo en múltiples sesiones
— Informe de Anthropic
Envie de l'histoire complète ? Lire l'original sur La Tercera ↗
Nous contacter FAQ