Anthropic expande acesso a modelos de IA mais poderosos para equipes de segurança

Defesa contra ataques que ainda não foram inventados
A Anthropic oferece aos defensores de segurança acesso a seus modelos mais poderosos para encontrar vulnerabilidades antes que sejam exploradas.
Mark

Por que a Anthropic está abrindo acesso a esses modelos agora? Parece arriscado.

Mimi

Eles argumentam que os defensores precisam das mesmas ferramentas que os atacantes poderiam usar. Se você quer encontrar vulnerabilidades antes que alguém as explore, precisa de um modelo poderoso.

Luke

Mas quem define "defensor"? A empresa diz que avalia com o governo dos EUA, mas não sabemos exatamente quais são os critérios.

Mimi

É verdade. Eles consolidaram dois programas que já existiam, então não é totalmente novo. Mas agora há três níveis claros, e o mais restritivo é para infraestrutura crítica mesmo.

Mark

E se alguém conseguir enganar o processo de verificação?

Luke

Esse é o risco real que ninguém consegue quantificar. A Anthropic admite que seus números são provavelmente subestimados. Eles esperam que o impacto real seja cinco vezes maior, mas isso é uma estimativa, não um dado.

Mimi

O programa Glasswing já estava funcionando há seis meses sem grandes incidentes públicos. Isso sugere que o modelo de verificação está funcionando, pelo menos até agora.

Mark

Então a questão é se confiar que o governo americano está fazendo seu trabalho de verificação bem.

Luke

Exatamente. E nós não temos visibilidade sobre isso.

  • O lançamento do Claude Mythos em abril acendeu um alerta: e se a IA mais capaz da Anthropic chegasse às mãos erradas antes que as defesas estivessem prontas?
  • Dois programas paralelos e fragmentados criavam lacunas de cobertura e inconsistência nos critérios de quem podia acessar o quê.
  • A Anthropic consolidou tudo em um único programa com três níveis — Defesa, Red Team e Specialized — cada um com critérios de verificação e salvaguardas próprios.
  • O nível mais restrito, Specialized, reserva acesso com proteções mínimas para organizações que guardam redes elétricas, sistemas de voo e infraestrutura bancária.
  • A avaliação conjunta com o governo dos EUA funciona como filtro institucional, tentando garantir que ferramentas poderosas cheguem apenas a quem as usará para proteger, não para atacar.

Em um momento em que a inteligência artificial avança mais rápido do que as defesas que a cercam, a Anthropic deu um passo calculado: abrir seus modelos mais poderosos não ao mercado, mas aos guardiões digitais. O novo Programa de Verificação Cibernética, anunciado nesta terça-feira, organiza em três camadas o acesso a ferramentas que antes eram distribuídas de forma fragmentada, reconhecendo que proteger infraestruturas críticas exige que os defensores estejam armados com os mesmos recursos que os adversários. A parceria com agências do governo americano para avaliar candidatos revela que, neste campo, a confiança não é presumida — ela é verificada.

A Anthropic anunciou nesta terça-feira a reformulação de seu programa de acesso a modelos de IA para profissionais de segurança digital. O movimento consolida duas iniciativas anteriores — o programa Glasswing e o programa original de verificação cibernética — em uma estrutura única com três camadas de acesso, cada uma com critérios e salvaguardas distintos.

O novo Programa de Verificação Cibernética oferece acesso aos modelos Opus 5.5, Sonnet 5.5 e Mythos 5.1 em todos os níveis. O nível "Defesa", o mais acessível, cobre resposta a incidentes e análise de malware, aberto a equipes de segurança, pesquisadores e mantenedores de código aberto. O nível "Red Team" permite testes de penetração e simulações de ataque, mas exige que os participantes sejam organizações formais. Já o nível "Specialized", com as menores restrições, é reservado a um grupo seleto autorizado a testar infraestruturas críticas como redes elétricas, sistemas de aviação e transferências interbancárias.

A Anthropic avalia cada candidato em parceria com agências do governo americano. Os membros atuais do Glasswing migram automaticamente para o nível Specialized. A empresa admite que seus dados subestimam o alcance real do programa — o impacto efetivo pode ser até cinco vezes maior do que o mensurável.

O pano de fundo do anúncio é a tensão que surgiu em abril, quando o lançamento do Claude Mythos gerou preocupações de que modelos tão capazes pudessem ser usados para comprometer sistemas antes que as defesas estivessem em lugar. O novo programa é, em parte, uma resposta a esse dilema: dar aos defensores acesso às mesmas ferramentas poderosas, mas com verificação rigorosa para evitar que cheguem a mãos mal-intencionadas.

A Anthropic reformulou seu programa de acesso a modelos de inteligência artificial, abrindo seus sistemas mais poderosos para um círculo mais amplo de profissionais de segurança digital. O movimento, anunciado nesta terça-feira, consolida duas iniciativas que a empresa vinha executando nos últimos seis meses em um único programa estruturado em três camadas, cada uma com seus próprios critérios de verificação e salvaguardas.

O novo Programa de Verificação Cibernética reúne o que era antes dois esforços separados. O primeiro deles, chamado Glasswing, havia dado a organizações responsáveis por softwares críticos acesso ao Claude Mythos, a linha de modelos mais capaz da Anthropic. O segundo, o programa original de verificação cibernética, concedia a equipes de segurança aprovadas a possibilidade de usar o Claude Opus e o Sonnet com proteções menos rigorosas. Agora, todos os três níveis do novo programa oferecem acesso aos modelos Opus 5.5, Sonnet 5.5, Mythos 5.1 e versões futuras.

A estrutura em camadas reflete diferentes usos e diferentes riscos. O nível "Defesa" é o mais acessível e cobre atividades como resposta a incidentes de segurança e análise de malware. Equipes de segurança, operadores de infraestrutura crítica, mantenedores de projetos de código aberto e pesquisadores com histórico documentado de descoberta de vulnerabilidades podem se inscrever. O nível "Red Team" adiciona testes de penetração autorizados e simulações de ataque, mas apenas organizações formais podem participar. O nível "Specialized" tem as restrições mais leves e fica reservado a um pequeno grupo de organizações com permissão para testar sistemas que são vitais para a segurança nacional e econômica: redes de energia elétrica, sistemas de voo e infraestrutura de transferências interbancárias.

A Anthropic avalia cada candidato em conjunto com agências do governo dos EUA. Os membros atuais do programa Glasswing serão automaticamente movidos para o nível Specialized. A empresa reconhece que seus números provavelmente subestimam o alcance real do programa e espera que o impacto efetivo seja pelo menos cinco vezes maior do que o que consegue medir, já que seus dados vêm de uma pesquisa com um número limitado de parceiros.

O lançamento do Claude Mythos em abril havia gerado preocupações públicas de que a inteligência artificial pudesse ser usada para atacar e comprometer softwares antes que as defesas estivessem em lugar. A estrutura do novo programa tenta equilibrar a necessidade de dar aos defensores acesso a ferramentas poderosas com o risco de que essas mesmas ferramentas caiam em mãos que as usem para fins maliciosos. A verificação conjunta com o governo americano é parte dessa estratégia de contenção.

A Anthropic espera que o impacto real do programa seja pelo menos cinco vezes maior do que os números atuais, já que os dados provêm de uma pesquisa com número limitado de parceiros
— Anthropic
Envie de l'histoire complète ? Lire l'original sur UOL ↗
Nous contacter FAQ