Em um momento em que a inteligência artificial avança mais rápido do que a capacidade humana de compreender suas consequências, a Anthropic revelou que seus modelos foram alvo de tentativas deliberadas de uso para fins destrutivos — desde a síntese de armas biológicas até operações de espionagem patrocinadas por Estados. O relatório, publicado em setembro de 2026, não é apenas um inventário de ameaças bloqueadas, mas um espelho da tensão fundamental entre o poder criativo da tecnologia e a fragilidade das salvaguardas que a cercam. À medida que vozes científicas e políticas pedem pausas e caut
Anthropic relata ter bloqueado tentativas de usar IA para desenvolver armas biológicas
As mesmas informações para uma arma também servem para uma vacina
Por que a Anthropic está publicando esses relatórios agora? Parece uma mudança recente.
As empresas de IA começaram a fazer isso para mostrar que estão levando a segurança a sério. É uma forma de demonstrar responsabilidade enquanto continuam desenvolvendo a tecnologia.
Mas há algo importante aqui: eles estão bloqueando essas tentativas, certo? Então como sabem exatamente o que as pessoas tentaram fazer? Eles estão monitorando conversas?
Sim, detectam padrões suspeitos — perguntas muito específicas sobre síntese biológica, por exemplo. Quando veem algo assim, conseguem interromper antes que vire um problema real.
E quanto aos casos que mencionam — cinco estudos de caso sobre armas biológicas. Eles deram detalhes sobre quem tentou?
Não, e esse é o ponto. O relatório não nomeia os atores específicos nesses cinco casos. Sabemos que aconteceu, mas não sabemos quem eram ou de onde vinham.
Provavelmente por razões de segurança. Se revelassem quem tentou, poderiam estar expondo investigações em andamento ou comprometendo parceiros que trabalham com autoridades.
Então estamos confiando que a Anthropic está dizendo a verdade sobre o número de casos e a seriedade deles?
Exatamente. Eles têm incentivo para mostrar que seus sistemas funcionam. Mas não há verificação independente desses números. Temos que confiar na palavra deles.
É verdade, mas o Google também reportou algo similar com o Gemini na mesma semana. Isso sugere que não é apenas a Anthropic vendo isso — é um padrão real.
E quanto àquele aviso sobre 10% de chance de matar toda a humanidade? Isso parece extremo.
É um pesquisador da Anthropic dizendo isso, não um consenso científico. É uma estimativa pessoal dele, não um resultado de pesquisa revisada por pares. Precisamos ser cuidadosos em não tratar como fato estabelecido.
Il Polso
- Entre dezembro de 2025 e agosto de 2026, a Anthropic identificou cinco tentativas distintas de usar seus modelos Claude para apoiar o desenvolvimento de armas biológicas — um dos cenários de risco mais graves imaginados pela indústria.
- O escopo das ameaças vai além do laboratório: hackers russos, grupos iranianos de propaganda, empresas chinesas e cibercriminosos independentes também exploraram a plataforma para fins que vão de espionagem a golpes financeiros e vigilância de dissidentes políticos.
- O Google reportou caso semelhante com seu modelo Gemini, e cientistas da Anthropic e da OpenAI passaram a estimar publicamente probabilidades superiores a 10% de impacto catastrófico na próxima década — uma linguagem de risco raramente usada fora de contextos de guerra nuclear.
- Figuras políticas como Bernie Sanders pedem pausa imediata no desenvolvimento, enquanto Donald Trump, antes cético, admitiu publicamente preocupação — sinalizando que o debate saiu dos laboratórios e entrou na arena do poder.
- A Anthropic afirma ter incorporado as descobertas em seus sistemas de prevenção e compartilhado informações com autoridades, mas a pergunta que paira é se qualquer salvaguarda conseguirá acompanhar o ritmo do próprio avanço que busca conter.
Em um momento em que a inteligência artificial avança mais rápido do que a capacidade humana de compreender suas consequências, a Anthropic revelou que seus modelos foram alvo de tentativas deliberadas de uso para fins destrutivos — desde a síntese de armas biológicas até operações de espionagem patrocinadas por Estados. O relatório, publicado em setembro de 2026, não é apenas um inventário de ameaças bloqueadas, mas um espelho da tensão fundamental entre o poder criativo da tecnologia e a fragilidade das salvaguardas que a cercam. À medida que vozes científicas e políticas pedem pausas e cautela, a humanidade se vê diante de uma pergunta antiga com urgência inédita: a que velocidade devemos avançar quando o caminho à frente é irreversível?
A Anthropic divulgou um relatório detalhando como identificou e bloqueou dezenas de tentativas de uso malicioso de seus modelos de IA entre dezembro de 2025 e agosto de 2026. Entre os casos mais graves, cinco envolveram atores que buscavam apoio para o desenvolvimento de armas biológicas usando os modelos Claude Haiku, Sonnet e Opus. Jacob Klein, chefe de inteligência de ameaças da empresa, descreveu o desafio como extraordinariamente complexo, já que usuários raramente revelam abertamente suas intenções.
O relatório vai além das armas biológicas: seis casos documentaram tentativas de desenvolver software para armas convencionais, incluindo mísseis e drones armados. Grupos como ShinyHunters e hackers com padrões associados ao russo Midnight Blizzard também foram identificados — este último teria usado IA para criar um sistema capaz de reescrever automaticamente seu próprio malware para escapar de sistemas de defesa. Agentes ligados à Rússia e ao Irã, além de empresas chinesas que tentaram replicar capacidades dos modelos Claude, também aparecem no documento.
O relatório surge em meio a uma onda de alertas crescentes. O Google reportou tentativa semelhante com o Gemini. Um pesquisador sênior da Anthropic estimou publicamente mais de 10% de probabilidade de que a IA possa causar mortes em massa na próxima década. Jakub Pachocki, cientista-chefe da OpenAI, publicou artigo pedindo desacelerações voluntárias até que medidas de segurança adequadas sejam estabelecidas. No campo político, Bernie Sanders pediu uma pausa formal no desenvolvimento, e Donald Trump — antes dismissivo — admitiu preocupação real com o tema.
A Anthropic afirma ter incorporado as descobertas em seus processos internos e compartilhado informações com autoridades competentes. Mas a questão central permanece sem resposta: as salvaguardas sendo construídas hoje conseguirão acompanhar a velocidade da tecnologia que buscam proteger?
A Anthropic, empresa americana de inteligência artificial, divulgou na quinta-feira um relatório detalhando como conseguiu identificar e bloquear múltiplas tentativas de usar seus modelos de IA para fins maliciosos — desde o desenvolvimento de armas biológicas até operações de ciberespionagem patrocinadas por Estados. O documento representa o mais recente sinal de alerta vindo de pesquisadores e líderes do setor sobre os riscos potenciais que a tecnologia representa para a humanidade.
Entre dezembro de 2025 e agosto de 2026, a Anthropic detectou casos preocupantes envolvendo seus modelos Claude Haiku, Sonnet e Opus. O relatório destaca cinco estudos de caso específicos de atores que tentaram usar a plataforma de maneiras que poderiam apoiar o desenvolvimento de armas biológicas. A empresa enfatiza que esse tipo de uso indevido representa um dos riscos mais graves dos modelos de IA de ponta, e sem salvaguardas adequadas, as consequências poderiam ser catastróficas. Jacob Klein, chefe de inteligência de ameaças da Anthropic, descreveu a situação como incrivelmente complexa, observando que os usuários raramente se identificam abertamente com intenções destrutivas.
O escopo das atividades maliciosas bloqueadas vai muito além das armas biológicas. O relatório documenta seis casos em que o Claude foi usado para desenvolver software destinado a armas convencionais, incluindo armas de fogo, mísseis, drones armados e bombas. Cibercriminosos e hackers patrocinados por governos também exploraram a tecnologia para auxiliar suas operações. O grupo ShinyHunters e laboratórios baseados na China foram nomeados no documento. Um grupo de hackers com padrões consistentes com o grupo russo Midnight Blizzard supostamente usou inteligência artificial para construir um sistema que detectava automaticamente quando seu malware era sinalizado pelas defesas de segurança e reescrevia o código para burlar a detecção.
O relatório também revelou que agentes ligados a campanhas de ciberespionagem com base na Rússia e uma instituição de propaganda iraniana utilizaram o modelo Claude. Nos últimos oito meses, a Anthropic identificou casos que variavam desde aplicativos de namoro falsos e golpes com wi-fi de hotéis até sistemas de vigilância criados para identificar dissidentes políticos. A empresa acusou ainda empresas chinesas de IA de tentarem replicar as capacidades do Claude. Nenhum dos casos de uso indevido envolveu o Claude Fable ou os poderosos modelos da classe Mythos, com exceção de um caso de destilação — o processo de treinar modelos menores usando modelos maiores e mais capazes.
Este relatório chega em um momento de crescente preocupação na indústria. Na terça-feira anterior, o Google divulgou que uma pessoa tentou usar seu modelo Gemini para obter um guia técnico completo e passo a passo para sintetizar agentes biológicos como armas. O senador americano Bernie Sanders fez um apelo por uma pausa no desenvolvimento de IA avançada e a proibição da superinteligência artificial. O presidente Donald Trump, que havia rejeitado esses temores, mudou de posição na quinta-feira, afirmando estar preocupado: se não vencerem a IA, ficarão em uma situação muito ruim.
Os cientistas da área estão intensificando seus avisos. Um dos principais investigadores de segurança da Anthropic alertou que a IA está avançando tão rapidamente que acredita haver uma probabilidade superior a 10% de que possa matar todos os humanos na próxima década. Jakub Pachocki, cientista-chefe da OpenAI, publicou um artigo pedindo que a indústria implemente desacelerações voluntárias até que medidas de segurança sejam estabelecidas. Ele expressou preocupação de que ninguém esteja preparado para as consequências do crescimento rápido e contínuo da inteligência artificial, e afirmou que quando cientistas dizem que existe uma chance de impacto catastrófico na humanidade, é necessário ser prudente no desenvolvimento de IA avançada.
A Anthropic afirmou ter incorporado as descobertas em seus processos para melhor prevenir, detectar e interromper essas atividades no futuro. A empresa também compartilhou informações com autoridades e parceiros do setor quando apropriado. Esses relatórios sobre ameaças se tornaram comuns no setor de IA, à medida que as empresas buscam demonstrar como identificam e interrompem tentativas de uso indevido de seus modelos. A questão que permanece em aberto é se essas medidas de proteção serão suficientes para acompanhar a velocidade do desenvolvimento tecnológico.
Citazioni salienti
Se não vencermos a IA, ficaremos em uma situação muito ruim— Donald Trump, quinta-feira
Quando os cientistas dizem que existe uma chance de que isso possa ter um impacto catastrófico na humanidade, você tem que ser um idiota para não dizer: vá com calma— Jakub Pachocki, cientista-chefe da OpenAI