Anthropic lança Claude Sonnet 5.5 com 30% mais velocidade e custos reduzidos

Processa menos texto, custa menos, entrega mais rápido
O Sonnet 5.5 reduz custos em até 30% por tarefa ao ser mais eficiente no uso de tokens.
Mark

Por que a Anthropic lançou especificamente um modelo intermediário agora? Não tinham o Sonnet 5 já?

Mimi

Tinham, mas o Sonnet 5.5 é uma evolução focada em eficiência. A empresa percebeu que muitas tarefas do dia a dia — programação, criação de documentos — não precisam da potência bruta do Opus. Então otimizaram o Sonnet para ser mais rápido e mais barato nessas situações.

Luke

Mas espera: os preços por token não mudaram. Como exatamente o custo cai 30%?

Mimi

Porque o modelo precisa de menos tokens para fazer o mesmo trabalho. Se antes precisava de 1.000 tokens para uma tarefa e agora precisa de 700, você paga menos mesmo com a mesma tabela de preços.

Mark

E esses números de desempenho — 70,6% no Terminal-Bench — o que significam na prática?

Mimi

Significam que o modelo consegue executar tarefas complexas em linha de comando muito melhor. No teste anterior, o Sonnet 5 acertava apenas 10,3% das vezes. Agora acerta sete vezes mais.

Luke

Mas quem fez esses testes? A própria Anthropic, certo?

Mimi

Sim, foram testes internos da Anthropic. Eles também citam feedback de clientes como Epic Games e Slack, que testaram o modelo.

Mark

E o Opus 5.5 fica obsoleto?

Mimi

Não. A Anthropic deixa claro que o Opus continua sendo a escolha para trabalhos mais abertos e complexos que exigem raciocínio prolongado. O Sonnet 5.5 é para tarefas bem definidas.

Luke

Há alguma limitação mencionada?

Mimi

As salvaguardas de cibersegurança direcionam solicitações mais arriscadas de volta ao Sonnet 5, então há um limite no que o 5.5 pode fazer em segurança. Mas para a maioria das tarefas cotidianas, funciona.

Mark

Quando fica disponível?

Mimi

Já está disponível em AWS, Google Cloud e Microsoft Azure. O Haiku 5.5, o modelo mais leve, chega nas próximas semanas.

  • O mercado de IA enfrenta uma tensão crescente entre modelos cada vez mais caros e poderosos e a necessidade real das empresas por ferramentas ágeis e economicamente viáveis no dia a dia.
  • O Sonnet 5.5 provoca uma ruptura silenciosa: sem alterar a tabela de preços por token, a Anthropic reduz o custo real por tarefa em até 30% ao fazer o modelo precisar de menos fragmentos de texto para chegar ao resultado.
  • Os benchmarks de programação revelam saltos expressivos — de 10,3% para 70,6% no Terminal-Bench 4.0 e de 34,1% para 55,5% no CursorBench 4.0 — sinalizando que o modelo não apenas ficou mais rápido, mas fundamentalmente mais capaz em tarefas técnicas.
  • Empresas como Epic Games e Slack já relatam que o Sonnet 5.5 supera modelos de categoria superior sem qualquer ajuste nos prompts existentes, indicando uma adoção acelerada no ambiente corporativo.
  • O modelo chega com salvaguardas inéditas para a linha Sonnet — mecanismos de cibersegurança e fallback que equilibram capacidade expandida com limites de risco — e já está disponível em AWS, Google Cloud e Azure.

Em um momento em que a inteligência artificial deixa de ser promessa e passa a ser ferramenta de trabalho cotidiano, a Anthropic apresentou o Claude Sonnet 5.5 — um modelo intermediário que não busca ser o mais poderoso, mas o mais útil para as tarefas que as pessoas realmente precisam realizar. Com velocidade 30% superior e custos efetivos até 30% menores, o novo modelo representa uma aposta deliberada na eficiência prática sobre a grandiosidade técnica, reconhecendo que a maioria das necessidades humanas não exige raciocínio prolongado, mas respostas rápidas e confiáveis.

A Anthropic lançou o Claude Sonnet 5.5, seu novo modelo intermediário, posicionado não como o mais sofisticado da família, mas como o mais eficiente para o trabalho cotidiano. O modelo processa informações mais de 30% mais rápido que seu antecessor e, embora mantenha a mesma tabela de preços por token, consegue reduzir o custo final de uma tarefa em até 30% porque precisa de menos unidades de texto para chegar ao resultado — uma distinção sutil, mas economicamente relevante para empresas que operam em escala.

Os ganhos são especialmente visíveis em programação. No Terminal-Bench 4.0, o Sonnet 5.5 alcançou 70,6% contra apenas 10,3% do modelo anterior. No OSWorld 2.1, subiu de 57% para 80,1%. No CursorBench 4.0, que simula sessões reais de desenvolvimento, passou de 34,1% para 55,5%. Daniel Vogel, da Epic Games, relatou que o modelo atingiu o nível de qualidade esperado de uma categoria superior. Curtis Allen, do Slack, afirmou que o Sonnet 5.5 superou o antecessor em quase todas as avaliações internas sem qualquer alteração nos prompts.

Os avanços não se restringem ao código. Em um teste interno, o modelo recebeu materiais trimestrais e transcrições de uma empresa pública e produziu uma apresentação de dez slides que dois especialistas consideraram pronta para envio imediato — um sinal de que a eficiência se estende a tarefas de conhecimento e criação.

O aumento de capacidade veio acompanhado de novas proteções: o Sonnet 5.5 é o primeiro da linha Sonnet lançado com salvaguardas de cibersegurança semelhantes às do Opus 5.5, limitando solicitações de maior risco sem comprometer tarefas rotineiras. O modelo já está disponível em Amazon Web Services, Google Cloud e Microsoft Azure, com o Haiku 5.5 previsto para as próximas semanas.

A Anthropic apresentou o Claude Sonnet 5.5, seu novo modelo intermediário, com ganhos de velocidade e eficiência de custo que o posicionam como ferramenta mais prática para trabalhos do dia a dia. O modelo processa informações mais de 30% mais rápido que seu antecessor e, embora mantenha a mesma tabela de preços por token — dois dólares por milhão de tokens de entrada, dez dólares por milhão de saída e vinte centavos por milhão em leituras de cache — consegue reduzir o custo final de uma tarefa em até 30% porque precisa de menos unidades de texto para chegar ao resultado.

Tokens são as pequenas unidades de linguagem que modelos de inteligência artificial decompõem para compreender uma pergunta e formular uma resposta. A eficiência do Sonnet 5.5 em usar menos desses fragmentos é o que torna a economia real, mesmo com a tabela de preços inalterada. A empresa desenhou o modelo para tarefas bem definidas: corrigir código, redigir documentos, montar apresentações, construir planilhas. Enquanto isso, o Opus 5.5 permanece como a opção para trabalhos mais abertos e complexos que exigem raciocínio prolongado.

Os ganhos aparecem com clareza nos testes de programação. No Terminal-Bench 4.0, uma avaliação que mede a capacidade de uma IA executar tarefas complexas em linha de comando — o ambiente baseado em texto que desenvolvedores usam para rodar programas — o Sonnet 5.5 alcançou 70,6%, contra apenas 10,3% do Sonnet 5. No OSWorld 2.1, que testa tarefas realizadas em computadores, o novo modelo atingiu 80,1% enquanto o anterior ficou em 57%. Em FrontierCode 1.1, avaliação de programação, marcou 46,2% contra 42,4%. No CursorBench 4.0, que simula sessões reais de desenvolvimento, chegou a 55,5% enquanto o Sonnet 5 ficou em 34,1%. Em GDPval-AA v2.1, que mede trabalhos profissionais de diferentes áreas, alcançou 1.844 pontos ante 1.449 do modelo anterior.

A melhoria é especialmente visível em tarefas de programação. O Sonnet 5.5 compreende bases de código com rapidez e executa trabalhos em menos etapas, conforme destacaram testadores que também notaram eficiência no uso de ferramentas. Daniel Vogel, diretor de operações da Epic Games, afirmou em nota que em testes iniciais o Claude Sonnet 5.5 atingiu o mesmo nível de qualidade esperado de um modelo de categoria superior. Curtis Allen, engenheiro principal do Slack, relatou que sem alterar seus prompts o Sonnet 5.5 teve desempenho melhor que o Sonnet 5 em quase todas as avaliações internas do Slackbot.

Os avanços não se limitam ao código. A Anthropic destaca o desempenho em tarefas de conhecimento e criação, incluindo interfaces e apresentações. Em um teste interno, o modelo recebeu materiais trimestrais, transcrições de uma companhia pública e um modelo de apresentação, e produziu uma revisão operacional de dez slides que dois especialistas consideraram pronta para envio imediato.

O aumento de capacidade veio acompanhado de novas proteções. O Sonnet 5.5 é o primeiro modelo da linha Sonnet lançado com salvaguardas de cibersegurança e mecanismos de fallback semelhantes aos do Opus 5.5. Essas salvaguardas limitam o uso da IA em situações de maior risco: tarefas rotineiras de desenvolvimento continuam disponíveis, mas solicitações mais arriscadas podem ser direcionadas ao Sonnet 5. Na área de biologia, as proteções permanecem iguais às do Sonnet 5 e se concentram em pedidos de alto risco.

O Sonnet 5.5 já está disponível em todas as plataformas principais, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. O Claude Haiku 5.5, o modelo mais leve da família, será lançado nas próximas semanas para completar a nova geração de modelos da Anthropic.

Em testes iniciais, o Claude Sonnet 5.5 atingiu o mesmo nível de qualidade esperado de um modelo de categoria superior
— Daniel Vogel, diretor de operações da Epic Games
Sem alterar nossos prompts, o Claude Sonnet 5.5 teve desempenho melhor que o Sonnet 5 em quase todas as nossas avaliações internas
— Curtis Allen, engenheiro principal do Slack
Möchten Sie die ganze Geschichte? Das Original lesen bei Olhar Digital ↗
Kontakt FAQ