Anthropic lançou esta segunda‑feira o Claude Sonnet 5.5, afirmando que o novo modelo de IA de gama média é mais de 30% rápido e pode reduzir em até 30% o custo por tarefa face à geração anterior.
Principais destaques:
- Sonnet 5.5 obteve 70,6% no teste de programação Terminal-Bench 4.0, contra 10,3% do Sonnet 5.
- É o primeiro modelo Sonnet a estrear com salvaguardas de cibersegurança antes reservadas aos sistemas topo de gama da Anthropic.
- Um benchmark independente apontou, no entanto, um custo por tarefa superior ao do Sonnet 5 quando usado no esforço máximo.
Benchmarks do Claude Sonnet 5.5
Este é o segundo modelo da família Claude 5.5 e chegou seis dias depois do topo de gama Claude Opus 5.5, anunciou a empresa no comunicado de lançamento aqui.
A Anthropic posiciona o Sonnet 5.5 como um complemento mais rápido e económico ao Opus 5.5, pensado para tarefas quotidianas bem definidas, correção de bugs e produção de documentos, apresentações e folhas de cálculo com acabamento profissional. O modelo é tarifado a 2 dólares por milhão de tokens de entrada e 10 dólares por milhão de tokens de saída.
No Terminal-Bench 4.0, um teste de programação orientado a agentes, o Sonnet 5.5 alcançou 70,6%, comparando com 10,3% do Sonnet 5 e 66,4% do mais caro Opus 5.5. O modelo também se tornou o primeiro Sonnet a vencer o jogo Pokémon Red recorrendo apenas a capturas de ecrã, um teste de tarefas de longo prazo e capacidade de interpretação de imagens.
O Sonnet 5.5 está agora disponível em todas as plataformas da Anthropic, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. A Anthropic adiantou que o mais compacto Claude Haiku 5.5, dirigido a cenários de grande volume e elevada sensibilidade a custos, chegará nas próximas semanas, completando assim a gama de três modelos.
Veja também: OpenAI trava avanço em Frontier AI após fuga no “sandbox” a 20 de setembro
Salvaguardas e custos do Sonnet 5.5
A Anthropic citou Daniel Vogel, diretor de operações da Epic Games, que referiu que o modelo conseguiu lidar, nos testes iniciais, com “dezenas de milhares de linhas de código” de sistemas de jogabilidade. Segundo Vogel, o desempenho “atingiu o mesmo patamar de qualidade que se esperaria de um modelo de gama superior”.
Dado que as capacidades de cibersegurança do Sonnet 5.5 são comparáveis às do Opus 5, este é o primeiro Sonnet a ser lançado com o conjunto de salvaguardas que a Anthropic reservava para os seus modelos mais potentes. A correção rotineira de bugs permanece inalterada, mas pedidos de cibersegurança de maior risco são automaticamente reencaminhados para o Sonnet 5, de forma visível. Novos classificadores também bloqueiam tentativas de extrair o raciocínio interno do modelo.
Nem todos os testes corroboram, porém, a narrativa de poupança. A empresa de análise Artificial Analysis terá apurado um custo ponderado de 7,60 dólares por tarefa de benchmark, em regime de esforço máximo, contra 5,09 dólares no Sonnet 5 — isto apesar de o índice de desempenho ter subido de 38 para 56.
O lançamento segue‑se à apresentação do Opus 5.5 em 22 de setembro, quando a Anthropic reduziu o preço do modelo bandeira em 20%, para 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. Na altura, a empresa indicou que o Opus 5.5 permitiria reduzir em cerca de 40% o custo típico por carga de trabalho e gerar respostas mais de 30% rápidas face ao Opus 5. No mesmo dia, a OpenAI apresentou os modelos GPT-6 Sol e GPT-6 Luna, com preços equivalentes a metade dos respectivos predecessores.
Leia a seguir: BlackRock prevê que poder computacional vá dar origem a contratos de futuros

