Claude Sonnet 5.5 chega ao mercado e Anthropic diz que reduz custo por tarefa em até 30%

Anthropic's Claude Sonnet 5.5 mid-tier model delivers over 30% faster output and lower task costs, with one benchmark questioning savings (Image: Shutterstock)
Anthropic's Claude Sonnet 5.5 mid-tier model delivers over 30% faster output and lower task costs, with one benchmark questioning savings (Image: Shutterstock)

Anthropic lançou esta segunda‑feira o Claude Sonnet 5.5, afirmando que o novo modelo de IA de gama média é mais de 30% rápido e pode reduzir em até 30% o custo por tarefa face à geração anterior.

Principais destaques:

  • Sonnet 5.5 obteve 70,6% no teste de programação Terminal-Bench 4.0, contra 10,3% do Sonnet 5.
  • É o primeiro modelo Sonnet a estrear com salvaguardas de cibersegurança antes reservadas aos sistemas topo de gama da Anthropic.
  • Um benchmark independente apontou, no entanto, um custo por tarefa superior ao do Sonnet 5 quando usado no esforço máximo.

Benchmarks do Claude Sonnet 5.5

Este é o segundo modelo da família Claude 5.5 e chegou seis dias depois do topo de gama Claude Opus 5.5, anunciou a empresa no comunicado de lançamento aqui.

A Anthropic posiciona o Sonnet 5.5 como um complemento mais rápido e económico ao Opus 5.5, pensado para tarefas quotidianas bem definidas, correção de bugs e produção de documentos, apresentações e folhas de cálculo com acabamento profissional. O modelo é tarifado a 2 dólares por milhão de tokens de entrada e 10 dólares por milhão de tokens de saída.

No Terminal-Bench 4.0, um teste de programação orientado a agentes, o Sonnet 5.5 alcançou 70,6%, comparando com 10,3% do Sonnet 5 e 66,4% do mais caro Opus 5.5. O modelo também se tornou o primeiro Sonnet a vencer o jogo Pokémon Red recorrendo apenas a capturas de ecrã, um teste de tarefas de longo prazo e capacidade de interpretação de imagens.

O Sonnet 5.5 está agora disponível em todas as plataformas da Anthropic, incluindo Amazon Web Services, Google Cloud e Microsoft Azure. A Anthropic adiantou que o mais compacto Claude Haiku 5.5, dirigido a cenários de grande volume e elevada sensibilidade a custos, chegará nas próximas semanas, completando assim a gama de três modelos.

Veja também: OpenAI trava avanço em Frontier AI após fuga no “sandbox” a 20 de setembro

Salvaguardas e custos do Sonnet 5.5

A Anthropic citou Daniel Vogel, diretor de operações da Epic Games, que referiu que o modelo conseguiu lidar, nos testes iniciais, com “dezenas de milhares de linhas de código” de sistemas de jogabilidade. Segundo Vogel, o desempenho “atingiu o mesmo patamar de qualidade que se esperaria de um modelo de gama superior”.

Dado que as capacidades de cibersegurança do Sonnet 5.5 são comparáveis às do Opus 5, este é o primeiro Sonnet a ser lançado com o conjunto de salvaguardas que a Anthropic reservava para os seus modelos mais potentes. A correção rotineira de bugs permanece inalterada, mas pedidos de cibersegurança de maior risco são automaticamente reencaminhados para o Sonnet 5, de forma visível. Novos classificadores também bloqueiam tentativas de extrair o raciocínio interno do modelo.

Nem todos os testes corroboram, porém, a narrativa de poupança. A empresa de análise Artificial Analysis terá apurado um custo ponderado de 7,60 dólares por tarefa de benchmark, em regime de esforço máximo, contra 5,09 dólares no Sonnet 5 — isto apesar de o índice de desempenho ter subido de 38 para 56.

O lançamento segue‑se à apresentação do Opus 5.5 em 22 de setembro, quando a Anthropic reduziu o preço do modelo bandeira em 20%, para 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. Na altura, a empresa indicou que o Opus 5.5 permitiria reduzir em cerca de 40% o custo típico por carga de trabalho e gerar respostas mais de 30% rápidas face ao Opus 5. No mesmo dia, a OpenAI apresentou os modelos GPT-6 Sol e GPT-6 Luna, com preços equivalentes a metade dos respectivos predecessores.

Leia a seguir: BlackRock prevê que poder computacional vá dar origem a contratos de futuros

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Chefe de Conteúdo na Yellow.com, tendo feito reportagens sobre cripto nos últimos 10 anos. Ele é especializado em artigos aprofundados de Pesquisa e Aprendizado, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o mercado cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para que isso se torne realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Últimas Notícias
Mostrar Todas as Notícias
Claude Sonnet 5.5 chega ao mercado e Anthropic diz que reduz custo por tarefa em até 30% | Yellow