Claude Sonnet 5.5 arrive, Anthropic promet une baisse du coût des tâches pouvant aller jusqu’à 30 %

Anthropic's Claude Sonnet 5.5 mid-tier model delivers over 30% faster output and lower task costs, with one benchmark questioning savings (Image: Shutterstock)
Anthropic's Claude Sonnet 5.5 mid-tier model delivers over 30% faster output and lower task costs, with one benchmark questioning savings (Image: Shutterstock)

Anthropic a lancé lundi Claude Sonnet 5.5, affirmant que ce nouveau modèle d’IA « mid‑tier » s’exécute plus de 30 % plus rapidement et peut réduire le coût des tâches jusqu’à 30 % par rapport à son prédécesseur.

Points clés :

  • Sonnet 5.5 obtient 70,6 % au test de code Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5.
  • C’est le premier modèle Sonnet lancé avec les garde‑fous cyber réservés jusqu’ici aux systèmes les plus avancés d’Anthropic.
  • Un benchmark indépendant indique toutefois qu’à charge maximale, il coûterait plus cher par tâche que Sonnet 5.

Les performances de Claude Sonnet 5.5

Ce modèle est le deuxième de la famille Claude 5.5 et arrive six jours après le vaisseau amiral Claude Opus 5.5, a indiqué la société dans son annonce de lancement ici.

Anthropic le positionne comme un complément plus rapide et plus abordable qu’Opus 5.5, conçu pour les tâches quotidiennes bien cadrées, la correction de bugs et la production de documents, présentations et feuilles de calcul soignés. Son tarif est fixé à 2 dollars par million de tokens en entrée et 10 dollars par million de tokens en sortie.

Sur Terminal-Bench 4.0, un test de programmation agentique, Sonnet 5.5 affiche un score de 70,6 %, contre 10,3 % pour Sonnet 5 et 66,4 % pour le plus onéreux Opus 5.5. Il est aussi devenu le premier modèle Sonnet à terminer Pokémon Red en ne voyant que des captures d’écran, un test de planification de long terme et de compréhension d’images.

Le modèle tourne désormais sur toutes les plateformes Anthropic, dont Amazon Web Services, Google Cloud et Microsoft Azure. Anthropic précise que le plus petit Claude Haiku 5.5, destiné aux usages à très fort volume et très sensibles aux coûts, sera lancé dans les prochaines semaines, complétant ainsi la gamme de trois modèles.

À lire aussi : OpenAI freine sur l’IA de pointe après l’évasion de son bac à sable du 20 septembre

Garde‑fous et structure de coûts de Sonnet 5.5

Anthropic cite Daniel Vogel, directeur des opérations d’Epic Games, selon qui le modèle a géré des dizaines de milliers de lignes de code de systèmes de gameplay lors des premiers tests. Vogel estime qu’il « atteint le même niveau de qualité qu’on attendrait d’un modèle de gamme supérieure ».

Ses capacités cyber étant jugées comparables à celles d’Opus 5, Sonnet 5.5 devient le premier Sonnet lancé avec les garde‑fous qu’Anthropic réservait jusqu’ici à ses modèles les plus puissants. La correction de bugs courante n’est pas impactée, mais les requêtes cyber jugées plus risquées basculent de façon visible vers Sonnet 5. De nouveaux classifieurs bloquent également les tentatives visant à extraire ses chaînes de raisonnement.

Tous les tests ne corroborent pas la promesse de réduction des coûts. Artificial Analysis aurait mesuré un coût pondéré de 7,60 dollars par tâche de benchmark à effort maximal, contre 5,09 dollars pour Sonnet 5, alors même que l’indice de performance du nouveau modèle grimpe de 38 à 56.

Ce lancement intervient dans le sillage de l’arrivée d’Opus 5.5, dévoilé le 22 septembre, lorsque Anthropic a réduit de 20 % le prix de son modèle phare, à 4 dollars par million de tokens en entrée et 20 dollars par million en sortie. La société indiquait alors qu’Opus 5.5 coûterait environ 40 % de moins qu’Opus 5 sur des charges de travail types, tout en générant des réponses plus de 30 % plus rapides. OpenAI a, le même jour, dévoilé GPT-6 Sol et GPT-6 Luna, facturés à la moitié du prix de leurs prédécesseurs.

À suivre : BlackRock estime que la puissance de calcul se dirige vers les marchés à terme

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com et couvre l’actualité crypto depuis dix ans. Il est spécialisé dans les analyses approfondies et les articles pédagogiques, avec un accent sur les reportages analytiques, le contexte sectoriel et les grandes forces qui façonnent la crypto, de l’ère de l’IA et des technologies de sécurité à l’innovation fintech. Il est convaincu que tout ce qui est numérique dépassera bientôt tout ce qui est analogique et travaille dur pour que cela devienne réalité.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.
Dernières nouvelles
Voir toutes les nouvelles
Claude Sonnet 5.5 arrive, Anthropic promet une baisse du coût des tâches pouvant aller jusqu’à 30 % | Yellow