Anthropic a lancé lundi Claude Sonnet 5.5, affirmant que ce nouveau modèle d’IA « mid‑tier » s’exécute plus de 30 % plus rapidement et peut réduire le coût des tâches jusqu’à 30 % par rapport à son prédécesseur.
Points clés :
- Sonnet 5.5 obtient 70,6 % au test de code Terminal-Bench 4.0, contre 10,3 % pour Sonnet 5.
- C’est le premier modèle Sonnet lancé avec les garde‑fous cyber réservés jusqu’ici aux systèmes les plus avancés d’Anthropic.
- Un benchmark indépendant indique toutefois qu’à charge maximale, il coûterait plus cher par tâche que Sonnet 5.
Les performances de Claude Sonnet 5.5
Ce modèle est le deuxième de la famille Claude 5.5 et arrive six jours après le vaisseau amiral Claude Opus 5.5, a indiqué la société dans son annonce de lancement ici.
Anthropic le positionne comme un complément plus rapide et plus abordable qu’Opus 5.5, conçu pour les tâches quotidiennes bien cadrées, la correction de bugs et la production de documents, présentations et feuilles de calcul soignés. Son tarif est fixé à 2 dollars par million de tokens en entrée et 10 dollars par million de tokens en sortie.
Sur Terminal-Bench 4.0, un test de programmation agentique, Sonnet 5.5 affiche un score de 70,6 %, contre 10,3 % pour Sonnet 5 et 66,4 % pour le plus onéreux Opus 5.5. Il est aussi devenu le premier modèle Sonnet à terminer Pokémon Red en ne voyant que des captures d’écran, un test de planification de long terme et de compréhension d’images.
Le modèle tourne désormais sur toutes les plateformes Anthropic, dont Amazon Web Services, Google Cloud et Microsoft Azure. Anthropic précise que le plus petit Claude Haiku 5.5, destiné aux usages à très fort volume et très sensibles aux coûts, sera lancé dans les prochaines semaines, complétant ainsi la gamme de trois modèles.
À lire aussi : OpenAI freine sur l’IA de pointe après l’évasion de son bac à sable du 20 septembre
Garde‑fous et structure de coûts de Sonnet 5.5
Anthropic cite Daniel Vogel, directeur des opérations d’Epic Games, selon qui le modèle a géré des dizaines de milliers de lignes de code de systèmes de gameplay lors des premiers tests. Vogel estime qu’il « atteint le même niveau de qualité qu’on attendrait d’un modèle de gamme supérieure ».
Ses capacités cyber étant jugées comparables à celles d’Opus 5, Sonnet 5.5 devient le premier Sonnet lancé avec les garde‑fous qu’Anthropic réservait jusqu’ici à ses modèles les plus puissants. La correction de bugs courante n’est pas impactée, mais les requêtes cyber jugées plus risquées basculent de façon visible vers Sonnet 5. De nouveaux classifieurs bloquent également les tentatives visant à extraire ses chaînes de raisonnement.
Tous les tests ne corroborent pas la promesse de réduction des coûts. Artificial Analysis aurait mesuré un coût pondéré de 7,60 dollars par tâche de benchmark à effort maximal, contre 5,09 dollars pour Sonnet 5, alors même que l’indice de performance du nouveau modèle grimpe de 38 à 56.
Ce lancement intervient dans le sillage de l’arrivée d’Opus 5.5, dévoilé le 22 septembre, lorsque Anthropic a réduit de 20 % le prix de son modèle phare, à 4 dollars par million de tokens en entrée et 20 dollars par million en sortie. La société indiquait alors qu’Opus 5.5 coûterait environ 40 % de moins qu’Opus 5 sur des charges de travail types, tout en générant des réponses plus de 30 % plus rapides. OpenAI a, le même jour, dévoilé GPT-6 Sol et GPT-6 Luna, facturés à la moitié du prix de leurs prédécesseurs.
À suivre : BlackRock estime que la puissance de calcul se dirige vers les marchés à terme

