Anthropic heeft maandag Claude Sonnet 5.5 gelanceerd. Volgens het bedrijf is het nieuwe midrange AI-model meer dan 30% sneller en tot 30% goedkoper per taak dan zijn voorganger.
Belangrijkste punten:
- Sonnet 5.5 scoorde 70,6% op de Terminal-Bench 4.0-codingtest, tegen 10,3% voor Sonnet 5.
- Het is het eerste Sonnet-model dat wordt gelanceerd met cyberveiligheidsmaatregelen die eerder waren voorbehouden aan Anthropic's topmodellen.
- Eén onafhankelijke benchmark concludeerde juist dat het model bij maximale inzet duurder per taak is dan Sonnet 5.
Benchmarks Claude Sonnet 5.5
Het model is het tweede in de Claude 5.5-serie en verscheen zes dagen na vlaggenschip Claude Opus 5.5, meldde het bedrijf in zijn aankondiging.
Anthropic positioneert Sonnet 5.5 als een sneller en goedkoper alternatief naast Opus 5.5, gericht op duidelijk afgebakende dagelijkse taken, bugfixes en het produceren van verzorgde documenten, presentaties en spreadsheets. Het tarief ligt op $2 per miljoen inputtokens en $10 per miljoen outputtokens.
In Terminal-Bench 4.0, een agentische codingbenchmark, scoorde Sonnet 5.5 een resultaat van 70,6%, tegenover 10,3% voor Sonnet 5 en 66,4% voor de duurdere Opus 5.5. Het model werd ook het eerste Sonnet-model dat Pokémon Red uitspeelde op basis van alleen screenshots – een test voor langlopende taken en beeldbegrip.
Sonnet 5.5 draait nu op alle Anthropic-platforms, waaronder Amazon Web Services, Google Cloud en Microsoft Azure. Anthropic kondigde aan dat het kleinere Claude Haiku 5.5, bedoeld voor grote volumes en sterk prijsgevoelige toepassingen, de komende weken volgt. Daarmee zou de driedelige modellenreeks compleet zijn.
Ook interessant: OpenAI trapt op de rem bij Frontier AI na sandbox-incident op 20 september
Beveiliging en kosten van Sonnet 5.5
Anthropic verwees naar uitspraken van Daniel Vogel, chief operating officer bij Epic Games, die stelde dat het model in vroege tests tienduizenden regels code voor gameplay-systemen aankon. Volgens Vogel haalde het model “hetzelfde kwaliteitsniveau dat je van een hoger segment zou verwachten”.
Omdat de cybercapaciteiten vergelijkbaar zijn met die van Opus 5, is Sonnet 5.5 het eerste Sonnet-model dat wordt uitgerold met beveiligingen die Anthropic eerder alleen toepaste op zijn krachtigste systemen. Gewone bugfixing blijft ongemoeid, maar risicovollere cyberverzoeken worden zichtbaar teruggeschaald naar Sonnet 5. Nieuwe classifiers blokkeren bovendien pogingen om de onderliggende redeneerketen van het model bloot te leggen.
Niet alle metingen ondersteunen de kostenclaim. Artificial Analysis mat naar verluidt een gewogen kostprijs van $7,60 per benchmarktaak bij maximale inzet, tegenover $5,09 voor Sonnet 5, terwijl de indexscore van het nieuwe model steeg naar 56, van 38.
De introductie volgt op de lancering van Opus 5.5 op 22 september, toen Anthropic de prijzen voor zijn vlaggenschip met 20% verlaagde naar $4 per miljoen inputtokens en $20 per miljoen outputtokens. Het bedrijf stelde toen dat Opus 5.5 bij typische workloads circa 40% goedkoper zou zijn dan Opus 5, en meer dan 30% sneller output zou genereren. OpenAI bracht diezelfde dag GPT-6 Sol en GPT-6 Luna uit, elk geprijsd op de helft van hun respectieve voorgangers.
Lees ook: BlackRock: rekenkracht op weg naar de termijnmarkten

