Anthropic släppte Claude Sonnet 5.5 den 28 september till samma pris som Sonnet 5. Företaget säger att modellen är över 30 % snabbare och kostar upp till 30 % mindre per uppgift.
Ett oberoende testföretag kom fram till en annan slutsats om kostnaden när de pressade modellen till dess gräns.
Följ oss på X för att få de senaste nyheterna direkt
Anthropics andra 5.5-modell lanseras dagar efter Opus
Sonnet 5.5 är den andra modellen i Claude 5.5-familjen. Anthropic lanserade Opus 5.5 den 22 september. Samma dag släppte OpenAI också GPT-6 Sol och Luna.
Den nya modellen behåller Sonnet 5:s priser: 2 USD per en miljon input-tokens och 10 USD per en miljon output-tokens. Anthropic rapporterade 70,6 % på Terminal-Bench 4.0, ett kodningstest. Sonnet 5 fick bara 10,3 %, medan Opus 5.5 nådde 66,4 %.
”Opus 5.5 är byggd för avancerat arbete och bedömningar, men Sonnet 5.5 fungerar bäst med tydliga vardagsuppgifter, rättar fel och skapar proffsiga dokument, presentationer och kalkylblad”, säger teamet.
Anthropic säger att Sonnet 5.5 inte utökar modellens kapacitet. Därför har de granskat risker som att vilseleda användare eller bidra till missbruk i viktiga situationer.
Sonnet 5.5 kommer också med cybersäkerhetsskydd och antikloningsklassificeringar. De blockerar försök att ta ut modellens resonemang för att träna konkurrenter. Claude Haiku 5.5 släpps de kommande veckorna.
Samtidigt stoppade OpenAI en kommande modell, GPT-6.1 Astra, av säkerhetsskäl. CNBC bekräftade på måndagen att modellen inte klarade företagets standarder.
Artificial Analysis hittar högre tokenkostnad vid maxinsats
Artificial Analysis, testföretaget som placerade Grok 4.7 på fjärde plats, gav Sonnet 5.5 en 56:a på sin Intelligence Index. Det innebär en andraplats, 2 poäng bakom Opus 5.5 vid maxinsats.
Företaget noterade 64 % för Sonnet 5.5 på Terminal-Bench 4.0, jämfört med 60 % för Opus 5.5 och GPT-6 Astra. På tester om kunskapsarbete som GDPval-AA låg Sonnet 5.5 ungefär jämsides med Opus 5.5.
Företaget säger att Sonnet 5.5 använde betydligt fler tokens för att nå de resultaten.
”Vid maxinsats, när Sonnet 5.5 nästan når Opus 5.5:s prestanda, använde Claude Sonnet 5.5 ungefär 193 000 output-tokens per uppgift i Intelligence Index,” står det i inlägget.
Den mängden ligger cirka 60 % över Opus 5.5 och Sonnet 5 vid maxinsats. Det är också ungefär 7 gånger så mycket som GPT-6 Astra vid maxinsats.
Kunder med tidig tillgång sade det motsatta om Sonnet 5.5 jämfört med Sonnet 5, men för andra typer av arbete. Balyasny Asset Management såg betydligt lägre tokenanvändning i sina finanstester.
”I vårt privata test med 2 441 finanstester för frågor och svar, extrahering, analys och prognoser, fick Claude Sonnet 5.5 bättre resultat än Sonnet 5 och använde omkring 121 000 tokens per svar, medan Sonnet 5 använde 497 000,” säger Joe Poirier, Senior AI Engineer hos Balyasny Asset Management.
Artificial Analysis testade en förhandsversion med ett fel i strukturerad output, som Anthropic nu har rättat. Företaget planerar att testa igen snart.
Prenumerera på vår YouTube-kanal för att se ledare och reportrar ge expertinsikter









