Claude Sonnet 5.5 närmar sig Opus – till halva tokenpriset

|Författare: QUASA:s redaktion|5 min läsning
Claude Sonnet 5.5 närmar sig Opus – till halva tokenpriset

Anthropic lanserade Claude Sonnet 5.5 den 28 september 2026 med API-priser på 2 dollar per miljon indatatoken och 10 dollar per miljon utdatatoken, hälften av Opus 5.5:s 4 respektive 20 dollar, enligt bolagets lanseringsbesked. För en arbetsuppgift som båda modellerna löser med samma mängd token halveras därmed listkostnaden. Priset per färdigt resultat beror också på hur länge modellen arbetar och om svaret behöver göras om.

I Tom’s Guides genomgång redovisas 1 844 poäng för Sonnet 5.5 och 1 846 för Opus 5.5 i GDPval-AA, ett test av yrkesuppgifter. Det gör Sonnet till ett intressant billigare alternativ för tydligt avgränsat arbete. För öppna, komplexa projekt som kräver återkommande bedömningar beskriver Anthropic fortfarande Opus som den starkare modellen.

Nästan samma poäng gäller ett bestämt arbetsprov

GDPval-AA prövar arbete från olika yrken och ger därmed en mer relevant jämförelse för många kontorsuppgifter än ett prov med fristående faktafrågor. Sonnet och Opus ligger nära varandra i det redovisade totalresultatet, men poängen säger inte att de gör samma bedömningar i varje enskild uppgift. Ett dokument med givna ramar kan vara lätt att utvärdera, medan ett projekt med motstridiga mål kräver beslut som påverkar senare steg.

Den skillnaden märks också mellan olika slags kodarbete. En specificerad rättning har ett tydligare slutläge än en förändring som berör flera delar av en kodbas och kräver val mellan möjliga lösningar. I lanseringsjämförelsen ligger Opus före i vissa kodprov, medan Sonnet har ett starkare resultat i ett annat. Ett nästan lika högt värde för yrkesuppgifter bör därför läsas som ett resultat för just den testuppsättningen.

Hur mycket arbete modellen får lägga på ett svar påverkar dessutom både resultat och kostnad. Vid högre ansträngningsnivå kan den resonera längre och förbruka fler token. Halva priset per token innebär alltså inte automatiskt halva kostnaden för två körningar med olika inställningar eller olika långa svar.

Vals mätte kostnad per test – med en viktig metoddetalj

En separat utvärdering ger ett mått på faktisk testkostnad. I Vals AI:s daterade resultat från den 28 september fick Sonnet 5.5 69,22 procent i Vals Index till 20,80 dollar per test, jämfört med 69,69 procent och 32,77 dollar för Opus 5.5. Resultatskillnaden var liten även där, men kostnaden per test var inte halverad. Vals Index mäter en annan uppsättning uppgifter än GDPval-AA, så de två poängskalorna kan inte läggas ihop.

Vals körde Sonnet 5.5 med Sonnet 5 som reservmodell på serversidan när den nya modellen avböjde vissa uppgifter. Det publicerade indexresultatet gäller därför den konfigurationen, inte en körning där Sonnet 5.5 ensam besvarade allt. När uppgifter som klarades med reservmodellen i stället räknades som misslyckade sjönk resultatet något. För den som vill veta om en modell kan slutföra en uppgift utan reservlösning är den metodskillnaden väsentlig.

Den löpande indextabellen på samma sida visar nu ett annat modellurval än den daterade lanseringsnotisen. Placering och procenttal från dessa två urval beskriver därför inte samma jämförelse. Det daterade resultatet är användbart som en separat mätning vid lanseringen, medan skillnader mellan uppgiftstyperna förklarar varför ett enda sammanlagt tal inte kan avgöra modellvalet.

Tre fasta arbetslaster visar listpriset i praktiken

Med lika många in- och utdatatoken kostar Sonnet hälften så mycket som Opus enligt de publicerade API-priserna. Följande är hypotetiska arbetslaster med fast tokenmängd, inte uppmätta körningar. Beloppen avser vanlig in- och utdata; cache, verktygsanrop och eventuella omförsök ingår inte.

  • En dokumentsammanfattning med 30 000 indatatoken och 2 000 utdatatoken kostar 0,08 dollar med Sonnet och 0,16 dollar med Opus. Här står materialet som läses för större delen av kostnaden.
  • En avgränsad kodändring med 120 000 indatatoken och 12 000 utdatatoken kostar 0,36 dollar med Sonnet och 0,72 dollar med Opus. Exemplet förutsätter att båda modellerna får samma kod och lämnar lika långa svar.
  • Ett presentationsutkast med 15 000 indatatoken och 4 000 utdatatoken kostar 0,07 dollar med Sonnet och 0,14 dollar med Opus. Utdatan står här för en större andel av kostnaden än i dokumentsammanfattningen.

Varje belopp är summan av antalet indatatoken gånger priset för indata och antalet utdatatoken gånger priset för utdata. De fasta mängderna gör listpriserna jämförbara, men verkliga svar kan bli olika långa. Ett längre svar kan öka kostnaden utan att förbättra resultatet; ett kortare svar kan minska den, förutsatt att uppgiften ändå blir slutförd.

Det finns också en skillnad mellan pris per försök och pris per godkänt resultat. Om ett första svar behöver rättas måste kostnaden för rättningen räknas in. En modell som använder fler token men oftare klarar uppgiften direkt kan därför vara billigare i ett visst arbetsflöde än dess tokenpris antyder. De tre exemplen visar vad samma förbrukning kostar, inte hur ofta respektive modell lyckas.

Opus behåller sin roll när uppgiften är öppen

Sonnet 5.5 har den tydligaste prisfördelen när arbetet kan avgränsas i förväg och resultatet går att bedöma direkt, exempelvis en specificerad kodrättning eller ett utkast utifrån ett bestämt underlag. Där är den lilla skillnaden i det redovisade arbetsprovet relevant. Om uppgiften i stället kräver att modellen tolkar oklara mål, väger alternativ och håller ihop besluten över många steg blir leverantörens bedömning av Opus mer betydelsefull.

Det avgörande måttet för en återkommande arbetslast är kostnaden per godkänt slutresultat med samma kvalitetskrav. Listpriset anger vad varje token kostar; de publicerade proven ger indikationer om förmåga under sina respektive testvillkor. Hur många försök en verklig uppgift kräver kan däremot ändra vilken modell som blir billigast i slutänden.

Läs också:

Dela:

Prenumerera på vårt nyhetsbrev

Få de senaste nyheterna om Web3, AI och krypto direkt i din inkorg.

0