Claude Haiku 5.5 taie prețul cu 90%, dar pragul de 100.000 de tokeni contează

|Autor: Echipa editorială QUASA|5 min de citit
Claude Haiku 5.5 taie prețul cu 90%, dar pragul de 100.000 de tokeni contează

În anunțul din 7 octombrie 2026, Anthropic a lansat Claude Haiku 5.5 cu tarife per token cu 90% mai mici decât la Haiku 4.5 pentru prompturi de cel mult 100.000 de tokeni; Alex Wang, de la Rogo, descrie utilizarea vizată astfel: „The short and high-volume work is where Claude Haiku 5.5 fits for us”. Pentru aceste cereri, un milion de tokeni de intrare costă 0,10 USD, iar un milion de tokeni de ieșire costă 0,50 USD, față de 1 USD și, respectiv, 5 USD la modelul precedent.

În testele MultiAI publicate tot pe 7 octombrie, 170 de rulări au inclus sarcini scurte și căutări în documente lungi. La efort Medium, noul model a rezolvat 24 din 24 de încercări din setul de sarcini cotidiene, cu un cost API estimat de 0,30 USD pentru 1.000 de răspunsuri similare. Același document a produs aproximativ 30% mai mulți tokeni cu Haiku 5.5, diferență capabilă să mute un prompt dintr-o categorie de preț în alta.

De unde începe tariful superior

Fișa Claude Platform indică pentru prompturile de peste 100.000 de tokeni 0,50 USD la intrare și 2,50 USD la ieșire pentru fiecare milion de tokeni. Asta înseamnă de cinci ori tariful aplicat cererilor mai scurte, însă jumătate din tariful per token al Haiku 4.5. Pragul se stabilește după lungimea promptului, iar odată depășit, categoria superioară se aplică întregii cereri, inclusiv tokenilor de ieșire, nu doar porțiunii care trece de limită.

Promptul poate include mai mult decât documentul vizibil utilizatorului: instrucțiuni, mesaje anterioare și conținut introdus automat de aplicație. Într-o conversație păstrată între apeluri, același tip de întrebare poate ajunge în categoria superioară după acumularea contextului. Un text numărat sub limită cu vechiul model poate depăși pragul când este numărat de tokenizerul nou, astfel că prețul afișat per milion de tokeni nu este suficient pentru a prevedea factura unui flux existent.

Performanța măsurată depinde de efort

Setul de probe a cuprins clasificarea tichetelor de asistență, extragerea unor date din note și alte sarcini cu răspuns verificabil. Haiku 4.5 a ajuns la 24 de răspunsuri corecte din 24 numai cu raționamentul activat; fără el, a avut 17 din 24. La Haiku 5.5, efortul Medium a dat 24 din 24, iar setarea Off a dat 22 din 24. Aceasta este o comparație pe sarcinile și configurațiile publicate, nu o rată generală de acuratețe pentru orice aplicație.

Schimbarea setării a modificat și timpul, și costul: în aceste teste, răspunsul complet al Haiku 5.5 a durat în medie 3,5 secunde la Medium și 1,9 secunde la Off. Costul estimat pentru 1.000 de răspunsuri a fost 0,30 USD la Medium și 0,22 USD la Off. Reducerea prețului per token nu fixează așadar costul unui răspuns: volumul de ieșire și nivelul de efort ales rămân variabile ale comparației.

Trei calcule pentru un flux API

Următoarele exemple sunt ipotetice, la tarife standard, fără cache, loturi sau reîncercări. Pentru fiecare cerere, costul tokenilor de intrare se adună cu cel al tokenilor de ieșire; valorile de mai jos arată totalul pentru 1.000 de cereri. Comparațiile care păstrează același număr de tokeni la ambele modele izolează efectul tarifului, fără a reprezenta o măsurătoare a modului în care fiecare tokenizer ar împărți textul real.

Clasificare scurtă. Dacă o cerere are 1.000 de tokeni de intrare și 50 de ieșire, 1.000 de clasificări costă 0,125 USD cu Haiku 5.5 și 1,25 USD cu Haiku 4.5. Toate prompturile rămân sub prag, iar cele două modele sunt comparate la aceleași cantități facturate. În această ipoteză, reducerea de 90% a tarifului per token devine și o reducere de 90% a costului total.

Rezumat. Pentru 20.000 de tokeni de intrare și 500 de ieșire pe cerere, 1.000 de rezumate ajung la 2,25 USD cu Haiku 5.5, față de 22,50 USD cu Haiku 4.5, dacă numărul de tokeni rămâne identic. O creștere a numărului de tokeni facturați pentru același text ar ridica suma noului model. Procentul observat la documentul testat este o măsurătoare a acelui document, nu o corecție universală care poate fi adăugată fiecărui rezumat.

Document lung. Presupunem un prompt de 80.000 de tokeni cu Haiku 4.5 care devine, în mod ipotetic, 104.000 cu Haiku 5.5, folosind ca scenariu creșterea de 30% observată la compararea documentului. Cu încă 500 de tokeni de ieșire pe cerere, 1.000 de cereri ar costa 82,50 USD cu modelul vechi și 53,25 USD cu cel nou. Economia scade la aproximativ 35%, fiindcă promptul nou trece pragul și toți tokenii săi intră la tariful superior. Acesta este efectul combinat al schimbării numărului de tokeni și al categoriei de tarifare, în condițiile declarate ale exemplului.

Disponibilitatea și costul unei migrări

Haiku 5.5 este disponibil prin Claude API cu identificatorul claude-haiku-5-5 și prin Amazon Bedrock, Google Cloud, Microsoft Foundry și Claude Platform on AWS. Are o fereastră de context de un milion de tokeni și acceptă reglarea efortului; capacitatea de a primi un prompt lung nu implică menținerea tarifului mic până la acea limită. Aceste detalii contează pentru echipele care vor să păstreze aceleași sarcini, dar să schimbe modelul folosit în spatele aplicației.

Pentru un flux cu multe solicitări scurte, diferența de tarif poate avea efect imediat asupra costului per cerere. Pentru unul cu istoric extins sau documente lungi, factura depinde de câte prompturi trec efectiv de 100.000 de tokeni după noua tokenizare și de câți tokeni generează fiecare răspuns. O medie a lungimii prompturilor poate ascunde tocmai grupul de cereri care ajunge în categoria de preț mai mare.

Citește și:

Distribuie:

Abonează-te la newsletter

Primește cele mai noi știri despre Web3, IA și cripto direct în inbox.

0