Claude Sonnet 5.5 păstrează tariful, dar schimbă cinci reguli API

Anthropic a lansat Claude Sonnet 5.5 prin anunțul din 28 septembrie 2026, păstrând tariful Sonnet 5: 2 dolari pentru un milion de tokenuri de intrare, 10 dolari pentru un milion de tokenuri de ieșire și 0,20 dolari pentru un milion de tokenuri citite din cache. Compania afirmă că noul model generează răspunsuri cu peste 30% mai rapid și, în testele sale, poate costa cu până la 30% mai puțin pe sarcină. Economia estimată vine din consumul mai mic de tokenuri, nu dintr-o reducere a tarifului pe token.
Pentru aplicațiile construite pe Sonnet 5, schimbarea ID-ului modelului poate fi insuficientă. Documentația tehnică identifică cinci incompatibilități care pot afecta cererile existente, unele cu răspuns HTTP 400, și o schimbare separată care poate face streamingul să pară inactiv între apelurile de instrumente. Modelul este disponibil prin Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry și Claude Platform on AWS, dar compatibilitatea instrumentului de control al computerului diferă între platforme.
Tariful rămâne, factura depinde de consum
Pe Claude API, ID-ul noului model este claude-sonnet-5-5; pe Amazon Bedrock se folosește anthropic.claude-sonnet-5-5. Prețul identic cu cel al predecesorului permite compararea costului unei sarcini fără o schimbare a tarifului de bază. Consumul efectiv depinde însă de cerere și de nivelul de efort ales, astfel că reducerea estimată de Anthropic nu se aplică automat fiecărei integrări.
Analiza eesel AI semnalează că API-ul pornește implicit la nivelul de efort high, iar economiile observate la nivelurile mai mici nu trebuie extrapolate la setarea maximă. Raționamentul consumă tokenuri facturați ca ieșire, ceea ce poate schimba costul chiar dacă textul final are o lungime asemănătoare. O comparație utilă între versiuni privește, prin urmare, întreaga cerere: instrucțiuni, apeluri de instrumente, blocuri de raționament și răspuns final.
Cinci incompatibilități: simptom și remediu
Modificările vizează în special aplicațiile care trimit setări explicite pentru raționament sau instrumente și pe cele care reiau istoricul unei conversații. Un răspuns respins la migrare poate proveni din corpul cererii, dintr-un instrument declarat sau din blocurile de raționament retrimise; aceeași schimbare a modelului nu produce același simptom în toate aplicațiile.
- Raționamentul dezactivat. O cerere care trimite thinking: {"type": "disabled"} este respinsă. Pentru a opri raționamentul de la începutul răspunsului, noua valoare este between_tools, acceptată la nivelurile de efort low, medium și high. La xhigh sau max trebuie folosit raționamentul adaptiv. between_tools nu acceptă câmpuri suplimentare precum display sau budget_tokens, iar bugetele manuale de raționament sunt respinse.
- Apelul forțat al unui instrument. Valorile any și tool pentru tool_choice produc eroare. Varianta acceptată este auto; strict: true poate valida argumentele atunci când instrumentul este apelat. Această validare nu garantează însă apelul: modelul poate răspunde în text. O aplicație care considera obligatoriu un rezultat de la instrument trebuie să poată trata și acest răspuns. Pe Amazon Bedrock, ieșirile structurate care includ strict tool use nu sunt disponibile pentru model.
- Blocurile de raționament reluate. Blocurile produse de Sonnet 5.5 sunt legate de model și de partea anterioară a conversației. Pentru conturile cărora li se aplică implicit verificarea, modificarea instrucțiunilor de sistem, a instrumentelor sau a unui mesaj anterior înainte de retrimiterea blocului poate duce la eroare. Păstrarea istoricului prin adăugarea de mesaje evită nepotrivirea. Dacă istoricul trebuie editat, blocurile afectate se elimină folosind mecanismul prevăzut pentru această situație; un bloc de la un model pe care Sonnet 5.5 nu îl poate citi este, în schimb, eliminat de API fără respingerea cererii.
- Controlul computerului. Pe Claude API și Google Cloud, declarația computer_20251124 este respinsă și trebuie înlocuită cu computer_toolset_20260801. Migrarea schimbă și bucla agentului, care trebuie să gestioneze apelurile membrilor noului set de instrumente și rezultatele lor. Amazon Bedrock acceptă în continuare instrumentul anterior, așa că înlocuirea depinde de platforma pe care rulează integrarea.
- Instrumentul advisor. Când Sonnet 5.5 este executorul, asocierea lui cu Claude Opus 4.8, Claude Opus 4.7 sau Claude Sonnet 5 ca advisor este respinsă. Integrarea are nevoie de un model advisor acceptat de noul executor. Chiar și într-o asociere validă, recomandarea sosește criptată într-un bloc advisor_redacted_result; un client care afișa sau înregistra textul recomandării trebuie să țină cont de noua formă a rezultatului.
De ce un flux activ poate părea blocat
Există și o schimbare care nu respinge cererea. Notele mai lungi scrise de model între apelurile de instrumente pot sosi ca blocuri thinking, în timp ce observațiile scurte rămân blocuri text. Cu setarea implicită de afișare, textul blocurilor de progres este gol. O interfață care transmite utilizatorului doar aceste mesaje poate arăta o pauză, deși instrumentele continuă să lucreze.
Cu raționament adaptiv, integrarea poate cere afișarea actualizărilor printr-o valoare display potrivită; pentru actualizările separate este necesar antetul beta corespunzător. Cu between_tools, textul de progres revine fără acel câmp. Aplicația trebuie totodată să citească blocurile după tip și să le păstreze la retrimiterea conversației, inclusiv când textul vizibil este gol. Altfel, o migrare care a eliminat erorile din cerere poate lăsa utilizatorul fără semnalul că operațiunea avansează.
Citește și:
Abonează-te la newsletter
Primește cele mai noi știri despre Web3, IA și cripto direct în inbox.