Claude Opus 5.5 kushton më pak, por arsyetimi nuk çaktivizohet

Anthropic, në faqen zyrtare të modelit, e shënon Claude Opus 5.5 si aktiv që prej 22 shtatorit 2026, me çmim 4 dollarë për një milion tokenë hyrës dhe 20 dollarë për një milion tokenë dalës. Modeli ofrohet në Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud dhe Microsoft Foundry. Arsyetimi adaptiv qëndron aktiv në çdo kërkesë; zhvilluesit mund të ndryshojnë nivelin e përpjekjes, por nuk mund ta fikin.
Në matjen e Artificial Analysis, Claude Opus 5.5 arriti 58 pikë në Intelligence Index me përpjekje maksimale. Matja tregon edhe dallimin mes tarifës dhe kostos së punës: në atë konfigurim modeli përdori rreth 119 mijë tokenë dalës për detyrë, kundrejt rreth 73 mijë për Opus 5, ndërsa kostoja për detyrë mbeti afërsisht në të njëjtin nivel. Për aplikacionet ekzistuese, përfitimi nga tarifa më e ulët duhet parë bashkë me këtë konsum dhe me ndryshimet në kërkesat API.
Ulja e tarifës dhe kostoja e një detyre
Dokumentacioni i migrimit i Anthropic jep tarifat e Opus 5.5 prej 4 dollarësh për hyrjen dhe 20 dollarësh për daljen për një milion tokenë, kundrejt 5 dhe 25 dollarëve për Opus 5. Kjo është ulje prej 20% në secilën tarifë bazë. Nëse një aplikacion dërgon dhe merr saktësisht të njëjtat sasi tokenësh pas migrimit, ajo pjesë e faturës ulet në të njëjtën masë.
Sasia e tokenëve, megjithatë, nuk është domosdoshmërisht e njëjtë. Opus 5.5 vendos sa arsyetim t’i kushtojë kërkesës brenda nivelit të zgjedhur të përpjekjes, dhe tokenët e arsyetimit llogariten si dalje edhe kur teksti i tyre nuk shfaqet në aplikacion. Një rrjedhë që në Opus 5 e kishte arsyetimin të fikur mund të marrë më shumë tokenë dalës pas kalimit, pavarësisht tarifës më të ulët për token. Parametri effort ndryshon thellësinë e arsyetimit, vonesën dhe koston; ai nuk është çelës fikjeje.
Niveli i parazgjedhur i përpjekjes në Opus 5.5 është medium, ndërsa te Opus 5 ishte high. Kjo do të thotë se edhe një kërkesë pa parametër të shprehur për përpjekjen ndryshon sjellje gjatë migrimit. Në nivel të njëjtë, modeli i ri priret të përdorë më shumë arsyetim për çdo kthesë bisede, veçanërisht në nivelet më të larta. Për këtë arsye, një krahasim i faturave kërkon të shihet si niveli i përpjekjes, ashtu edhe numri i tokenëve që prodhon puna konkrete.
Çfarë mat performanca e pavarur
Rezultati i Artificial Analysis i përket Opus 5.5 me arsyetim adaptiv, përpjekje maksimale dhe mekanizmin e parazgjedhur të zëvendësimit të modelit gjatë testit. Ai përshkruan atë konfigurim në grupin e provave të indeksit, jo cilësinë e garantuar të çdo kërkese API. Matja nxjerr në pah një aftësi të lartë në detyrat e testuara, por edhe më shumë tokenë daljeje për detyrë se te Opus 5 i testuar në nivel maksimal.
Kjo shpjegon pse dy pohime për çmimin mund të jenë njëkohësisht të sakta: tarifa për token ka rënë, ndërsa kostoja për detyrë në provën maksimale të Artificial Analysis ka mbetur afërsisht e njëjtë. Janë metrika të ndryshme, me sasi të ndryshme tokenësh në emërues. Për një aplikacion në Shqipëri ose Kosovë, rezultati i indeksit tregon çfarë arriti konfigurimi i matur; fatura e aplikacionit do të varet nga kërkesat e tij, niveli i përpjekjes dhe përdorimi i mjeteve.
Katër ndryshimet që mund të prishin integrimet
Kalimi te identifikuesi claude-opus-5-5 mund të kërkojë më shumë sesa ndryshimin e emrit të modelit. Dokumentacioni rendit katër ndryshime të papajtueshme për kodin që punon me Opus 5. Disa kthejnë gabim në kërkesë; të tjera ndikojnë mënyrën si vazhdon një bisedë kur aplikacioni ndërron modelin ose ripërdor historikun.
- Arsyetimi nuk çaktivizohet. Kërkesat me thinking: {"type": "disabled"} ose me buxhet manual budget_tokens refuzohen. Integrimi duhet të heqë atë cilësim ose të përdorë arsyetimin adaptiv, ndërsa thellësinë ta kontrollojë me effort. Kufiri max_tokens duhet të lërë hapësirë si për arsyetimin, ashtu edhe për përgjigjen e dukshme; një kufi i vendosur për një model pa arsyetim mund ta shkurtojë përgjigjen.
- Thirrja e detyruar e mjetit refuzohet. Vlerat any dhe tool të parametrin tool_choice kthejnë gabim. Vlerat auto dhe none mbështeten. Për rrjedhat që kërkojnë dalje sipas një skeme, dokumentacioni propozon përdorimin e mjeteve me rregulla të rrepta ose të daljeve të strukturuara; kjo nuk ruan premtimin se një mjet i caktuar do të thirret detyrimisht në të njëjtin hap.
- Blloqet e arsyetimit varen nga modeli dhe historiku. Opus 5.5 mund të lexojë blloqe nga Opus 5 dhe disa modele më të hershme, por një kalim nga Opus 5.5 te shumica e modeleve të tjera nuk e ruan atë arsyetim për kthesat pasuese. Nëse kodi ndryshon udhëzimet, mjetet ose një mesazh më të hershëm para se të ridërgojë një bllok arsyetimi, disa llogari marrin gabim. Rrjedhat me mjete duhet t’i kthejnë blloqet e marra të pandryshuara dhe ta trajtojnë historikun e bisedës me kujdes.
- Mjeti i vjetër i përdorimit të kompjuterit ka kufi platforme. Në Claude API dhe Google Cloud, tipi computer_20251124 refuzohet dhe duhet kaluar te computer_toolset_20260801, bashkë me përshtatjen e ciklit që përpunon veprimet e mjetit. Në Amazon Bedrock, tipi i mëparshëm vazhdon të punojë me Opus 5.5. Ndikimi i këtij ndryshimi varet, pra, nga platforma ku ekzekutohet integrimi.
Një ndryshim tjetër mund të kalojë pa gabim, por të jetë i dukshëm për përdoruesin. Mesazhet e shkurtra mes thirrjeve të mjeteve kthehen në blloqe thinking, jo në blloqe të zakonshme teksti; me cilësimin e parazgjedhur për shfaqjen, përmbajtja e tyre tekstuale është bosh. Një aplikacion që i shfaqte këto mesazhe si përditësime të punës mund të heshtë mes veprimeve edhe kur puna vazhdon. Kjo pasojë prek ndërfaqen, ndërsa ndryshimet e tjera mund të ndalojnë vetë kërkesën ose vazhdimin e bisedës.
Abonohuni në buletinin tonë
Merrni lajmet më të fundit për Web3, AI dhe kripto direkt në kutinë tuaj postare.