Claude Opus 5.5 сваля цената на сложната AI работа с 40%

|Автор: Редакционният екип на QUASA|5 мин. четене| 1
Claude Opus 5.5 сваля цената на сложната AI работа с 40%

Anthropic пусна Claude Opus 5.5 на 22 септември 2026 г. и оценява разхода за типична задача като с 40% по-нисък спрямо Opus 5. Това е резултат от тестовете на компанията при стандартните настройки на моделите, а не обещана отстъпка за всяка заявка.

Публикуваните тарифи на Anthropic са 4 долара за милион входни и 20 долара за милион изходни токени при Opus 5.5 срещу съответно 5 и 25 долара при Opus 5. Това е намаление с 20% при еднакъв обем токени. Четенето от кеш струва 0,20 вместо 0,50 долара за милион токени. Моделът е достъпен през Claude Platform и за потребителите на платените планове Pro, Max, Team и Enterprise.

Защо 40% не са намалението в тарифата

Цената на токен и цената на завършена задача измерват различни неща. Първата се вижда в тарифата, преди моделът да започне работа. Втората зависи от използваните входни и изходни токени, броя опити и това дали част от контекста се чете повторно от кеш. Според Anthropic Opus 5.5 използва по-малко токени за типична задача; заедно с по-ниската тарифа това води до оценката за 40% икономия.

Разликата има значение най-вече при продължителна работа по код, когато AI инструментът разглежда файлове, прави промени и проверява резултата на няколко стъпки. Ако новият модел стигне до същия резултат с по-малко стъпки, екипът плаща за по-малък обем работа на по-ниска цена за токен. При кратка заявка с еднакъв вход и изход предимството остава това от тарифата: 20%.

Кешът е трета, отделна величина. Когато една сесия използва многократно същия контекст, четенето му може да струва по-малко от подаването му като нов вход. То обаче не участва във всяко натоварване, а създаването на кеша също има цена. Затова процентът от тестовете на Anthropic не може да се приложи направо към бюджета на произволен проект.

Как изглежда разликата в примерна сметка

При условен обем от един милион входни и 200 000 изходни токени, без кеш, Opus 5.5 струва 8 долара: 4 долара за входа и 4 долара за изхода. Същите количества при Opus 5 струват 10 долара. Икономията е 2 долара, или 20%. Примерът изолира промяната в тарифата и не предполага, че двата модела завършват една задача с еднакво качество.

Ако условното потребление нарасне до десет милиона входни и два милиона изходни токени, сметките стават съответно 80 и 100 долара. Спестяват се 20 долара, но процентът остава 20%, защото съотношението между вход и изход е същото. По-големият обем увеличава спестената сума; сам по себе си той не обяснява оценката за 40% по-нисък разход на задача.

При повторно използван контекст резултатът се променя. Да приемем условно десет милиона токени, прочетени от вече създаден кеш, плюс един милион нови входни и един милион изходни токени. Сметката е 26 долара за Opus 5.5 срещу 35 долара за Opus 5, или приблизително 26% по-малко. В този разчет няма разход за записване на кеша; той показва цената на посочените четения и нови токени.

Възможен е и разход с 40% по-нисък от условна сметка за Opus 5, но за него трябва да се промени потреблението, а не само тарифата. Например задача, която при стария модел струва 10 долара, би струвала 6 долара при новия, ако той използва три четвърти от съответните входни и изходни токени. Това е аритметичен пример за механизма зад оценката на Anthropic, а не измерен резултат за конкретен екип.

Какво показват тестовете за сложна работа

По-ниският разход е полезен, ако моделът запазва или подобрява качеството на работата. В репортажа на VentureBeat са приведени публикуваните от Anthropic резултати от 66,4% за Opus 5.5 срещу 52,3% за Opus 5 в Terminal-Bench 4.0; там продуктовият директор на GitHub Марио Родригес използва израза „among the fewest tokens and steps“ за модела в тестовете на GitHub. Резултатите от бенчмарка са представени от производителя, а цитираният опит идва от посочен от него ранен потребител.

Terminal-Bench оценява изпълнението на задачи по програмиране през команден ред. Резултатът е полезен ориентир за работата на AI агенти, но зависи и от настройките, инструментите и начина на оценяване. Той не измерва пряко колко ще струва поддръжката на дадена кодова база или колко човешки корекции ще са нужни след отговора на модела.

Именно тук разходът за завършена задача става по-смислен от цената на отделен отговор. Повторните опити, дългият генериран код и проверките могат да изядат спестеното от по-ниската тарифа. Обратно, по-малко стъпки до годен резултат могат да направят крайното намаление по-голямо от 20%. Публикуваните тестове обясняват защо Anthropic очаква такъв ефект, но не го установяват независимо за всички видове професионална работа.

Какво се променя при избора на инструмент

За разработчиците, които плащат за използвани токени, новата тарифа има непосредствен и предвидим ефект. При избор между модели за дълги задачи обаче има значение цялата поредица от заявки до приемлив резултат. Един модел може да е по-скъп на токен и да приключва с по-малко повторения; друг може да предлага по-ниска тарифа, но да изисква повече преработване.

При абонаментните планове намалението на API тарифата не се превръща автоматично в същото намаление на месечната цена. Там значение имат и ограниченията за ползване. За екип, който работи през API, най-ясната отправна точка остава сметката за вход, изход и кеш; заявената по-голяма икономия ще се види само ако моделът действително използва по-малко ресурси за задачите на този екип.

Така ценовата промяна отваря място за Opus 5.5 в натоварвания, при които продължителните AI сесии досега са били скъпи. Дали това ще промени избора на инструмент зависи от резултата при реалните задачи: колко работа приключва моделът, колко токени изразходва и колко корекции остават за хората след него.

Прочетете също:

Споделяне:

Абонирайте се за нашия бюлетин

Получавайте най-новите новини за Web3, AI и криптовалути директно във входящата си поща.

0