OpenAI API или Gemini API: дуг контекст мења цену пре квалитета

|Аутор: Уредништво QUASA|6 мин читања| 1
OpenAI API или Gemini API: дуг контекст мења цену пре квалитета

Избор између OpenAI API-ја и Gemini API-ја зависи од тога како су исти улазни и излазни токени распоређени по позивима. Ценовник OpenAI API-ја за GPT-6.1 Sol у стандардном режиму наводи 2 долара за милион улазних и 10 долара за милион излазних токена у кратком контексту, односно 4 и 15 долара у дугом. Према ценовнику Gemini API-ја, Gemini 3.1 Pro Preview кошта 2 и 12 долара до 200.000 токена у промпту, а 4 и 18 долара изнад тог прага.

За условни позив са 500.000 улазних и 10.000 излазних токена рачун за GPT-6.1 Sol износи 2,15 долара, а за Gemini 3.1 Pro Preview 2,18 долара. Оба износа примењују тарифу за дуг контекст на цео позив. Код бота са много кратких питања и програмерског агента који ради у више корака однос трошкова је другачији, чак и када оба провајдера добију потпуно исти број токена.

Шта улази у поређење цене

Рачунице испод користе јавне цене плаћеног стандардног режима у америчким доларима. Улазни токени се множе ценом улаза, излазни ценом излаза, а обе тарифе су исказане по милиону токена. У основном износу нема пореза, конверзије валуте, накнаде посредника, претраге ни других алата. То је цена задатог обима потрошње, а не цена гарантовано доброг одговора.

За кратке позиве бота упоређени су GPT-6 Luna и Gemini 3.1 Flash-Lite, модели намењени великом броју лакших захтева. За програмерски рад и велики документ узети су GPT-6.1 Sol и Gemini 3.1 Pro Preview. Парови служе да се упореди рачун за исто оптерећење; не подразумевају једнак квалитет. Важна је и расподела токена: милион улазних токена у месецу може да потиче из много кратких позива или из неколико промптова који прелазе праг скупље тарифе.

Три сценарија са једнаким бројем токена

Бот корисничке подршке. Условни скуп кратких позива троши укупно милион улазних и 250.000 излазних токена, без претраге. За GPT-6 Luna улаз кошта 0,10, а излаз 0,125 долара, што даје 0,225 долара. За Gemini 3.1 Flash-Lite исти обим кошта 0,25 долара за улаз и 0,375 за излаз, укупно 0,625 долара. Из овог збира се не може закључити колико је разговора успешно решено.

Програмерски агент. Укупно оптерећење остаје милион улазних и 250.000 излазних токена, али је распоређено у позиве испод прагова дугог контекста. GPT-6.1 Sol тада кошта 4,50 долара, а Gemini 3.1 Pro Preview 5 долара. То је рачун под условом да оба агента троше исти број токена и праве исти број корака. Ако један модел чешће понавља покушај, шаље дужи контекст у следећи корак или производи више излазних токена, стварна цена завршеног задатка може да буде другачија.

Анализа великог документа. Један текстуални промпт садржи 500.000 улазних токена и тражи 10.000 излазних. Код GPT-6.1 Sol улаз кошта 2 долара, а излаз 0,15; код Gemini 3.1 Pro Preview улаз кошта 2 долара, а излаз 0,18. Разлика од три цента је мала за један одговор, али овај сценарио јасно показује зашто се цена дугачког позива не добија применом јефтиније тарифе за кратак контекст. Ако се исти корпус поново шаље, трошак поновљеног улаза постаје важнији.

Примери намерно користе текстуалне токене. Код докумената послатих као PDF или слика уместо као текст, обрачун може да укључи другу категорију улазних токена. Зато се цена из примера односи на наведени текстуални улаз, а не аутоматски на сваку датотеку исте дужине.

Где дуг промпт прелази у скупљу тарифу

Спецификација GPT-6.1 Sol наводи контекстни прозор од 1.050.000 токена: када промпт пређе 272.000 улазних токена, цена улаза и кеша се удвостручује, а цена излаза расте један и по пут за цео захтев. За Gemini 3.1 Pro Preview виша улазна и излазна тарифа важи када промпт пређе 200.000 токена. Код оба модела праг се односи на појединачни промпт, па исти месечни збир токена може да произведе различит рачун.

Google-ов водич за Gemini 3 наводи улазни прозор од милион токена за Gemini 3.1 Pro Preview и статус Preview. Оба упоређена модела зато могу да приме текстуални улаз од 500.000 токена из примера. Величина прозора ипак не говори колико ће модел поуздано пронаћи потребан пасус у обимном корпусу. Када је за одговор потребан мали део збирке, избор између контекста и RAG-а мења и количину послатог текста и начин на који се долази до одговора.

Колико мењају кеш и групна обрада

Кеширање снижава цену читања само ако се одговарајући део промпта заиста понови и буде доступан у кешу. За GPT-6.1 Sol читање кешираног улаза кошта 0,10 долара за милион токена у кратком, односно 0,20 у дугом контексту; упис има посебну тарифу. За Gemini 3.1 Pro Preview читање кошта 0,20, односно 0,40 долара, уз цену чувања по количини токена и времену. Примена цене читања на цео први позив би зато потценила рачун.

Као условна провера осетљивости, претпоставимо да је половина улаза великог документа већ доступна за читање из кеша. Трошак токена тада пада са 2,15 на 1,20 долара за GPT-6.1 Sol и са 2,18 на 1,28 долара за Gemini 3.1 Pro Preview. У тај обрачун нису укључени упис и чување кеша. Ако се документ обрађује асинхроно у Batch режиму, објављене тарифе за ова два модела преполовљују основни рачун на 1,075 и 1,09 долара, без додатних ставки. Тај режим одговара послу који може да чека; агенту чији следећи корак зависи од претходног одговора потребан је другачији ток рада.

Претрага је засебна ставка

Када бот или агент укључи веб претрагу, основни трошак токена више није укупан трошак. OpenAI за стандардни Web search наплаћује 10 долара за хиљаду позива, а токене садржаја претраге додатно по тарифи модела. За Grounding with Google Search код Gemini 3.x постоји заједничка месечна квота од 5.000 бесплатних претрага, после које се наплаћује 14 долара за хиљаду претрага. То су различите обрачунске јединице, па број корисничких одговора није довољан за процену ове ставке.

У условном месецу са 10.000 наплативих претрага, OpenAI ставка за алат износи 100 долара пре токена преузетог садржаја. Ако је Google-ова заједничка квота на почетку тог периода неискоришћена, додатак износи 70 долара; ако је већ потрошена, износи 140 долара. Овај пример не мења трошак модела из претходних сценарија: показује колико алат може да надмаши малу разлику у цени самих токена.

Шта резултати кодирања говоре о избору

BenchLM-ово поређење у својој агрегираној категорији кодирања даје GPT-6.1 Sol резултат 67,0, а Gemini 3.1 Pro резултат 42,4. Та категорија спаја јавне резултате из различитих поставки и ослања се на један јавни ред за Sol, а пет за Gemini. Она даје сигнал о задацима кодирања, али није цена по успешно завршеном задатку истог програмерског агента.

За такав избор пресудно је колико покушаја, токена и позива алата сваки модел потроши да би измена прошла исте тестове. Јефтинији збир токена има вредност само ако задатак буде прихватљиво решен; додатни покушаји могу да поједу разлику из основне рачунице. Зато бот, програмерски агент и анализа великог документа могу оправдано да заврше на различитим API-јима, иако је почетно питање о цени исто.

Прочитајте и:

Подели:

Претплатите се на наш билтен

Добијајте најновије вести о Web3, AI-у и криптовалутама директно у пријемно сандуче.

0