
GPT-6.1 Sol вышел за $2 и $10 — многоагентный режим пока в бете

В журнале изменений OpenAI от 29 сентября 2026 года зафиксирован выпуск GPT-6.1 Sol: стандартный тариф для запросов с входом до 272 тыс. токенов составляет $2 за миллион входных и $10 за миллион выходных токенов, а многоагентный режим доступен в бете. Модель работает через API; вызов инструментов и делегирование задач вспомогательным агентам предусмотрены в Responses API.
На DevDay 2026 модель представили как обновление рабочей GPT-6, которое приближает часть возможностей более дорогой Astra к меньшей цене, следует из репортажа Axios от 29 сентября. Для разработчика различие начинается со счёта за запрос: помимо входа и ответа, на него влияет запись повторяемого фрагмента в кеш или чтение из кеша. Бета-статус относится к делегированию между агентами, а не к обычным запросам к выпущенной модели.
Ставки для входа, ответа и кеша
Стандартный тариф разделяет обычные входные токены, выходные токены и два действия с кешем. Запись входных токенов в кеш стоит $2,50 за миллион, чтение ранее сохранённых — $0,10 за миллион. Это разные ставки для разных состояний входа: записанный токен оплачивается по ставке записи, а при успешном повторном чтении — по ставке чтения. Складывать цену записи с ценой обычного входа за один и тот же токен не нужно.
Такое разделение особенно заметно в приложении, которое многократно передаёт модели одни и те же инструкции или большой неизменный фрагмент данных. Первый запрос с записываемой частью может оказаться дороже запроса с обычным входом той же длины. Выигрыш появляется в последующих обращениях, если совпадающий фрагмент действительно читается из кеша. Из общей структуры запроса нельзя заранее заключить, что весь его вход получит льготную ставку: расчёт зависит от фактически записанных и прочитанных токенов.
Выход оплачивается отдельно при любом варианте входа. Поэтому дешёвое чтение кеша не превращает весь запрос в дешёвый: длинный ответ способен составить основную часть счёта. Для оценки повторяющейся нагрузки полезно различать стоимость первого обращения, когда фрагмент записывается, и стоимость следующих обращений, когда он может быть использован повторно. Именно это различие скрывается за одной общей цифрой «цена входа».
Большое окно меняет тариф до достижения своего предела
Карточка GPT-6.1 Sol указывает контекстное окно в 1 050 000 токенов и максимальный выход в 128 000 токенов; для запросов с входом свыше 272 тыс. токенов она устанавливает ставки $4 за миллион обычных входных токенов, $0,20 за чтение кеша, $5 за запись в кеш и $15 за выход, причём повышенный тариф применяется ко всему запросу. Таким образом, техническая вместимость контекста значительно больше границы нижнего ценового диапазона.
Разницу показывает условный расчёт без кеша и платных инструментов. Запрос с 272 тыс. входных и 20 тыс. выходных токенов стоит $0,744: $0,544 за вход и $0,20 за ответ. При 273 тыс. входных токенов и таком же ответе стоимость составит $1,392: $1,092 за вход и $0,30 за выход. Один дополнительный блок в тысячу входных токенов переводит весь запрос на повышенные ставки; рост счёта объясняется сменой тарифа для всего объёма, а не только ценой этого блока.
Для длинной истории работы агента или большого набора документов это различие может быть важнее максимальной вместимости окна. Контекстное окно отвечает на вопрос, сколько материала модель способна обработать в одном запросе. Порог тарификации отвечает на другой вопрос — по какой ставке будет оплачен уже допустимый запрос. При планировании бюджета эти величины нельзя считать одним и тем же ограничением.
Сколько стоят короткие запросы: два воспроизводимых случая
Первый условный запрос содержит 100 тыс. обычных входных токенов и ответ в 10 тыс. токенов. По стандартным ставкам вход обойдётся в $0,20, выход — в $0,10, вместе $0,30. Хотя ответ здесь в десять раз короче входа, на него приходится треть стоимости. Расчёт охватывает только токены модели при стандартной обработке; вызовы отдельных платных инструментов в него не включены.
Во втором условном случае приложение дважды отправляет повторяемый фрагмент объёмом 100 тыс. токенов и каждый раз получает ответ в 10 тыс. токенов. Предположим, что первый запрос полностью записывает этот фрагмент в кеш, а второй полностью читает его оттуда. Тогда первый стоит $0,35: $0,25 за запись и $0,10 за ответ. Второй стоит $0,11: $0,01 за чтение и $0,10 за ответ.
За пару таких обращений получается $0,46. Если оба входа оплачивать как обычные, сумма составит $0,60. Разница в $0,14 относится именно к заданному условию полного повторного чтения фрагмента; при частичном совпадении счёт будет другим. Пример также показывает, почему одна низкая ставка чтения кеша не описывает стоимость всей последовательности: перед повторным использованием фрагмент нужно записать, а оба ответа оплачиваются независимо от судьбы входа.
Интерфейсы API и предел многоагентной беты
Для запросов к GPT-6.1 Sol доступны Responses API и Chat Completions. Второй интерфейс подходит для запросов без вызова инструментов. Если модель должна обращаться к инструментам, используется Responses API; в нём же бета-режим позволяет передавать часть работы вспомогательным агентам внутри запроса. Поэтому поддержка модели в двух интерфейсах не означает одинаковый набор возможностей в каждом из них.
Модель принимает текст и изображения на вход, выдаёт текст, поддерживает потоковую выдачу и структурированные ответы. Тонкая настройка в перечне её возможностей не заявлена. Для обычной генерации эти характеристики уже описывают доступный продукт; для сценария с несколькими агентами существенен отдельный статус беты. Приложение, которому нужны инструменты и делегирование, зависит от возможностей Responses API, даже если простые текстовые запросы оно отправляет через Chat Completions.
Что означает сравнение с Astra
Sol позиционируется для сложного программирования, работы с компьютером и профессиональных задач, где важен баланс возможностей и цены. Astra остаётся более мощной моделью в линейке, а заявленная близость Sol к ней не обещает одинакового результата на каждом запросе. Разница в оплате токенов уже определена опубликованными ставками; разница в качестве зависит от конкретной задачи и объёма работы, который модель должна выполнить.
Для затрат особенно важен состав запроса. На коротком входе преимущество Sol можно посчитать по обычным ставкам и отдельно учесть кеш. При входе за границей нижнего тарифа расчёт меняется для всего запроса, даже если его размер ещё далёк от предела контекстного окна. А если работа требует делегирования между агентами, в архитектуре приложения приходится учитывать бета-статус этой функции вместе с обязательным использованием Responses API.
Читайте также:
Похожие статьи


GPT-5.5 уступила место GPT-5.6 Sol при той же цене токена

Claude Opus 5.5 дешевле на 40% — максимум усилий съедает экономию

Тариф DeepSeek зависит от часа: как посчитать счёт API до запуска

Claude Sonnet 5 сохраняет цену за токен, но тот же текст может стоить дороже

Дешёвый ИИ API может обойтись дороже: считайте результат, кэш и повторы
Подпишитесь на рассылку
Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.