8 октября 2026 г.
Меньше ждать ответа GPT-6.1 Sol: OpenAI обещает генерацию токенов до 8× быстрее
С 8 октября GPT-6.1 Sol Ultrafast доступен в API по цене в 6 раз выше Standard для короткого контекста.

OpenAI Developers
@openaidevs
Сегодня начинаем предоставлять Ultrafast для GPT-6.1 Sol в API, Codex и ChatGPT Work. Интеллект почти на уровне Astra, скорость до 8 раз выше Sol Standard: создавайте так же быстро, как приходят идеи.
· 313,3 тыс. просмотров
В Codex и ChatGPT Work ускорение доступно на Pro за $500 в месяц и подходящих Enterprise/Edu. Эти условия действуют с 8 октября.
OpenAI добавила к Standard режим Ultrafast в API, Codex и ChatGPT Work. Компания обещает интеллект, близкий к Astra, и до 8× более быструю генерацию токенов в Codex. Речь о скорости ответа модели, а не о времени всей задачи агента.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Доступ в приложениях. Остальные самостоятельные подписки не дают Ultrafast даже с купленными credits. В Enterprise владелец workspace сначала включает режим через workspace permissions для отдельных пользователей или всей команды.
В Standard агент расходует включённый лимит с обычной скоростью. Ultrafast расходует его в 8 раз быстрее, а купленные credits и Enterprise pay-as-you-go оплачиваются с множителем 6×. Для практики это отдельный выбор между ожиданием ответа и расходом бюджета.
Как включить API. В Responses API укажите `model: "gpt-6.1-sol"` и `service_tier: "ultrafast"`. Режим доступен всем пользователям API, подписка Pro для этого не нужна.
Цены OpenAI API на 08.10.2026, в долларах за 1 млн токенов:
| Режим и контекст | Вход | Вход из кэша | Запись в кэш | Выход | | --- | ---: | ---: | ---: | ---: | | Standard, короткий | $2 | $0,10 | $2,50 | $10 | | Ultrafast, короткий | $12 | $0,60 | $15 | $60 | | Ultrafast, длинный | $24 | $1,20 | $30 | $90 |
Для короткого контекста каждый вид токенов Ultrafast стоит в 6 раз дороже Standard. Отдельные лимиты пропускной способности API составляют 1 млн токенов в минуту на Build, 4 млн на Launch и 40 млн на Grow.
Для агентов, которые часто вызывают инструменты, OpenAI рекомендует постоянное WebSocket-соединение. HTTP тоже поддерживается, но сетевые задержки могут сократить выигрыш от ускоренной генерации.
Ultrafast поддерживает хранение данных API в США и ЕС, а выполнение запросов Codex и ChatGPT Work в США и Европе, включая EEA и Швейцарию.
Первоисточник
