13 августа 2026 г.
Ждать конца генерации больше не надо: GPT-5.6 Sol Ultrafast выдаёт 750 токенов в секунду
OpenAI и Cerebras включили Ultrafast: та же модель, до 14 раз быстрее обычного режима, доступ пока по заявке.

Исследователь OpenAI Джеффри Ван раньше уходил из задачи, пока модель думает. Теперь она заканчивает раньше, чем он успевает переключить контекст.
Скорость стала отдельным товаром: 13 августа OpenAI и Cerebras запустили Ultrafast, скоростной режим той же модели GPT-5.6 Sol.
Раньше и теперь. Финансовый дашборд в демо OpenAI собирался на Standard 12 минут 20 секунд, на Ultrafast укладывается в 1 минуту 50 секунд (13.08). Humanity's Last Exam Cerebras прогнала за 11 часов 11 минут, у Claude Fable 5 на тот же тест ушло 78 часов 27 минут (замер Cerebras, 10.07).
Ум остался прежним, быстрее стала только выдача: до 750 выходных токенов в секунду, до 14 раз против Standard. На бенчмарке GDP-Val Cerebras намерила ускорение в 5,6 раза от запроса до готового ответа без потери качества (31.07). Artificial Analysis насчитала 11 раз против Fable 5 и 5 раз против Opus 4.8 в режиме Fast.
Как включить. Кнопки нет: Cerebras принимает заявки формой на ранний доступ, спрашивает, что ты строишь и какую нагрузку ждёшь, и решает вместе с OpenAI. Ultrafast идёт в закрытом превью в API OpenAI у узкого круга клиентов, цену и дату общего запуска не назвали.
Доступ обещают расширять по мере роста мощностей.
первоисточник