19 августа 2026 г.
GPT-5.6 Sol обогнал по скорости Gemini Flash: до 750 токенов в секунду
Разгон почти в 12 раз даёт железо Cerebras, а доступ в новый режим OpenAI пока раздаёт по записи.

Nick Dobos
@nickadobos
GPT 5.6 Sol на 1400 токенах в секунду Какого хрена??? Вы вообще понимаете, насколько это быстро?! Моргнул — и всё готово Для сравнения, «быстрые модели»: Claude sonnet 5 — примерно 50-70 Gemini flash 3.7 — примерно 350 Самая умная модель OpenAI вот-вот станет в 4-25 раз быстрее тупых моделей конкурентов
Самый быстрый ИИ стал ещё быстрее. Встречайте CS-4.

В обычном API GPT-5.6 Sol выдаёт 63 токена в секунду. В режиме Ultrafast обещаны до 750.
Раньше выбор стоял так: либо самый умный ответ, либо быстрый. Ultrafast эту развилку убирает. Модель та же, что в обычном режиме, а на тесте GDP-Val Cerebras намеряла ускорение в 5,6 раза без потери качества (13.08).
Откуда скорость. Считает железо Cerebras: 44 ГБ памяти прямо на кристалле, веса модели лежат на чипе, слои идут конвейером. Экзамен Humanity's Last Exam из 2500 вопросов та же связка прошла за 11 часов 11 минут против 78 с лишним часов.
Взять сейчас нельзя. Ultrafast не новая модель, а отдельный режим в API поверх GPT-5.6 Sol, открытый узкому кругу клиентов в превью. Записаться в очередь можно по форме на сайте OpenAI. В публичных доках модели на 19.08 отдельного режима нет: там базовый прайс $5 за миллион входных токенов и $30 за миллион выходных.
Цифра 1400 токенов в секунду, которая разошлась по соцсетям, в первоисточниках не встречается. OpenAI называет потолок до 750 и ускорение до 14 раз против обычного режима.
Пока очередь не дошла, самый быстрый вариант для всех прямо сейчас это Gemini 3.7 Flash: 343,7 токена в секунду в независимом замере от 19.08.
OpenAI обещает расширять доступ по мере роста мощностей, тогда появятся и цена, и сторонние замеры.
первоисточник