30 сентября 2026 г.
GPT-6 Astra быстрее пишет ответ: OpenAI заявляет ускорение генерации до 8 раз
Ultrafast ускоряет генерацию той же модели, но в API стоит в 6 раз дороже Standard.

OpenRouter
@openrouter
Astra Ultrafast 🤯 https://openrouter.ai/openai/gpt-6-astra

· 3,7 тыс. просмотров
GPT-6 Astra Ultrafast генерирует токены в Codex до 8 раз быстрее Standard по данным OpenAI на 30 сентября. Это скорость генерации, а не выполнения задачи.
OpenRouter добавил ускоренный режим для openai/gpt-6-astra. Модель остаётся той же, пользователь выбирает скорость и цену запроса.
Цена ускорения. В OpenAI API Standard стоит $10 за миллион входных токенов и $50 за миллион выходных. Ultrafast тарифицируется отдельно.
| Режим | Вход, за 1 млн токенов | Выход, за 1 млн токенов | | --- | --- | --- | | Standard | $10 | $50 | | Ultrafast | $60 | $300 | | Ultrafast при входе свыше 272 000 токенов | $120 | $450 |
Цены проверены 30.09.2026 по тарифам OpenAI и документации GPT-6 Astra. При превышении порога повышенная ставка действует на весь запрос. OpenRouter берёт за Ultrafast $60/$300, чтение кеша стоит $6 за миллион токенов.
Как включить. В OpenRouter нужно передать `service_tier: "ultrafast"`. Суффиксы `:nitro` и `:floor` этот режим не выбирают. OpenRouter допускает переход на priority и Standard, а `provider.only: ["openai/ultrafast"]` оставляет только Ultrafast.
В OpenAI API режим включается через `client.responses.create` с `model="gpt-6-astra"` и `service_tier="ultrafast"`. В документации есть готовые примеры для Python, JavaScript и curl.
Ultrafast доступен всем пользователям API. Лимиты составляют 500 тысяч токенов в минуту для уровней доступа 1–3, 1 млн для уровня 4 и 5 млн для уровня 5. Режим поддерживает глобальную обработку и регион США, региональные endpoints ЕС и других регионов за пределами США не поддерживаются.
В Codex и ChatGPT Work режим доступен на Pro за $500 и подходящих Enterprise/Edu. Включённый лимит расходуется в 8 раз быстрее Standard, купленные кредиты оплачиваются с множителем 6.
Первоисточник: [GPT-6 Astra в OpenRouter](https://openrouter.ai/openai/gpt-6-astra).
Для ИИ-агентов с частыми вызовами инструментов OpenAI рекомендует постоянное WebSocket-соединение, чтобы сетевые задержки не съедали выигрыш Ultrafast.
Первоисточник