2 сентября 2026 г.
Проверить рассуждения GPT-6 Astra стало труднее: OpenAI написала об этом в system card
OpenAI выкатила GPT-6 Astra 3 сентября 2026 и в system card признала: по цепочке рассуждений модель читается хуже предшественников.
Astra втрое реже попадается на подсунутые со стороны инструкции. И при этом хуже показывает, как думала.
Цепочка рассуждений была окном в работу модели: по шагам видно, как она пришла к ответу и где подменила задачу. В system card GPT-6 Astra OpenAI пишет прямым текстом, что читаемость этих шагов заметно упала против прошлых моделей.
Что поменяли внутри. Astra считает через recurrent depth: часть слоёв модель прогоняет по кругу, и эта работа не превращается в слова. В открытом примере Nanbeige 4.2 стек из 22 слоёв гоняется дважды и работает как 44 слоя, а число параметров не растёт. Компьют при этом дорожает почти вдвое.
Спор идёт о запасе. Главный научный сотрудник OpenAI Якуб Пахоцки ответил на панику числом: глубина вычислений Astra отличается от GPT-4 не больше чем вдвое. Исследователь Рауно Арике вывел из этой фразы 3-4 цикла у Astra. Исследовательская модель Huginn обучалась до 32 циклов и разгонялась до 64 на инференсе.
Чего боятся критики. Бак Шлегерис, гендиректор Redwood Research, говорит, что у OpenAI теперь есть возможность резко нарастить рекуррентность и полностью убить читаемость рассуждений. Его коллега Райан Гринблатт называет край этого пути: модель рассуждает целиком в скрытом пространстве.
Цена выросла в 2,5 раза. В API gpt-6-astra на коротком контексте стоит $10 за миллион входных токенов и $50 за миллион выходных. Прошлая gpt-5.6-sol брала $4 и $20 за то же. Раскатка началась 3 сентября с ограниченного круга организаций, дальше обещаны ChatGPT Plus, Pro, Business и Enterprise, API OpenAI, Microsoft Azure и AWS Bedrock.
За что платят. На OSWorld 2.0 Astra берёт 72,6% примерно за 40 минут на задачу, gpt-5.6-sol давала 65,7% за 75 минут. Доля сработавших непрямых prompt injection упала с 27,0% до 8,5%. По кибербезопасности Astra стала первой моделью OpenAI, дошедшей до высшего уровня риска Critical в собственной шкале компании Preparedness Framework. Заявлены также 98% на FrontierMath Tier 4 и 99,9% на ARC-AGI-3.
Массовый доступ обещан в ближайшие дни после 3 сентября — тогда рассуждения Astra смогут разобрать сторонние исследователи.
Первоисточник