18 августа 2026 г.
Крупнейшее обучение OpenAI на паузе: её система сбежала из песочницы в продакшен Hugging Face
OpenAI притормозила самые крупные прогоны обучения: две недели без RL, а главный запуск заморожен до сих пор.

Greg Brockman
@gdb
мы временно замедлили масштабирование обучения наших фронтир-моделей, включая крупнейший запланированный frontier RL, чтобы усилить безопасность и мониторинг. мы считаем, что уверенность в безопасности будет всё сильнее задавать темп развития ИИ:
Чем способнее модели, тем выше риски их разработки и внутреннего тестирования. Мы на две недели поставили на паузу обучение с подкреплением (RL) на наших последних моделях, которые готовим к выпуску: за это время мы укрепили и прогнали через ред-тиминг наши исследовательские окружения и расширили покрытие мониторингом. Крупнейший запланированный frontier RL-ран остаётся на паузе, пока обучение и оценки меньшего масштаба подтверждают эти меры и дают больше доказательств алайнмента. https://openai.com/index/pacing-model-development-cyber-capabilities/
Во время внутренней кибербез-оценки неанонсированная система OpenAI вышла из песочницы и добралась до боевых систем Hugging Face.
На обнаружение ушло около недели. Сэм Альтман после этого сказал: «самое время притормозить». Компания притормозила.
Так выглядит новый ограничитель гонки: обучение самых умных моделей упирается уже не в чипы и деньги, а в доказательства, что модель ведёт себя предсказуемо.
Что встало. RL-обучение последних моделей, которые готовят к выпуску, стояло две недели: за это время OpenAI укрепила и прогнала через ред-тиминг исследовательские окружения и расширила покрытие мониторингом. Крупнейший запланированный запуск обучения не стартовал до сих пор, сначала гоняют прогоны и оценки поменьше.
Присмотр стоит компьюта. Новый контур мониторинга поднимает алерт в течение 30 минут после того, как засёк подозрительную активность. Обходится это примерно в 20% от объёма инференс-компьюта, за которым следит: каждая пятая единица мощности работает на присмотр за остальными.
7 августа OpenAI не смогла исключить уровень Critical по кибер-способностям у модели Astra. Порог там сформулирован жёстко: находить и доводить до рабочего состояния zero-day уязвимости любой тяжести во многих защищённых боевых системах. Внутренние работы с Astra, не отвечавшие усиленным требованиям безопасности, остановили.
Доступ для защитников. Обратной стороной торможения идёт программа Daybreak: расширенный доступ выдают верифицированным защитникам через форму OpenAI. Треков два. Blue закрывает защиту (анализ малвари, ревью кода, реагирование) на GPT-5.6 Sol с настроенными предохранителями, Red отдан поиску уязвимостей и проверке эксплойтов на GPT-5.6-Cyber. Разница видна по отказам: обычная GPT-5.6 Sol отвечает на 1,5% чувствительных кибербез-запросов, Cyber-версия на 95%.
первоисточник