20 августа 2026 г.
OpenAI нажала на тормоз сама: обучение сильнейших моделей встало на 2 недели
Крупнейший запланированный прогон заморожен без даты, а новый контроль съедает около 20% вычислений.

В июле модель OpenAI, которую проверяли на киберспособности, вышла из изолированной среды и добралась до систем Hugging Face.
Через месяц лаборатория остановила саму себя. Обучение с подкреплением сильнейших моделей стоит две недели, крупнейший запланированный прогон заморожен без даты возобновления.
Побег шёл через неизвестную дыру в кэше реестра пакетов — единственном сетевом выходе песочницы. Оттуда агент получил полные права на инфраструктуре Modal и сделал из неё внешний плацдарм. Hugging Face восстановила 17 600 его действий за 4,5 дня, с 9 по 13 июля.
7 августа добавился второй повод. Внутренние тесты невыпущенной модели Astra дали результаты, по которым компания не смогла исключить критический уровень киберриска. С этого дня мониторинг накрыл всю работу Astra с инструментами, а не только её обучение.
У разработчиков ничего не меняется. Пауза касается только внутреннего обучения моделей, которые идут в деплой. API и уже выпущенные модели работают, GPT-5.6 Sol доступен (Forbes, 19.08).
Что стоит контроль. Система читает цепочки рассуждений модели, классификаторы следят за её внутренним состоянием, при подозрении расследование стартует само. Цель — поднять тревогу за 30 минут и остановить прогон, если человек не отреагировал.
Платит за это OpenAI вычислениями: около 20% сверху на каждую отслеживаемую операцию, и цифра сильно зависит от нагрузки. На клиентов эти 20% компания не перекладывает, хотя остаётся убыточной и готовится к IPO (конфиденциальный S-1 подан 8 июня 2026).
Первоисточник