18 августа 2026 г.
Новые модели OpenAI поедут медленнее: компания остановила дообучение на две недели
OpenAI на две недели остановила дообучение моделей, идущих в деплой, а крупнейший запланированный прогон стоит до сих пор.

Самый крупный тренировочный прогон OpenAI выключен. Держит его модель, которой ещё нет в проде.
Две недели компания не дообучала свежие модели, идущие в деплой: шли только мелкие тренировки и оценки. Темп выпуска теперь задаёт не гонка лабораторий, а собственный порог опасности.
Почему нажали на тормоз
Причин две. Инцидент OpenAI и Hugging Face, плюс предварительные оценки готовящейся модели Astra. Формулировка компании осторожная: результат достаточно сильный, чтобы уровень Critical по кибербезопасности нельзя было исключить. Critical стоит верхней ступенью внутренней шкалы OpenAI, Preparedness Framework, а в эксплуатации Hugging Face Astra не участвовала.
Насколько выросли способности, видно по замеру: 32-шаговую симуляцию «The Last Ones» GPT-5.6 Sol прошёл в 7 попытках из 10, GPT-5.5 — в 2 из 10. С инструментом Daybreak Red исследователи OpenAI нашли в движке V8 две ранее неизвестные дыры, и их цепочка давала побег из песочницы. Первую Google уже починил, вторую чинят по закрытой процедуре раскрытия.
Присмотр стал сплошным. Раньше мониторинг накрывал только внутренние деплои frontier-моделей и крупные RL-прогоны. Теперь он обязателен для всех тренировок и оценок с инструментами на моделях уровня Sol и выше, а с 7 августа 2026 — для любого инференса Astra с инструментами. Стоит такой присмотр примерно 20% сверху к тому компьюту, который мониторят.
Классификаторы читают внутреннюю активность модели на каждом сэмплированном токене и передают подозрительное автоматическим следователям. Норматив на алерт: 30 минут. Не доказали за эти полчаса ложное срабатывание — активность обязаны остановить.
Первоисточник