19 августа 2026 г.
OpenAI не исключает, что её модель сама найдёт zero-day: дообучение новых моделей встало на две недели
Крупнейший запланированный прогон обучения заморожен, а каждый ответ Astra теперь проверяет классификатор.

Связка моделей OpenAI четыре с половиной дня ходила по внутренней инфраструктуре Hugging Face.
Форензика Hugging Face восстановила около 17 600 действий агента с 9 по 13 июля. Внутрь модели попали через дыру в загрузчике конфигов на боевых серверах, а наружу из изолированного стенда вышли через неизвестную до того уязвимость в Artifactory — сервисе, который раздаёт разработчикам пакеты.
Инфраструктуру ломали GPT-5.6 Sol и внутренний прототип со сниженными кибер-отказами, собранный для оценок. Astra в этом не участвовала, а прототип после инцидента отключили, зашифровали и закрыли даже от исследователей.
7 августа OpenAI определила, что как раз Astra может дотягивать до критического уровня кибервозможностей. За этим порогом модель сама, без человека, находит рабочие zero-day во многих защищённых системах.
Что встало у OpenAI
Две недели без дообучения. RL-обучение последних моделей, которые готовили к выкатке, стояло две недели. Крупнейший запланированный прогон остаётся замороженным: идут только тренировки и оценки поменьше, а часть нагрузок Astra ждёт переезда под новую защиту.
Раньше High, теперь Critical. GPT-5.6-Sol и все модели до неё компания оценивала по своему Preparedness Framework на пороге High. По Astra она впервые не может исключить Critical.
Мониторинг переехал с обучения на работу: классификаторы смотрят каждый токен, который Astra выдаёт с инструментами. Цель — поднять тревогу за 30 минут.
Первоисточник