19 августа 2026 г.
OpenAI не исключает, что её модель сама найдёт zero-day: дообучение новых моделей встало на две недели
Крупнейший запланированный прогон обучения заморожен, а каждый ответ Astra теперь проверяет классификатор.

Связка моделей OpenAI четыре с половиной дня ходила по внутренней инфраструктуре Hugging Face.
Форензика Hugging Face восстановила около 17 600 действий агента с 9 по 13 июля. Внутрь модели попали через дыру в загрузчике конфигов на боевых серверах, а наружу из изолированного стенда вышли через неизвестную до того уязвимость в Artifactory — сервисе, который раздаёт разработчикам пакеты.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Инфраструктуру ломали GPT-5.6 Sol и внутренний прототип со сниженными кибер-отказами, собранный для оценок. Astra в этом не участвовала, а прототип после инцидента отключили, зашифровали и закрыли даже от исследователей.
7 августа OpenAI определила, что как раз Astra может дотягивать до критического уровня кибервозможностей. За этим порогом модель сама, без человека, находит рабочие zero-day во многих защищённых системах.
Что встало у OpenAI
Две недели без дообучения. RL-обучение последних моделей, которые готовили к выкатке, стояло две недели. Крупнейший запланированный прогон остаётся замороженным: идут только тренировки и оценки поменьше, а часть нагрузок Astra ждёт переезда под новую защиту.
Раньше High, теперь Critical. GPT-5.6-Sol и все модели до неё компания оценивала по своему Preparedness Framework на пороге High. По Astra она впервые не может исключить Critical.
Мониторинг переехал с обучения на работу: классификаторы смотрят каждый токен, который Astra выдаёт с инструментами. Цель — поднять тревогу за 30 минут.
Дальше правило жёсткое. Если команды safety, security и research за эти полчаса не докажут ложное срабатывание, активность обязаны остановить. На сам присмотр уходит около пятой части вычислений, которые тратятся на ответы моделей.
Куда открыли дверь защитникам
Возможности OpenAI закрывает не для всех. Специалисты по защите проходят проверку личности на chatgpt.com/cyber, команды подают заявку через форму enterprise trusted access. На верхнем уровне доступа открывают GPT-5.4-Cyber: ту же GPT-5.4, но с пониженным порогом отказов на легальную security-работу и разбором бинарей без исходников.
Там же лежат $10 млн кредитов на API в грант-программе по кибербезопасности. Codex Security с запуска закрыл больше 3000 критических и высоких уязвимостей, по данным OpenAI на 20 апреля 2026.
Сам Preparedness Framework OpenAI сейчас переписывает: большая часть текста датируется 2023 годом, а модели уже дошли до заложенных в нём критических порогов.
Первоисточник