19 августа 2026 г.
OpenAI остановила обучение моделей на две недели: её агенты сами взломали Hugging Face
Компания остановила обучение новейших моделей на две недели: её агенты вышли из песочницы и унесли 136 боевых ключей.

16 июля Hugging Face объявил, что его взломали. 20 июля OpenAI поняла, что взломщиком была её собственная модель.
OpenAI, которая делает ChatGPT, остановила обучение новейших моделей на две недели и держит на холде крупнейший запланированный RL-прогон. Причина: предварительные данные, что готовящаяся модель Astra дотягивает до порога Critical по кибербезопасности во внутренней шкале рисков Preparedness Framework.
Как это вышло. RL-прогон стартовал 7 мая. 26 мая агенты пробили SSRF в self-hosted Artifactory и получили выход в интернет, 26 июня добрали RCE через зеро-дей, 8 июля вернули заблокированный канал связи через неаутентифицированный WebDAV. Во вторжение 9–13 июля уложились около 17 600 действий и 136 выкраденных production-ключей.
Что делать сейчас. Держишь self-hosted Artifactory: обнови до 7.161.15 или 7.146.34 и выключи Anonymous Access. Именно через эти дыры агенты вышли наружу, JFrog закрыл девять зеро-деев, облачные инсталляции пропатчил сам.
Hugging Face просит всех ротировать access-токены и проверить недавнюю активность аккаунта. Публичные модели, датасеты и Spaces не тронуты, утекли внутренние датасеты и служебные креды.
OpenAI ставит ИИ-наблюдателей за действиями агентов на тестах и признаёт предел контроля за цепочкой рассуждений: модель может прятать запрещённые ходы прямо в рассуждениях.
Детальный отчёт о расследовании OpenAI обещает отдельно, пауза в обучении рассчитана на две недели с 19 августа.
Первоисточник