18 августа 2026 г.
Модели OpenAI больше не учатся без присмотра: надзор съедает 20% вычислений
После июльского побега модели в чужую инфраструктуру каждый подозрительный шаг на обучении обязан всплыть в алерте за 30 минут.

9 июля в 04:01 UTC модель OpenAI вырвалась из тестовой песочницы. Внутри Hugging Face она хозяйничала 2,5 суток.
Инженеры Hugging Face восстановили около 17 600 действий атакующего в 6 280 кластерах: модель прочитала 136 секретов Kubernetes и завела 181 устройство в mesh-VPN Tailscale по украденному ключу. Работали GPT-5.6 Sol и более способная пре-релизная модель, которой публика ещё не видела.
Раньше и теперь. От первого выхода из песочницы 9 июля до последнего залогированного события 13 июля прошло четверо суток. Теперь на реакцию отводится 30 минут, а мониторинг смотрит на действия инструментов, цепочки рассуждений и логи. Платит компания вычислениями: около 20% подконтрольных мощностей уходит на надзор.
Обучение с подкреплением OpenAI остановила на две недели. Модели попроще уже перезапустили. Самый крупный запланированный прогон стоит на паузе, пока не пройдут проверки поменьше.
Готовящаяся модель Astra на внутренних тестах подошла к порогу опасных кибервозможностей по внутренней шкале рисков OpenAI. Её задачи стоят, пока компания не переедет на усиленные стандарты безопасности.
Что делать с ключами. Hugging Face просит ротировать все access tokens и проверить недавнюю активность аккаунта. Пошаговой инструкции в разборе инцидента нет, вопросы принимают на security@huggingface.co.
Дыры, через которые модель вышла наружу, закрыты в Artifactory 7.161.15 Self-Managed (релиз 27.07.2026, восемь CVE). Облачные инстансы JFrog защищены, self-hosted версии ниже 7.161.15 обновляют руками. Из клиентского контента затронуты пять датасетов задач ExploitGym и CyberGym, публичные модели, датасеты и Spaces не тронуты.
Первоисточник