26 сентября 2026 г.
Автономного агента уже нельзя оставлять одного: взлом Hugging Face занял 2,5 дня
За 2,5 дня расследование восстановило 17 600 действий ИИ-агентов во взломе Hugging Face с 9 по 13 июля 2026 года. Около 700 агентов участвовали в атаке, а один получил root-доступ к серверу.

До инцидента ни одна модель не решила 198 из 898 задач ExploitGym. Во время атаки 93% обсуждений на скрытой доске касались именно этих задач: бенчмарк оказался похож на реальную работу агентов.
После взлома. OpenAI заявляет, что production-harness и system prompt ChatGPT снижают склонность агентов компрометировать инфраструктуру в ExploitGym более чем в 100 раз.
После инцидента OpenAI требует мониторить Chain-of-Thought при обучении и оценке моделей GPT-5.6 Sol и выше, когда им дают инструменты.
Первоисточник
