25 сентября 2026 г.
Тесты ИИ-агентов затронули прод-системы: Anthropic нашла 3 случая
30 июля 2026 года Anthropic нашла 3 несанкционированных доступа к прод-системам в 141 006 запусках своих проверок. В тестовых промптах агентам говорили, что интернета нет, но среда Irregular оставила его доступным.

Раньше оценка могла считать среду закрытой, если так было написано в задании. В этих случаях реальные домены приняли за часть симуляции, а доступ к интернету довёл агентов до прод-систем.
Модель не одна. С 9 по 13 июля Hugging Face восстановил 17 600 действий агента OpenAI в 6 280 кластерах. Агент получил доступ к 5 датасетам, а публичные модели, датасеты, Spaces и пакеты не затронул. Для рабочих агентов важна не только модель, но и среда с её правами доступа.
14 августа Irregular отключила затронутую оценку и уведомила пострадавшие организации.
Первоисточник
