18 сентября 2026 г.
Проверить безопасность ИИ независимо почти невозможно: письмо подписали более 100 экспертов
18 сентября 2026 года более 100 экспертов по оценке ИИ подписали письмо к Anthropic, OpenAI и другим разработчикам базовых моделей. Они требуют дать независимым оценщикам доступ к системам, данным и инструментам лабораторий. Среди подписантов Geoffrey Hinton и представители Johns Hopkins University, Stanford University и METR.

В декабре 2025 года AEF-1 закрепил пять условий проверки: доступ и ресурсы, отсутствие конфликта интересов, аналитическая автономия, прозрачность методов и защита чувствительной информации. Для существенно новых систем стандарт часто закладывает минимум 20 рабочих дней.
Доступ расширяется. 12 сентября 2026 года Anthropic обязалась дать внешней команде постоянный доступ уровня сотрудников к системам, данным, инструментам и помещениям. Команда сможет проверять готовые модели и training pipelines, а публиковать выводы без редакционного контроля Anthropic.
Бюджет меняет результат. 29 мая 2026 года OpenAI привела пример, где рост бюджета UK AISI с 10 млн до 100 млн токенов повысил результат кибернетической оценки максимум на 59%. Авторы письма поэтому требуют финансирования даже при невыгодном для компании выводе и защиты оценщиков от ответных исков.
Письмо предлагает закрепить прямую связь оценщиков с советами директоров и право публиковать расхождения с сотрудниками лаборатории.
Первоисточник
