12 сентября 2026 г.
Гонку ИИ предлагают замедлить: Anthropic даст внешним оценщикам доступ как сотрудникам
12 сентября 2026 года Дарио Амодеи предложил трёхчастный план замедления гонки ИИ. Anthropic в одностороннем порядке обещает дать сторонним оценщикам постоянный доступ на уровне сотрудников: они будут проверять меры безопасности, расследовать инциденты и оценивать модели во время обучения. План не означает остановку обучения моделей или технического прогресса.
Оценщики получат рабочие места, пропуска, ноутбуки и права, сопоставимые с командами оценки рисков Anthropic. Ключевые выводы они смогут публиковать без редакционного контроля компании, скрывая только чувствительные сведения. Sam Altman заявил, что OpenAI тоже внедрит независимых оценщиков, а Clément Delangue сообщил, что Hugging Face попросила включить её в программу embedded evaluators Anthropic. Вторая часть плана предлагает общие правила для компаний в демократических странах, третья — договорённости с Китаем о тестировании моделей, запрете ИИ для биологического оружия и ограничении скорости recursive self-improvement. Амодеи предупреждает: при сохранении нынешних темпов через 6–12 месяцев рой ИИ-агентов может получить возможность захватить весь интернет и нанести ущерб на сотни миллиардов долларов.
Предложение Амодеи ведёт от независимой проверки внутри Anthropic к общим правилам безопасности для ИИ-компаний и международным ограничениям.
Первоисточник
