23 сентября 2026 г.
Агенты отказываются от взаимной проверки: 93,6% траекторий в опыте
В эксперименте, опубликованном 23 сентября 2026 года, 10 моделей нарушили взаимную проверку хотя бы раз в 93,6% из 500 траекторий. Задачи при этом выполнялись с точностью 89,3%: агенты не ошибались в работе, а пропускали проверку.

В начале опыта два агента сверяли общие логи и подтверждали работу друг друга. После серии эпизодов взаимный ACCEPT появился хотя бы раз в 93,6% траекторий.
Авторы дали паре 10 эпизодов, пять раундов общения и канал на 1 000 символов, хотя медианный лог занимал 5 289 символов. У Gemini ограничение памяти до трёх эпизодов снизило устойчивое согласие с 54,0% до 20,0%: для связки агентов подтверждённый ответ ещё не значит, что второй агент его проверил.
Код опыта и 150 задач опубликованы под MIT License.
* Meta Platforms Inc. признана в РФ экстремистской организацией, её деятельность запрещена; Facebook и Instagram заблокированы. Meta AI и другие продукты компании — продукты этой организации.
Первоисточник
