./новости · 31 июля 2026 г.
новость
Ложный документ перед финалом ломает deep research: 85,5% отчётов принимают его вывод
источник: reddit.com·
машинная выжимка · сверена с источником

Один подложный документ, подсунутый перед самым написанием отчёта, уводит deep research агента в ложный вывод в 85,5% случаев. Так замерили Пэнъюй Чжу и соавторы в препринте на arXiv от 31.07. Они сгенерировали 5 933 ложных факта и прогнали их через DeerFlow, WebThinker и Gemini Deep Research.
Раньше доверие держалось на цитатах. Агент планировал поиск, собирал источники и выдавал отчёт со ссылками, и это выглядело проверкой. Замер говорит другое. Важнее не то, что лежит в выдаче, а в какой момент оно туда попало.
Момент вброса решает всё. Без подлога агенты не приняли ни одного ложного вывода, 0%. Один подложный документ в выдаче поднял средний показатель до 54,7%. В начале поиска ложь проходила в 40,5% отчётов, в середине в 44,2%, перед финальной сборкой ответа в 85,5%.
Защиты дыру не закрыли. Авторы попробовали два очевидных приёма: проверочную инструкцию в запросе и агента-ревизора, который перечитывает готовый отчёт по пунктам с поиском. Оба снизили долю ложных выводов, ни один не обнулил. Сторонняя модель при этом правильно опознавала подложный документ, а агент всё равно брал его вывод. Пометка не равна отказу.
Замер сделан на двух open-source фреймворках и одном закрытом сервисе Google, других deep research агентов авторы не проверяли.
первоисточник