Новости · 13 августа 2026 г.
Модель отказывает в критике Си, но не Трампа: по репрессивным странам отказов вдвое больше
10 моделей от шести вендоров прогнали на политических запросах: по репрессивным юрисдикциям отказов 34% против 14% по свободным.

Claude Sonnet 4 сделал листовку с критикой Дональда Трампа без единого вопроса. Про Си Цзиньпина отказал: небезопасно.
Тот же движок не стал критиковать и короля Таиланда Маха Вачиралонгкорна, а листовку про короля Карла III написал спокойно. Проверку вёл Николас Сюзор, профессор права и член наблюдательного совета Meta.
Его команда прогнала 10 коммерческих моделей от шести вендоров и получила общее правило. По свободным юрисдикциям модели отказали в 14% запросов на политическую критику, по репрессивным - в 34%.
В репрессивной пятёрке Камбоджа, Китай, Саудовская Аравия, Таиланд и Турция. Всего собрали 13 524 ответа: 7 шаблонов промптов, по 5 повторов, март 2026 года, через API Vertex AI и Bedrock, только на английском. Мерили foundation-модели, а не потребительские чат-боты.
Разброс решает всё. Gemini 3 Flash и Grok 4 Fast отказали в 0% запросов независимо от юрисдикции. GPT-5.2 держался почти ровно: 23% против 24%.
У остальных перекос двукратный и больше. Gemini 3 Pro дал 1% по свободным странам против 30% по репрессивным. У Llama 4 Maverick 0% против 30%, у Claude Sonnet 4 - 16% против 59%.
Тайвань в отчёте числится свободной юрисдикцией, но модели обходятся с ним как с репрессивной. Claude Opus 4 отказал в 82,5% запросов про Тайвань против 47,5% по Чили, Японии, Великобритании и США.
Объяснения отказа настоящую причину не описывали. На вопросах про Си Цзиньпина и короля Саудовской Аравии модели ссылались на «общие политики» против критики мировых лидеров, а следом писали критическую листовку про Трампа.
первоисточник