24 августа 2026 г.
Группа агентов не даёт независимых мнений: GPT-4 Turbo и Claude 3 Opus сходятся на одном варианте
Конформизм растёт вместе с умом модели: GPT-3.5 Turbo договориться так и не смог, а GPT-4 Turbo и Claude 3 Opus сошлись полностью.
Десять языковых моделей рассадили по группам и дали спорить. Сильные закончили одинаково: все выбрали один вариант.
Джордано Де Марцо и его коллеги из Университета Констанца смотрели на ИИ так, как физики смотрят на стаи птиц: важно не что знает отдельный агент, а куда движется вся популяция. Работа вышла в Science Advances, пресс-релиз университета опубликован 17.08.2026.
Раньше модель мерили поодиночке: бенчмарк проверяет одного агента на одной задаче. Теперь физики измерили популяцию, и она повела себя не как сумма участников.
Каждому агенту случайно выдали одну из двух позиций, обозначенных случайными буквами, чтобы не всплыли скрытые ассоциации с «да» и «нет». На каждом шаге агент видел мнения остальных и выбирал своё заново. Соглашаться его никто не просил.
GPT-4 Turbo и Claude 3 Opus почти всегда приходили к полному согласию: один вариант в итоге выбирали 100% агентов. GPT-3.5 Turbo так и не договорился, его группа колебалась вокруг 50/50.
Конформизм растёт с умом. Всё поведение группы уложилось в одно число β. С уровнем модели по MMLU оно совпадает на 0.76, с длиной контекстного окна — только на 0.49. Чем лучше модель понимает язык, тем охотнее она идёт за большинством.
«Все протестированные нами модели подчиняются тому же математическому закону, которым физики век описывают магниты», говорит Де Марцо.
Согласие возникает не в любой группе. Тестировали составы от 10 до 1000 агентов, и порог у каждой модели свой:
- Llama 3 70B: около 50 агентов - GPT-4o: около 150 - GPT-4 Turbo и Claude 3.5 Sonnet: больше 1000, и это нижняя оценка
Первоисточник