15 августа 2026 г.
ИИ выигрывает у математиков памятью, а не умом: окно контекста держит сотни выкладок
ИИ силён в математике не потому, что думает лучше, а потому, что не забывает: всё промежуточное остаётся в окне контекста.
7 задач из 10 модели закрыли так, что живые математики зачли доказательства вслепую.
Давиде Пифер объясняет это не умом, а памятью. Окно контекста работает как внешняя рабочая память: в него помещаются разом условие, сотни промежуточных выкладок, брошенные подходы и ранние выводы.
Аргумент не из бенчмарков. В посте от 4 августа нет ни одного счёта модели и ни одного названия модели. Пифер опирается на четыре работы по психологии рабочей памяти, включая шестилетнее лонгитюдное исследование: они показали вклад памяти в математику сверх IQ.
Что из этого проверяемо. Преимущество моделей должно пропадать там, где нужен один короткий скачок или новый способ увидеть задачу. И держаться там, где способ уже найден и остаётся перебрать все следствия.
Раньше об уровне моделей спорили по бенчмаркам, где задачи уже побывали в обучающих данных. First Proof в июне дал четырём ИИ-системам 10 неопубликованных исследовательских задач, а решения вслепую отсмотрели живые математики. Проходной балл суммарно набрали 7 задач из 10 (arXiv, 16.06).
Стохастическое УрЧП одна из систем решила подходом, не похожим на человеческий, и рецензенты это отметили. На метрической геометрии ни одна система существенно не продвинулась. В приложениях к статье выложены сами задачи, человеческие решения, доказательства моделей и отчёты рецензентов: видно, на каком шаге модель поплыла.
Тот же замер Nature 12 июня подала другой стороной: до уровня топовых математиков модели не дотянули.
первоисточник