21 сентября 2026 г.
Нейросети в денежных вопросах ошибаются чаще, чем отвечают верно: 57% ответов неверны
Британский финтех Saturn прогнал 18 моделей по 121 вопросу про деньги и разобрал больше 10 000 ответов.

Неверный ответ про налоги на пенсию стоил бы человеку счёта на 17 500 фунтов от британской налоговой.
Такие сценарии Saturn собрал в отчёте «Artificial Authority» (сентябрь 2026). Вопросы бытовые, от долгов и ипотеки до пенсий и студенческих кредитов. Каждый задавали модели по пять раз.
В среднем модели ошибались в 57% ответов. На сложных вопросах средняя доля ошибок поднимается до 88%, а до 99% доходят только отдельные модели.
Лучший результат показал Claude Opus 5 в режиме рассуждений, 39% неверных ответов. Хуже всех отвечал Claude Haiku 4.5, 82%.
ChatGPT 5.6 Luna ошибался в 58% ответов, Grok 4.5 в 59%, Gemini 3.1 Pro в 73%.
Платный тариф помогает. Бесплатные модели ошибались в 63% ответов, платные в 49%. На самых сложных вопросах бесплатные промахивались в 93% случаев.
Ошибки повторяются одни и те же: арифметика, пропущенные предупреждения о рисках, устаревшие налоговые правила и ссылки на нормы, которых не существует. В долговых сценариях модели советовали гасить сначала самые дорогие кредиты, а не аренду и муниципальный налог, то есть выводили человека на выселение и приставов.
Кто считал. Saturn не независимая лаборатория, а британский финтех 2023 года. Компания продаёт ИИ-платформу финансовым консультантам и подняла $15 млн.
Полный отчёт Saturn отдаёт только через форму на своём сайте.
Первоисточник
