17 июля 2026 г.
Kimi K3 Max ошибся в статистике при аудите научных работ
Kimi K3 Max провалила сложный статистический аудит прежних научных работ: модель наделала ошибок, включая неверное применение статистических методов. Автор прогнал её на своих старых исследованиях. GPT-5.6 Pro разобрала выводы K3, и автор с этой критикой согласен.

Ethan Mollick
@emollick
Предостережение: скажу прямо - когда Kimi K3 Max делала сложный статистический аудит нескольких моих прежних академических работ, она ошибалась по-разному, включая неправильное применение статистики и просто небрежное обращение с рядом вещей. Кое-что из критики K3 от GPT-5.6 Pro (я с этим согласен):

· 62,7 тыс. просмотров
Почему это важно: Статистику LLM по-прежнему заваливает, даже топовая модель. Отдавать ей количественный аудит без ручной проверки рано. Здесь ошибки поймала другая модель, GPT-5.6 Pro, а не сам K3. Кросс-проверка вторым инструментом надёжнее доверия к одной модели.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Что дальше: Даёте LLM статистику или числовой аудит - прогоните её выводы второй моделью и проверьте методы руками. Полного разбора ошибок K3 в тексте твита нет.
Первоисточник