Новости · 14 августа 2026 г.
Grok 4.6 вышел на первое место бенчмарка Cursor: 70,8% против 70,5% у Claude Fable 5
Отрыв 0,3 пункта, и рейтинг ведёт сам Cursor: агрегатор BenchLM не учитывает его в сводном зачёте моделей.

Elon Musk
@elonmusk
Grok 4.6 занимает первое место в CursorBench по реальным задачам кодинга
Grok 4.6 только что вышел на первое место в CursorBench 3.2 Обошёл Claude Fable 5, Opus 5 и GPT-5.6 Sol по реальным задачам кодинга И что совсем безумно, так это эффективность.... на графике результат CursorBench против средней стоимости задачи, и Grok 4.6 сидит на самой вершине фронтира Grok 4.6 безумно хорош в кодинге.... выдаёт кодинг уровня фронтира за смешные деньги

На запуске 12.08 Grok 4.6 не был первым даже в собственном анонсе SpaceXAI. Через два дня таблица перевернулась.
В день релиза компания показывала у модели 69,9% на CursorBench v3.2, а выше стояла Fable 5 Max с 70,5%. В публичном снапшоте от 14.08 у Grok 4.6 уже 70,8%: первое место из 16 моделей. Claude Opus 5 идёт третьим с 70,0%, GPT-5.6 Sol - четвёртым с 67,2%.
Чему верить. CursorBench - бенчмарк самого Cursor. Агрегатор BenchLM помечает его как first-party и не учитывает в сводном рейтинге моделей, а по предыдущему Grok 4.5 Cursor публиковал оговорку о контаминации: задачи теста могли попасть в обучение.
Рывок против Grok 4.5 виден и на сторонних агентных наборах. DeepSWE v1.1 вырос с 54% до 65,9%, Terminal-Bench v3.0 поднялся с 15,7% до 26%. До лидеров терминальной агентики отсюда далеко: GPT-5.6 Sol держит на Terminal-Bench 34,6%, Fable 5 даёт 34,1%.
Где попробовать. Grok 4.6 стоит в Cursor на индивидуальных и командных планах, в Grok Build и в API под именем grok-4.6 с контекстом 500 тысяч токенов. Цена не менялась с Grok 4.5: $2 за миллион входных токенов, $6 за миллион выходных.
Скидка 50% и двойной включённый лимит в Cursor и Grok Build действуют до 19.08 - дальше обычные $2 и $6 за миллион токенов.
первоисточник