18 августа 2026 г.
Grok 4.6 делит первое место в рейтинге агентов: 59 баллов, вровень с Claude Opus 5 Max
Grok 4.6 набрал 59 баллов в Artificial Analysis Agentic Index и встал вровень с Claude Opus 5 Max (17.08). Одна задача обходится ему в $0,84.

Elon Musk
@elonmusk
Grok очень хорош в агентских задачах!
changis_k @changis_k
Агентская работа — там, где @grok 4.6 бьёт сильнее всего: он забрал первое место в Artificial Analysis Agentic Index с 59 баллами, вровень с Claude Opus 5 Max. Индекс меряет работу с инструментами, планирование, автономность и решение сложных задач, а не одиночные ответы. Grok 4.6 в среднем закрывает задачу за ~53 хода и ~0,5 млрд входных токенов, против ~103 ходов и ~2,0 млрд у Claude Opus 5 Max. Задача стоит $0,84, и это выводит его на границу Парето по связке «интеллект против цены за задачу». Компании, которые покупают агентов, платят за выполненную задачу, а не за балл в бенчмарке. Эффективность ходов и определяет, будет ли долго работающ

Grok 4.6 набрал 59 баллов в Artificial Analysis Agentic Index и встал вровень с Claude Opus 5 Max (17.08). Одна задача обходится ему в $0,84.
Компании, которые покупают агентов, платят за выполненную задачу, а не за балл в бенчмарке.
первоисточник