31 июля 2026 г.
Grok 4.5 обошла GPT-5.6 Terra почти во всех общих бенчмарках: лидер в ACB, GPQA, SWE-P и Atlas
31 июля Илон Маск позвал пробовать Grok 4.5 и поднял к себе пост, где модель обходит GPT-5.6 Terra почти во всех общих бенчмарках агрегатора AskClash. Лидерство заявлено в четырёх: ACB, GPQA, SWE-P и Atlas, плюс выше общий балл. Ссылка из твита ведёт на x.ai/cli.

Elon Musk
@elonmusk
Попробуйте Grok 4.5 http://X.ai/cli
СРОЧНО: Grok 4.5 обходит GPT-5.6 Terra почти во всех общих бенчмарках на AskClash, лидирует в ACB, GPQA, SWE-P и Atlas и берёт более высокий общий балл. 🔥

· 2,1 млн просмотров
Почему это важно: Обычно новую модель представляет сама лаборатория: пост в блоге, карточка, описание прогонов. Тут порядок другой. Цифры принёс сторонний агрегатор AskClash, сводку написал фан-аккаунт @cb_doge, а Маск её просто репостнул одной строкой. Сравнивали при этом только пересечение: те бенчмарки, которые прогнали обе модели, а не весь их набор. Для инженера это пока заявка, а не замер: как считали ACB и SWE-P, из твита не видно. Ссылка ведёт не в чат, а на CLI - Grok 4.5 зовут в терминал, рядом с код-агентами. О цене и лимитах в анонсе молчат.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Что дальше: Ждать карточку Grok 4.5 с методологией прогонов: без неё числа AskClash перепроверить нечем. Пока можно поставить x.ai/cli и прогнать один свой модуль рядом с текущим агентом на тех же задачах.
Первоисточник