./новости · 31 июля 2026 г.
новость
Grok 4.5 обошла GPT-5.6 Terra почти во всех общих бенчмарках: лидер в ACB, GPQA, SWE-P и Atlas
источник: @elonmusk · X·
машинная выжимка · сверена с источником

Elon Musk
@elonmusk
Попробуйте Grok 4.5 http://X.ai/cli
СРОЧНО: Grok 4.5 обходит GPT-5.6 Terra почти во всех общих бенчмарках на AskClash, лидирует в ACB, GPQA, SWE-P и Atlas и берёт более высокий общий балл. 🔥

· 749,8 тыс. просмотров
31 июля Илон Маск позвал пробовать Grok 4.5 и поднял к себе пост, где модель обходит GPT-5.6 Terra почти во всех общих бенчмарках агрегатора AskClash. Лидерство заявлено в четырёх: ACB, GPQA, SWE-P и Atlas, плюс выше общий балл. Ссылка из твита ведёт на x.ai/cli.
Почему это важно: Обычно новую модель представляет сама лаборатория: пост в блоге, карточка, описание прогонов. Тут порядок другой. Цифры принёс сторонний агрегатор AskClash, сводку написал фан-аккаунт @cb_doge, а Маск её просто репостнул одной строкой. Сравнивали при этом только пересечение: те бенчмарки, которые прогнали обе модели, а не весь их набор. Для инженера это пока заявка, а не замер: как считали ACB и SWE-P, из твита не видно. Ссылка ведёт не в чат, а на CLI - Grok 4.5 зовут в терминал, рядом с код-агентами. О цене и лимитах в анонсе молчат.
Что дальше: Ждать карточку Grok 4.5 с методологией прогонов: без неё числа AskClash перепроверить нечем. Пока можно поставить x.ai/cli и прогнать один свой модуль рядом с текущим агентом на тех же задачах.
первоисточник