24 августа 2026 г.
Модель отвечает вчетверо быстрее: NVIDIA пустила Groq 3 LPX в серию
Стойки встанут в дата-центрах до конца 2026 года, а попробовать чип можно уже сейчас: в Nebius это смена модели, не миграция.

Замер Artificial Analysis: 3400 выходных токенов в секунду на Gemma 4 31B при контексте 100 000 токенов.
Это вчетверо быстрее ближайшей платформы. NVIDIA объявила о полномасштабном производстве Groq 3 LPX 24 августа, первые стойки выйдут в онлайн до конца 2026 года.
Почему быстро. GPU держит веса в HBM и гоняет данные через кэши, а планировщик решает всё на лету. LPU строится вокруг SRAM и управляет данными явно, поэтому задержка держится ровной. В стойке 256 ускорителей и 128 ГБ SRAM.
Что это даёт агенту. Агент гоняет десятки шагов подряд, и каждый шаг ждёт ответа модели. NVIDIA заявляет, что агентные задачи кодинга на Groq 3 LPX считаются за минуты вместо часов, а в связке с Vera Rubin NVL72 обещает до 35 раз больше пропускной способности на моделях с триллионом параметров.
Как попробовать. Первым чип разворачивает облако Nebius. В его Token Factory это смена модели, а не миграция: новый SDK, отдельный контракт с вендором и настройка биллинга не нужны, на старте работает подмножество моделей. Регистрация идёт на studio.nebius.ai, цены лежат в разделе тарифов Token Factory.
Чип вырос из лицензионной сделки NVIDIA с Groq на $20 млрд, подписанной 24 декабря 2025. Вместе с технологией в NVIDIA перешли основатель Jonathan Ross и президент Sunny Madra. От подписи до серийного производства прошло ровно восемь месяцев.
Первые стойки обещаны до конца 2026 года, тогда и появятся сторонние замеры на моделях крупнее Gemma 4.
Первоисточник