15 сентября 2026 г.
ИИ-фабрики смогут считать больше на том же мегаватте: до 40% прироста GPU-мощности
15 сентября 2026 года NVIDIA показала рост token throughput на 24% в кластере Lambda из 5 стоек и 19 HGX B200. 19 узлов уложились в тот же power budget, где раньше работали 16 узлов на полной мощности. В демонстрации Emerald AI Conductor снизил потребление AI-фабрики с 4 до 3 МВт менее чем за минуту, пока критический inference продолжал работать без оператора.

Lambda держала 16 узлов на полной мощности. Теперь DSX MaxLPS размещает 19 узлов в том же бюджете, а производительность на ватт выросла на 23%. В чистом inference-тесте throughput поднялся примерно с 4,04 млн до 5 млн tokens/sec.
Один рычаг. DSX MaxLPS перераспределяет мощность между GPU, стойками и рабочими нагрузками. В смешанном кластере из 10 inference- и 10 training-узлов политика на 80% подняла throughput на 20% и 17% соответственно.
Как начать. DSX Flex принимает сигналы о снижении нагрузки, спросе на электричество и ценах, затем урезает низкоприоритетные задачи. NVIDIA отправляет за практическим стартом в документацию DSX, а Dynamic Power Software доступен для одобренных early-preview проектов.
Для Vera Rubin NVL72 NVIDIA прогнозирует до 40% больше GPU-мощности в том же мегаваттном бюджете при подходящих условиях размещения.
Первоисточник
