19 сентября 2026 г.
Стойка для ИИ-инференса доступна сейчас: GB300 NVL72 собрала 72 Blackwell Ultra GPU
На 19 сентября 2026 года GB300 NVL72 доступна через NVIDIA Contact Sales: в одной жидкостно охлаждаемой rack-scale системе стоят 72 Blackwell Ultra GPU и 36 Grace CPU. NVIDIA заявляет в 1,5 раза большую плотность FP4 Tensor Core FLOPS и вдвое выше производительность attention, чем у Blackwell GPU. В марте 2025 года компания планировала партнёрские поставки со второй половины 2025 года.

В марте 2025 года NVIDIA заявляла для GB300 NVL72 рост производительности ИИ в 1,5 раза относительно GB200 NVL72. Теперь система доступна, а для AI factories компания указывает до 50-кратного роста output performance по сравнению с платформами Hopper.
Память. На странице продукта указаны 37 TB fast memory, 20 TB GPU memory с пропускной способностью до 576 TB/s и 17 TB LPDDR5X CPU memory. В технической таблице от 19 марта fast memory указана как 40 TB, HBM как 20 TB, а сетевая пропускная способность как 14,4 TB/s. NVLink передаёт данные со скоростью до 130 TB/s.
Для inference. NVIDIA предлагает open-source Dynamo: он распределяет нагрузку по GPU-узлам и разделяет prefill и decode. Каждый GPU получает до 800 Gb/s через ConnectX-8 SuperNIC, а платформа работает с Quantum-X800 InfiniBand и Spectrum-X Ethernet.
Дальше место GB300 NVL72 в инфраструктуре определят реальные inference-замеры после поставок партнёрам.
Первоисточник
