Vera Rubin NVL72 в предварительных тестах MLPerf обошла GB300 NVL72 до 3,7 раза

NVIDIA впервые представила результаты Vera Rubin NVL72 в наборе тестов MLPerf Inference v6.1. В конфигурации с 72 ускорителями новая платформа показала до 3,7 раза более высокую пропускную способность, чем GB300 NVL72, однако результаты опубликованы в категории Preview.

NVIDIA опубликовала первые результаты платформы Vera Rubin NVL72 в тестах MLPerf Inference v6.1. При одинаковом масштабе в 72 ускорителя система превзошла GB300 NVL72 в задачах на модели Qwen3-VL в 1,8 раза в автономном режиме, в 1,9 раза в серверном и в 3,7 раза в интерактивном сценарии. В тестах DeepSeek-R1 преимущество составило соответственно 1,7, 1,9 и 2,5 раза.

Сравнение производительности NVIDIA Vera Rubin NVL72 и GB300 NVL72 в MLPerf Inference v6.1

Для Qwen3-VL использовались сервер vLLM и открытая платформа NVIDIA Dynamo, а для DeepSeek-R1 — библиотека TensorRT-LLM. NVIDIA связывает прирост с обновлёнными тензорными ядрами и Transformer Engine, форматом вычислений NVFP4, а также раздельной обработкой стадий prefill и decode.

MLCommons, организация-разработчик MLPerf, включила Vera Rubin NVL72 в категорию Preview. Она предназначена для ещё не выпущенных систем, которые по правилам теста должны быть представлены как доступные в следующем раунде, поэтому результаты пока не характеризуют серийное оборудование.

Источник: blogs.nvidia.com

Связь с редакцией