- Начало
- 16 сент. 2026 г.ДОСТОВЕРНОСТЬ 95%от mlcommons.org
Vera Rubin NVL72 от NVIDIA дебютирует в MLPerf Inference v6.1
Автоматический перевод оригинала
Оригинальное название: NVIDIA Vera Rubin NVL72 Debuts in MLPerf Inference v6.1
- MLCommons опубликовал результаты MLPerf Inference v6.1 16 сентября 2026 г. - первые рецензируемые показатели Vera Rubin NVL72 от NVIDIA, заявленной в категории предварительных (preview)[3][4]
- На Qwen3-VL Vera Rubin NVL72 показала до 3,7 раза большую пропускную способность, чем GB300 NVL72, в сценариях offline, server и interactive при использовании vLLM с NVIDIA Dynamo, и до 2,5 раза на DeepSeek-R1 при использовании TensorRT-LLM[1]
- Nebius, единственный другой участник с Vera Rubin, запустила DeepSeek R1 на 36 GPU в девяти узлах и показала 16 427 токенов/с на GPU в сценарии server[6]
- Заявка на 288 GPU GB300 NVL72 в четырёх стойках достигла 99% эффективности масштабирования на DeepSeek-R1, а программные доработки подняли GB300 NVL72 на Qwen3-VL до 1,6 раза по сравнению с v6.0[1]
- В раунде участвовало рекордное число организаций - 30 - и добавились тесты End-to-End RAG и Edge Agentic Inference; лучший результат DeepSeek R1 на ускоритель в сценарии server был в 5,7 раза выше, чем годом ранее[4]
- Заявление NVIDIA о превосходстве в 30 раз над GB300 NVL72 на SemiAnalysis AgentX основано на предварительном тестировании вне MLPerf и не проверено MLCommons[1][3]
- Результаты опубликованы в 11:00 по восточному летнему времени через релиз MLCommons на GlobeNewswire[5]
Основные особенности
- В одной стойке 72 GPU Rubin и 36 процессоров Vera, с ConnectX-9 SuperNIC и BlueField-4 DPU[2]
- 20,7 ТБ HBM4 со скоростью 1 400 ТБ/с, 3 168 специализированных ядер Olympus и до 54 ТБ LPDDR5X на стойку[2]
- NVLink и NVLink Switch шестого поколения, которые, по словам NVIDIA, обеспечивают в 10 раз большую частоту пакетов и в 3 раза меньшую задержку, чем готовая Ethernet[1]
- Точность NVFP4 и улучшенные Tensor Cores и Transformer Engine ускоряют и prefill, и decode[1]
- NVIDIA оценивает её стоимость на миллион токенов в одну десятую от GB200 NVL72[2]
Источники 6ДОСТОВЕРНОСТЬ 86%Общая достоверность: 86%Насколько источник и ссылки пина подтверждают его даты.Взвешенное среднее того, насколько 6 источников, включая основной, подтверждают время начала и окончания пина; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новымПоказать все пины с достоверностью 75% и выше
Первая запись — всегда источник пина. Общая достоверность — это взвешенное среднее того, насколько каждый источник подтверждает указанные выше время начала и окончания; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новым.
- [1]90%blogs.nvidia.com/blog/vera-rubin-nvl72-mlperf-inferenceblogs.nvidia.com· Размещено 23 сент. 2026 г.· Начало 16 сент. 2026 г.· 17% оценки
MLCommons[4] опубликовал результаты MLPerf Inference v6.1 16 сентября 2026 г. - его релиз на GlobeNewswire датирован «САН-ФРАНЦИСКО, 16 сент. 2026 г.» и помечен «11:00 по восточному летнему времени», - а публикация NVIDIA[2] в тот же день сообщает, что результаты «опубликованы сегодня».
- [2]75%NVIDIA Vera Rubin NVL72nvidia.com· Добавлено 23 сент. 2026 г.· 17% оценки
NVIDIA's[1] product page for the benchmarked system: 72 Rubin GPUs and 36 Vera CPUs per rack, 20.7 TB of HBM4 at 1,400 TB/s, 3,168 Olympus CPU cores, sixth-generation NVLink, and one-tenth the cost per million tokens of GB200 NVL72.
- [3]80%MLPerf v6.1 Puts First Peer-Reviewed Numbers on Vera Rubin: Software Gains Beat New Hardwaretechtimes.com· Опубликовано 17 сент. 2026 г.· 17% оценки
Independent analysis of the round 'published September 16, 2026': Vera Rubin NVL72 was entered in the Preview category reserved for platforms due to ship by the next round, 30 organizations produced 486 results, and NVIDIA's[1][2] 30x AgentX figure is separate from, and not verified by, MLCommons[4].
- [4]95%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Resultsmlcommons.org· Опубликовано 16 сент. 2026 г.· Начало 16 сент. 2026 г. ✓· 17% оценки
MLCommons' own announcement of the v6.1 round, dated September 16, 2026: a record 30 submitting organizations, two new tests (End-to-End RAG and Edge Agentic Inference), up to 5.7x on DeepSeek R1 versus a year earlier, and 'NVIDIA[1][2] Rubin and NVIDIA Vera Rubin NVL72 is in preview' among five new processors.
- [5]90%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Results (GlobeNewswire)financialcontent.com· Опубликовано 16 сент. 2026 г.· 17% оценки
The GlobeNewswire copy of MLCommons[4]' release, datelined 'SAN FRANCISCO, Sept. 16, 2026 (GLOBE NEWSWIRE)' and stamped 11:00 AM EDT, which gives the publication time of the results.
Предложить исправление
Чего-то не хватает или есть ошибка? Напишите своими словами: ссылку, подтверждающую этот пин, другую дату начала или окончания и почему, или факт, которого нет или который неверен. ИИ сверит это с источниками пина, поищет лучшие и добавит любую страницу, которая вас подтверждает. Собственные источники пина всё равно весят больше всего. Изображение, на котором показано что-то другое или показано плохо, тоже проверяется и опускается ниже или заменяется.