- Inizio
- 16 set 2026AFFIDABILITÀ 95%da mlcommons.org
NVIDIA Vera Rubin NVL72 debutta in MLPerf Inference v6.1
Tradotto automaticamente dall’originale
Titolo originale: NVIDIA Vera Rubin NVL72 Debuts in MLPerf Inference v6.1
- Il 16 settembre 2026 MLCommons ha pubblicato i risultati di MLPerf Inference v6.1, i primi numeri sottoposti a revisione paritaria per il Vera Rubin NVL72 di NVIDIA, iscritto nella categoria preview[3][4]
- Su Qwen3-VL, Vera Rubin NVL72 ha offerto fino a 3,7 volte il throughput di GB300 NVL72 negli scenari offline, server e interattivo usando vLLM con NVIDIA Dynamo, e fino a 2,5 volte su DeepSeek-R1 usando TensorRT-LLM[1]
- Nebius, l'unico altro partecipante con Vera Rubin, ha eseguito DeepSeek R1 su 36 GPU in nove nodi e ha registrato 16.427 token/s per GPU nello scenario server[6]
- Una sottomissione GB300 NVL72 da 288 GPU su quattro rack ha raggiunto il 99% di efficienza di scalabilità su DeepSeek-R1, e il lavoro sul software ha aumentato GB300 NVL72 su Qwen3-VL fino a 1,6 volte rispetto alla v6.0[1]
- Il round ha richiamato il record di 30 organizzazioni partecipanti e ha aggiunto i test End-to-End RAG ed Edge Agentic Inference; il miglior risultato server per acceleratore su DeepSeek R1 è stato 5,7 volte quello di un anno prima[4]
- L'affermazione di NVIDIA di un vantaggio di 30 volte su GB300 NVL72 su SemiAnalysis AgentX deriva da test in preview al di fuori di MLPerf e non è verificata da MLCommons[1][3]
- I risultati sono stati pubblicati alle 11:00 EDT tramite il comunicato GlobeNewswire di MLCommons[5]
Funzionalità principali
- Un rack contiene 72 GPU Rubin e 36 CPU Vera, con SuperNIC ConnectX-9 e DPU BlueField-4[2]
- 20,7 TB di HBM4 a 1.400 TB/s, 3.168 core CPU Olympus personalizzati e fino a 54 TB di LPDDR5X per rack[2]
- NVLink di sesta generazione e NVLink Switch, che secondo NVIDIA offrono frequenze di pacchetti 10 volte superiori e latenza 3 volte inferiore rispetto a Ethernet standard[1]
- La precisione NVFP4 e i Tensor Core e il Transformer Engine potenziati accelerano sia il prefill sia il decode[1]
- NVIDIA lo valuta a un decimo del costo per milione di token di GB200 NVL72[2]
Fonti 6AFFIDABILITÀ 86%Affidabilità complessiva: 86%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 6 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]90%blogs.nvidia.com/blog/vera-rubin-nvl72-mlperf-inferenceblogs.nvidia.com· Postato il 23 set 2026· Inizio 16 set 2026· 17% del punteggio
MLCommons[4] ha pubblicato i risultati di MLPerf Inference v6.1 il 16 settembre 2026 - il suo comunicato GlobeNewswire è datato «SAN FRANCISCO, 16 sett. 2026» e riporta l'orario «11:00 EDT» - e il post di NVIDIA[2] dello stesso giorno dice che i risultati sono stati «pubblicati oggi».
- [2]75%NVIDIA Vera Rubin NVL72nvidia.com· Aggiunto il 23 set 2026· 17% del punteggio
NVIDIA's[1] product page for the benchmarked system: 72 Rubin GPUs and 36 Vera CPUs per rack, 20.7 TB of HBM4 at 1,400 TB/s, 3,168 Olympus CPU cores, sixth-generation NVLink, and one-tenth the cost per million tokens of GB200 NVL72.
- [3]80%MLPerf v6.1 Puts First Peer-Reviewed Numbers on Vera Rubin: Software Gains Beat New Hardwaretechtimes.com· Pubblicato il 17 set 2026· 17% del punteggio
Independent analysis of the round 'published September 16, 2026': Vera Rubin NVL72 was entered in the Preview category reserved for platforms due to ship by the next round, 30 organizations produced 486 results, and NVIDIA's[1][2] 30x AgentX figure is separate from, and not verified by, MLCommons[4].
- [4]95%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Resultsmlcommons.org· Pubblicato il 16 set 2026· Inizio 16 set 2026 ✓· 17% del punteggio
MLCommons' own announcement of the v6.1 round, dated September 16, 2026: a record 30 submitting organizations, two new tests (End-to-End RAG and Edge Agentic Inference), up to 5.7x on DeepSeek R1 versus a year earlier, and 'NVIDIA[1][2] Rubin and NVIDIA Vera Rubin NVL72 is in preview' among five new processors.
- [5]90%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Results (GlobeNewswire)financialcontent.com· Pubblicato il 16 set 2026· 17% del punteggio
The GlobeNewswire copy of MLCommons[4]' release, datelined 'SAN FRANCISCO, Sept. 16, 2026 (GLOBE NEWSWIRE)' and stamped 11:00 AM EDT, which gives the publication time of the results.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.