- शुरुआत
- 16 सित॰ 202695% कॉन्फ़िडेंसmlcommons.org से
NVIDIA Vera Rubin NVL72 का MLPerf Inference v6.1 में डेब्यू
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: NVIDIA Vera Rubin NVL72 Debuts in MLPerf Inference v6.1
- MLCommons ने 16 सितंबर 2026 को MLPerf Inference v6.1 के नतीजे प्रकाशित किए, जो NVIDIA के Vera Rubin NVL72 के लिए पहले पीयर-रिव्यूड आंकड़े थे, इसे प्रीव्यू श्रेणी में शामिल किया गया था[3][4]
- Qwen3-VL पर, Vera Rubin NVL72 ने ऑफलाइन, सर्वर और इंटरैक्टिव परिदृश्यों में vLLM के साथ NVIDIA Dynamo का उपयोग करते हुए GB300 NVL72 की तुलना में 3.7 गुना तक थ्रूपुट दिया, और TensorRT-LLM का उपयोग करते हुए DeepSeek-R1 पर 2.5 गुना तक[1]
- Nebius, जो एकमात्र अन्य Vera Rubin सबमिटर था, ने नौ नोड्स में 36 GPU पर DeepSeek R1 चलाया और सर्वर परिदृश्य में प्रति GPU 16,427 टोकन/सेकंड दर्ज किए[6]
- चार रैक में फैले 288-GPU GB300 NVL72 सबमिशन ने DeepSeek-R1 पर 99% स्केलिंग दक्षता हासिल की, और सॉफ्टवेयर सुधारों ने Qwen3-VL पर GB300 NVL72 को v6.0 की तुलना में 1.6 गुना तक बढ़ाया[1]
- इस राउंड में रिकॉर्ड 30 सबमिट करने वाले संगठन शामिल हुए और End-to-End RAG तथा Edge Agentic Inference टेस्ट जोड़े गए; प्रति-एक्सेलेरेटर सर्वर का सबसे अच्छा DeepSeek R1 नतीजा एक साल पहले की तुलना में 5.7 गुना था[4]
- SemiAnalysis AgentX पर GB300 NVL72 से 30 गुना बेहतर होने का NVIDIA का दावा MLPerf के बाहर की गई प्रीव्यू टेस्टिंग पर आधारित है और MLCommons द्वारा सत्यापित नहीं है[1][3]
- नतीजे MLCommons के GlobeNewswire रिलीज़ के जरिए सुबह 11:00 बजे EDT पर प्रकाशित किए गए[5]
उल्लेखनीय विशेषताएं
- एक रैक में 72 Rubin GPU और 36 Vera CPU होते हैं, साथ ही ConnectX-9 सुपरNIC और BlueField-4 DPU[2]
- 1,400 TB/s पर 20.7 TB का HBM4, 3,168 कस्टम Olympus CPU कोर और प्रति रैक 54 TB तक LPDDR5X[2]
- छठी पीढ़ी का NVLink और NVLink Switch, जिसके बारे में NVIDIA का कहना है कि यह ऑफ-द-शेल्फ Ethernet की तुलना में 10 गुना अधिक पैकेट दर और 3 गुना कम लेटेंसी देता है[1]
- NVFP4 प्रिसिज़न और उन्नत Tensor Cores तथा Transformer Engine प्रीफिल और डिकोड दोनों को तेज़ करते हैं[1]
- NVIDIA के अनुसार, इसकी प्रति मिलियन टोकन लागत GB200 NVL72 की तुलना में दसवां हिस्सा है[2]
संदर्भ 686% कॉन्फ़िडेंसकुल भरोसा: 86%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 6 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%blogs.nvidia.com/blog/vera-rubin-nvl72-mlperf-inferenceblogs.nvidia.com· 23 सित॰ 2026 को पोस्ट किया गया· शुरुआत 16 सित॰ 2026· स्कोर का 17%
MLCommons[4] ने MLPerf Inference v6.1 के नतीजे 16 सितंबर 2026 को प्रकाशित किए - इसके GlobeNewswire रिलीज़ की डेटलाइन 'SAN FRANCISCO, Sept. 16, 2026' है और उस पर '11:00 AM EDT' अंकित है - और उसी दिन NVIDIA[2] की पोस्ट कहती है कि नतीजे 'released today' थे।
- [2]75%NVIDIA Vera Rubin NVL72nvidia.com· 23 सित॰ 2026 को जोड़ा गया· स्कोर का 17%
NVIDIA's[1] product page for the benchmarked system: 72 Rubin GPUs and 36 Vera CPUs per rack, 20.7 TB of HBM4 at 1,400 TB/s, 3,168 Olympus CPU cores, sixth-generation NVLink, and one-tenth the cost per million tokens of GB200 NVL72.
- [3]80%MLPerf v6.1 Puts First Peer-Reviewed Numbers on Vera Rubin: Software Gains Beat New Hardwaretechtimes.com· 17 सित॰ 2026 को प्रकाशित· स्कोर का 17%
Independent analysis of the round 'published September 16, 2026': Vera Rubin NVL72 was entered in the Preview category reserved for platforms due to ship by the next round, 30 organizations produced 486 results, and NVIDIA's[1][2] 30x AgentX figure is separate from, and not verified by, MLCommons[4].
- [4]95%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Resultsmlcommons.org· 16 सित॰ 2026 को प्रकाशित· शुरुआत 16 सित॰ 2026 ✓· स्कोर का 17%
MLCommons' own announcement of the v6.1 round, dated September 16, 2026: a record 30 submitting organizations, two new tests (End-to-End RAG and Edge Agentic Inference), up to 5.7x on DeepSeek R1 versus a year earlier, and 'NVIDIA[1][2] Rubin and NVIDIA Vera Rubin NVL72 is in preview' among five new processors.
- [5]90%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Results (GlobeNewswire)financialcontent.com· 16 सित॰ 2026 को प्रकाशित· स्कोर का 17%
The GlobeNewswire copy of MLCommons[4]' release, datelined 'SAN FRANCISCO, Sept. 16, 2026 (GLOBE NEWSWIRE)' and stamped 11:00 AM EDT, which gives the publication time of the results.
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।