- Bắt đầu
- 16 thg 9, 2026ĐỘ TIN CẬY 95%từ mlcommons.org
NVIDIA Vera Rubin NVL72 ra mắt trong MLPerf Inference v6.1
Được dịch tự động từ bản gốc
Tiêu đề gốc: NVIDIA Vera Rubin NVL72 Debuts in MLPerf Inference v6.1
- MLCommons đã công bố kết quả MLPerf Inference v6.1 vào ngày 16 tháng 9 năm 2026, những con số được thẩm định đầu tiên cho Vera Rubin NVL72 của NVIDIA, sản phẩm được tham gia ở hạng mục xem trước[3][4]
- Trên Qwen3-VL, Vera Rubin NVL72 đạt thông lượng gấp tới 3.7 lần GB300 NVL72 trong các kịch bản ngoại tuyến, máy chủ và tương tác khi dùng vLLM với NVIDIA Dynamo, và gấp tới 2.5 lần trên DeepSeek-R1 khi dùng TensorRT-LLM[1]
- Nebius, đơn vị nộp Vera Rubin duy nhất khác, chạy DeepSeek R1 trên 36 GPU qua chín nút và đạt 16,427 token/s mỗi GPU trong kịch bản máy chủ[6]
- Một bản nộp GB300 NVL72 gồm 288 GPU trên bốn giá máy đạt hiệu suất mở rộng 99% trên DeepSeek-R1, và công việc phần mềm đã nâng GB300 NVL72 trên Qwen3-VL lên tới 1.6 lần so với v6.0[1]
- Vòng này thu hút kỷ lục 30 tổ chức nộp kết quả và bổ sung các bài kiểm tra End-to-End RAG và Edge Agentic Inference; kết quả máy chủ trên mỗi bộ tăng tốc tốt nhất của DeepSeek R1 gấp 5.7 lần một năm trước[4]
- Tuyên bố của NVIDIA về mức gấp 30 lần GB300 NVL72 trên SemiAnalysis AgentX đến từ thử nghiệm xem trước ngoài MLPerf và chưa được MLCommons xác minh[1][3]
- Kết quả được công bố lúc 11:00 sáng EDT thông qua thông cáo GlobeNewswire của MLCommons[5]
Tính năng đáng chú ý
- Một giá máy chứa 72 GPU Rubin và 36 CPU Vera, với ConnectX-9 SuperNIC và BlueField-4 DPU[2]
- 20.7 TB HBM4 ở tốc độ 1,400 TB/s, 3,168 nhân CPU Olympus tùy chỉnh và tới 54 TB LPDDR5X mỗi giá máy[2]
- NVLink và NVLink Switch thế hệ thứ sáu, mà NVIDIA nói mang lại tốc độ gói tin cao hơn 10 lần và độ trễ thấp hơn 3 lần so với Ethernet thông thường[1]
- Độ chính xác NVFP4 cùng Tensor Core và Transformer Engine được cải tiến giúp tăng tốc cả giai đoạn prefill lẫn decode[1]
- NVIDIA đánh giá chi phí trên mỗi triệu token chỉ bằng một phần mười so với GB200 NVL72[2]
Tài liệu tham khảo 6ĐỘ TIN CẬY 86%Độ tin cậy tổng thể: 86%Mức độ nguồn và tài liệu tham khảo của ghim củng cố các ngày của nó.Trung bình có trọng số về mức độ 6 tài liệu, gồm cả nguồn, ủng hộ thời điểm bắt đầu và kết thúc của ghim; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhấtHiện tất cả ghim có độ tin cậy từ 75% trở lên
Mục đầu tiên luôn là nguồn của ghim. Độ tin cậy tổng thể là trung bình có trọng số về mức độ mỗi tài liệu ủng hộ thời điểm bắt đầu và kết thúc được dùng ở trên; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhất.
- [1]90%blogs.nvidia.com/blog/vera-rubin-nvl72-mlperf-inferenceblogs.nvidia.com· Đăng 23 thg 9, 2026· Bắt đầu 16 thg 9, 2026· 17% điểm số
MLCommons[4] đã công bố kết quả MLPerf Inference v6.1 vào ngày 16 tháng 9 năm 2026 - thông cáo GlobeNewswire của tổ chức này đề “SAN FRANCISCO, ngày 16 tháng 9 năm 2026” và đóng dấu “11:00 SÁNG EDT” - và bài đăng cùng ngày của NVIDIA[2] nói kết quả “được công bố hôm nay”.
- [2]75%NVIDIA Vera Rubin NVL72nvidia.com· Thêm 23 thg 9, 2026· 17% điểm số
NVIDIA's[1] product page for the benchmarked system: 72 Rubin GPUs and 36 Vera CPUs per rack, 20.7 TB of HBM4 at 1,400 TB/s, 3,168 Olympus CPU cores, sixth-generation NVLink, and one-tenth the cost per million tokens of GB200 NVL72.
- [3]80%MLPerf v6.1 Puts First Peer-Reviewed Numbers on Vera Rubin: Software Gains Beat New Hardwaretechtimes.com· Xuất bản 17 thg 9, 2026· 17% điểm số
Independent analysis of the round 'published September 16, 2026': Vera Rubin NVL72 was entered in the Preview category reserved for platforms due to ship by the next round, 30 organizations produced 486 results, and NVIDIA's[1][2] 30x AgentX figure is separate from, and not verified by, MLCommons[4].
- [4]95%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Resultsmlcommons.org· Xuất bản 16 thg 9, 2026· Bắt đầu 16 thg 9, 2026 ✓· 17% điểm số
MLCommons' own announcement of the v6.1 round, dated September 16, 2026: a record 30 submitting organizations, two new tests (End-to-End RAG and Edge Agentic Inference), up to 5.7x on DeepSeek R1 versus a year earlier, and 'NVIDIA[1][2] Rubin and NVIDIA Vera Rubin NVL72 is in preview' among five new processors.
- [5]90%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Results (GlobeNewswire)financialcontent.com· Xuất bản 16 thg 9, 2026· 17% điểm số
The GlobeNewswire copy of MLCommons[4]' release, datelined 'SAN FRANCISCO, Sept. 16, 2026 (GLOBE NEWSWIRE)' and stamped 11:00 AM EDT, which gives the publication time of the results.
Đề xuất chỉnh sửa
Thiếu hay sai điều gì? Hãy nói bằng lời của bạn: một liên kết củng cố ghim này, một ngày bắt đầu hoặc kết thúc khác kèm lý do, hoặc một thông tin còn thiếu hay sai. AI đối chiếu với các nguồn của ghim này, tìm nguồn tốt hơn và thêm mọi trang ủng hộ bạn. Các nguồn của chính ghim vẫn được tính nhiều nhất. Hình ảnh thể hiện nội dung khác hoặc thể hiện kém cũng được xem xét, rồi bị hạ xuống hoặc thay thế.