- 시작
- 2026년 9월 16일신뢰도 95%mlcommons.org 제공
NVIDIA 베라 루빈 NVL72, MLPerf 추론 v6.1에서 데뷔
원문에서 자동 번역됨
원본 제목: NVIDIA Vera Rubin NVL72 Debuts in MLPerf Inference v6.1
- MLCommons는 2026년 9월 16일 MLPerf 추론 v6.1 결과를 발표했으며, 이는 프리뷰 부문에 제출된 NVIDIA 베라 루빈 NVL72의 첫 동료 심사 수치다[3][4]
- Qwen3-VL 기준 베라 루빈 NVL72는 NVIDIA 다이나모를 곁들인 vLLM을 사용해 오프라인·서버·인터랙티브 시나리오 전반에서 GB300 NVL72 대비 최대 3.7배의 처리량을 냈고, TensorRT-LLM을 사용한 DeepSeek-R1에서는 최대 2.5배를 기록했다[1]
- 베라 루빈을 제출한 유일한 다른 곳인 네비우스는 9개 노드에 걸친 36개 GPU로 DeepSeek R1을 구동해 서버 시나리오에서 GPU당 초당 1만6,427토큰을 기록했다[6]
- 4개 랙에 걸친 288개 GPU 규모의 GB300 NVL72 제출은 DeepSeek-R1에서 99%의 확장 효율을 달성했으며, 소프트웨어 개선으로 GB300 NVL72의 Qwen3-VL 성능은 v6.0 대비 최대 1.6배 향상됐다[1]
- 이번 라운드에는 역대 최다인 30개 기관이 참여했고 종단간 RAG와 엣지 에이전틱 추론 테스트가 추가됐다; DeepSeek R1의 가속기당 서버 최고 기록은 1년 전 대비 5.7배였다[4]
- NVIDIA가 주장하는 SemiAnalysis AgentX 기준 GB300 NVL72 대비 30배라는 수치는 MLPerf 밖의 프리뷰 테스트에서 나온 것으로 MLCommons의 검증을 받지 않았다[1][3]
- 결과는 MLCommons의 글로브뉴스와이어 배포자료를 통해 미 동부시간 오전 11시에 발표됐다[5]
주요 특징
- 랙 한 대에 루빈 GPU 72개와 베라 CPU 36개가 탑재되며 ConnectX-9 슈퍼NIC와 블루필드-4 DPU를 갖춘다[2]
- 랙당 1,400TB/s의 HBM4 20.7TB, 커스텀 올림푸스 CPU 코어 3,168개, LPDDR5X 최대 54TB를 갖춘다[2]
- 6세대 NVLink·NVLink 스위치를 갖춰 NVIDIA는 기성 이더넷 대비 패킷 처리율 10배, 지연시간 3분의 1이라고 밝힌다[1]
- NVFP4 정밀도와 향상된 텐서 코어·트랜스포머 엔진이 프리필과 디코드 속도를 모두 높인다[1]
- NVIDIA는 이를 GB200 NVL72 대비 백만 토큰당 비용의 10분의 1로 평가한다[2]
참고자료 6신뢰도 86%
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%blogs.nvidia.com/blog/vera-rubin-nvl72-mlperf-inferenceblogs.nvidia.com· 게시 2026년 9월 23일· 시작 2026년 9월 16일· 점수의 17%
MLCommons[4]는 2026년 9월 16일 MLPerf 추론 v6.1 결과를 발표했다 - 글로브뉴스와이어 배포자료는 'SAN FRANCISCO, Sept. 16, 2026'로 시작해 'AM EDT 11:00'로 표시돼 있고, NVIDIA[2]의 같은 날 게시물도 결과가 '오늘 공개됐다'고 밝히고 있다.
- [2]75%NVIDIA Vera Rubin NVL72nvidia.com· 추가 2026년 9월 23일· 점수의 17%
NVIDIA's[1] product page for the benchmarked system: 72 Rubin GPUs and 36 Vera CPUs per rack, 20.7 TB of HBM4 at 1,400 TB/s, 3,168 Olympus CPU cores, sixth-generation NVLink, and one-tenth the cost per million tokens of GB200 NVL72.
- [3]80%MLPerf v6.1 Puts First Peer-Reviewed Numbers on Vera Rubin: Software Gains Beat New Hardwaretechtimes.com· 게재 2026년 9월 17일· 점수의 17%
Independent analysis of the round 'published September 16, 2026': Vera Rubin NVL72 was entered in the Preview category reserved for platforms due to ship by the next round, 30 organizations produced 486 results, and NVIDIA's[1][2] 30x AgentX figure is separate from, and not verified by, MLCommons[4].
- [4]95%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Resultsmlcommons.org· 게재 2026년 9월 16일· 시작 2026년 9월 16일 ✓· 점수의 17%
MLCommons' own announcement of the v6.1 round, dated September 16, 2026: a record 30 submitting organizations, two new tests (End-to-End RAG and Edge Agentic Inference), up to 5.7x on DeepSeek R1 versus a year earlier, and 'NVIDIA[1][2] Rubin and NVIDIA Vera Rubin NVL72 is in preview' among five new processors.
- [5]90%MLCommons Sets Participation Record with New MLPerf Inference v6.1 Benchmark Results (GlobeNewswire)financialcontent.com· 게재 2026년 9월 16일· 점수의 17%
The GlobeNewswire copy of MLCommons[4]' release, datelined 'SAN FRANCISCO, Sept. 16, 2026 (GLOBE NEWSWIRE)' and stamped 11:00 AM EDT, which gives the publication time of the results.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다.