- 시작
- 2026년 7월 21일신뢰도 90%출처 제공
엔비디아 베라 루빈 시스템, 출하 시작
원문에서 자동 번역됨
원본 제목: Nvidia Vera Rubin Systems Begin Shipping
엔비디아는 베라 루빈 NVL72 랙 시스템이 이제 클라우드 업체와 시스템 제조사에 출하되고 있으며, GPU당 288GB의 HBM4를 탑재하고 블랙웰 대비 추론 성능이 약 5배라고 밝혔다.
- 7월 21일 엔비디아는 베라 루빈 플랫폼이 완전 양산 단계에 이르렀다고 확인했다. 가속 컴퓨팅 담당 부사장 이언 벅은 엔비디아 본사에서 취재진에게 오픈AI, 코어위브, 구글 클라우드, 마이크로소프트 애저, 메타, 델을 포함한 고객에게 시스템이 이제 출하되고 있다고 말했다[1]
- 엔비디아는 5월 31일 GTC 타이베이에서 해당 플랫폼이 완전 양산으로 증산되고 있으며, 대만의 주요 서버 제조사들이 베라 루빈 기반 시스템을 대규모로 생산하고 있다고 밝힌 바 있다[1]
- 출하 시점을 두고 출처마다 다르다. 5월 31일자 뉴스룸 발표를[1] 인용하면 "베라 루빈의 양산 출하는 이번 가을부터 시작될 예정"이라고 돼 있었지만, 7월 21일 브리핑에서는 이미 출하가 이뤄지고 있었다고 한다. 더 최근 정보는 출하가 시작됐다는 쪽이다[1]
- 출시 시점의 양산 상태에 대해서도 서로 다르다. 2026년 1월 5일자 CES 보도자료는 이미 "엔비디아 루빈은 완전 양산 중이며, 루빈 기반 제품은 2026년 하반기부터 파트너사를 통해 제공될 것"이라고 밝혔다[2]이며, 같은 행사를 다룬 서브더홈의 보도는 이를 "'모든 것이 예정대로'라는 식의 발표"라고 부르며 "하드웨어는 아직 출하되지 않았고, 양산 증산은 하반기가 돼야 시작될 것"이라고 지적했다[3]
- 칩 개수에 대한 설명도 일관되지 않는다. CES 자료 두 곳 모두 베라 CPU, 루빈 GPU, NVLink 6 스위치, ConnectX-9 슈퍼NIC, BlueField-4 DPU, Spectrum-6 이더넷 스위치 등 여섯 개의 신규 칩을 소개했다[2][3] 하지만 이와 달리[1] 이 매체는 2026년 3월 16일 새너제이 GTC에서 엔비디아가 엔비디아 그록 3 LPU를 더해 완전 양산 중인 칩이 일곱 개로 늘었다고 발표했다고 전하면서도, 같은 기사의 다른 부분에서는 여전히 여섯 개라고 언급한다[1]
- 루빈 기반 제품은 2026년 하반기 파트너사를 통해 제공될 예정이며, AWS·구글 클라우드·마이크로소프트·OCI가 초기 퍼블릭 클라우드에 포함되고, 엔비디아 클라우드 파트너인 코어위브·람다·네비우스·엔스케일도 함께한다[1][2][3]
- 마이크로소프트는 향후 페어워터 AI 슈퍼팩토리 부지를 포함한 차세대 AI 데이터센터에 베라 루빈 NVL72 랙 스케일 시스템을 배치할 예정이며, 이는 "수십만 대의 엔비디아 베라 루빈 슈퍼칩 규모로 확장될 것"이다[1][2]
- 이 하드웨어를 가장 먼저 받은 클라우드 업체 중 하나인 코어위브는 블룸버그에 자사의 NVL72 랙이 이전 세대보다 10배 많은 토큰을 출력하고 있다고 말했다[1]
- 델 테크놀로지스, HPE, 레노버, 슈퍼마이크로와 함께 아수스, 폭스콘, 기가바이트, 페가트론, 콴타 클라우드 테크놀로지, 위스트론, 위윈이 베라 루빈 증산을 가속하기 위해 엔비디아 DSX를 도입하고 있다[1]
- 엔비디아는 블랙웰 출시부터 루빈 양산까지 18개월이라는 공격적인 개발 주기를 거쳤는데, 이는 통상 이런 전환에 걸리는 24~30개월보다 짧다[1]
- CES 보도자료에는 미래 예측 진술 관련 고지가 포함돼 있으며 "여기서 설명하는 다수의 제품과 기능은 아직 여러 단계에 있으며, 제공 가능 여부와 시점에 따라 출시될 것"이라고 경고한다[2]
주요 특징
- 플래그십 베라 루빈 NVL72 랙은 루빈 GPU 72개와 베라 CPU 36개를 NVLink 6로 연결하고, ConnectX-9 슈퍼NIC와 BlueField-4 DPU를 갖췄다[1][2][3]
- 루빈 GPU 한 개당 HBM4 메모리 288GB를 탑재하며 대역폭은 최대 22TB/s로, 블랙웰 울트라 B300의 8TB/s보다 크다[1]; 서브더홈은 같은 288GB와 초당 22TB를 블랙웰 HBM3e 대역폭의 2.8배로 설명하며, TSMC 3나노 공정으로 만든 3,360억 개 트랜지스터의 듀얼 다이 칩이라고 전했다[3]
- 엔비디아는 루빈이 추론 성능에서 블랙웰의 5배, 학습 성능에서 3.5배에 이르며, GPU당 NVFP4 추론 50페타플롭스, NVFP4 학습 35페타플롭스를 낸다고 주장한다[1][2][3]
- 이 플랫폼은 블랙웰 대비 추론 토큰 비용을 최대 10분의 1까지 줄인다고 홍보되며, NVL72 랙은 와트당 추론 처리량이 최대 10배 높고 토큰당 비용은 10분의 1이라고 소개된다[1][2]
- 완전한 NVL72 랙 한 대의 성능은 추론 3.6엑사플롭스, 학습 2.5엑사플롭스, 트랜지스터 220조 개, LPDDR5X 54TB, HBM4 20.7TB로 평가된다[3], GPU당 NVLink 대역폭 3.6TB/s, 랙 전체로는 260TB/s에 이른다[2]
- 이 랙은 100% 액체 냉각 방식이며 케이블이 없는 모듈형 트레이 구조를 갖췄다. 출처들은 조립 시간 단축을 세 가지 방식으로 제시하는데, 설치 시간은 "2시간에서 5분으로" 줄었고[1], 랙 조립은 "블랙웰의 100분에서 루빈에서는 단 6분으로" 줄었으며[3], "조립과 유지보수 속도가 블랙웰보다 최대 18배 빠르다"고 한다[2]
참고자료 3신뢰도 86%
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%gcn.com/nvidia-vera-rubin-chips-begin-shipping/20421gcn.com· 게시 2026년 9월 20일· 시작 2026년 7월 21일 ✓· 점수의 42%
엔비디아는 2026년 7월 21일 "시스템이 이제 고객에게 출하되고 있다"고 확인했다.
- [2]85%NVIDIA Kicks Off the Next Generation of AI With Rubinnvidianews.nvidia.com· 추가 2026년 9월 20일· 점수의 42%
Nvidia's own announcement of the Rubin platform and its six chips.
- [3]80%NVIDIA Launches Next-Generation Rubin AI Compute Platform at CES 2026servethehome.com· 게재 2026년 1월 5일· 점수의 16%
Covers the Rubin platform launch and its second-half 2026 availability.[1]
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다.