- Bắt đầu
- 21 thg 7, 2026ĐỘ TIN CẬY 90%từ nguồn
Hệ thống Nvidia Vera Rubin bắt đầu giao hàng
Được dịch tự động từ bản gốc
Tiêu đề gốc: Nvidia Vera Rubin Systems Begin Shipping
- Vào ngày 21 tháng 7, NVIDIA xác nhận nền tảng Vera Rubin đã đạt giai đoạn sản xuất toàn diện, khi Ian Buck, phó chủ tịch phụ trách điện toán tăng tốc, nói với các phóng viên tại trụ sở NVIDIA rằng các hệ thống hiện đang được giao cho khách hàng gồm OpenAI, CoreWeave, Google Cloud, Microsoft Azure, Meta và Dell[1]
- NVIDIA đã cho biết tại GTC Taipei ngày 31 tháng 5 rằng nền tảng này đang tăng tốc lên sản xuất toàn diện, với các nhà sản xuất máy chủ hàng đầu của Đài Loan đang sản xuất hàng loạt các hệ thống dựa trên Vera Rubin[1]
- Các nguồn không thống nhất về thời điểm giao hàng dự kiến: thông báo của phòng tin tức ngày 31 tháng 5, theo[1] trích dẫn, cho biết "các lô giao hàng sản xuất của Vera Rubin dự kiến bắt đầu từ mùa thu này", trong khi buổi họp báo ngày 21 tháng 7 cho thấy các hệ thống đã được giao; bản tin mới hơn là bản tin về việc giao hàng[1]
- Các nguồn cũng không thống nhất về tình trạng sản xuất của nền tảng khi ra mắt - thông cáo báo chí tại CES ngày 5 tháng 1 năm 2026 đã nói "NVIDIA Rubin đang trong sản xuất toàn diện, và các sản phẩm dựa trên Rubin sẽ có từ các đối tác vào nửa cuối năm 2026"[2], trong khi bài của ServeTheHome về cùng sự kiện gọi đó là "một thông báo kiểu 'mọi thứ vẫn đúng tiến độ'" và lưu ý rằng "phần cứng chưa được giao, và việc tăng tốc sản xuất thậm chí sẽ không bắt đầu cho đến nửa cuối năm"[3]
- Số lượng chip trong nền tảng cũng được nêu không nhất quán: cả hai nguồn CES đều mô tả sáu chip mới - CPU Vera, GPU Rubin, NVLink 6 Switch, ConnectX-9 SuperNIC, BlueField-4 DPU và Spectrum-6 Ethernet Switch[2][3] - trong khi[1] nói rằng vào ngày 16 tháng 3 năm 2026 tại GTC ở San Jose, NVIDIA công bố nền tảng đã mở rộng lên bảy chip trong sản xuất toàn diện với NVIDIA Groq 3 LPU, và ở chỗ khác trong cùng bài vẫn gọi là sáu[1]
- Các sản phẩm dựa trên Rubin sẽ có từ các đối tác vào nửa cuối năm 2026, với AWS, Google Cloud, Microsoft và OCI nằm trong số các đám mây công cộng đầu tiên, cùng các Đối tác Đám mây NVIDIA là CoreWeave, Lambda, Nebius và Nscale[1][2][3]
- Microsoft sẽ triển khai các hệ thống quy mô rack Vera Rubin NVL72 trong các trung tâm dữ liệu AI thế hệ tiếp theo gồm các địa điểm siêu nhà máy AI Fairwater trong tương lai, vốn "sẽ mở rộng lên hàng trăm nghìn siêu chip NVIDIA Vera Rubin"[1][2]
- CoreWeave, một trong những nhà cung cấp đám mây đầu tiên nhận phần cứng, nói với Bloomberg rằng các rack NVL72 của họ đang cho sản lượng token gấp mười lần thế hệ trước[1]
- Dell Technologies, HPE, Lenovo và Supermicro, cùng ASUS, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology, Wistron và Wiwynn, đang áp dụng NVIDIA DSX để đẩy nhanh quá trình tăng tốc sản xuất Vera Rubin[1]
- NVIDIA đã chạy một chu kỳ phát triển quyết liệt 18 tháng từ lúc ra mắt Blackwell đến khi sản xuất Rubin, so với 24 đến 30 tháng mà một bước như vậy thường đòi hỏi[1]
- Thông cáo CES có kèm thông báo về các tuyên bố hướng tới tương lai và cảnh báo rằng "Nhiều sản phẩm và tính năng được mô tả ở đây vẫn đang ở các giai đoạn khác nhau và sẽ được cung cấp trên cơ sở khi nào có và nếu có"[2]
Tính năng nổi bật
- Rack Vera Rubin NVL72 chủ lực tích hợp 72 GPU Rubin và 36 CPU Vera được kết nối bằng NVLink 6, cùng ConnectX-9 SuperNIC và BlueField-4 DPU[1][2][3]
- Mỗi GPU Rubin mang 288 GB bộ nhớ HBM4 với băng thông lên tới 22 TB/s, so với 8 TB/s của Blackwell Ultra B300[1]; ServeTheHome cho rằng cùng mức 288GB và 22 TB/giây này bằng 2.8 lần băng thông HBM3e của Blackwell, trên một con chip hai die 336 tỷ bóng bán dẫn được sản xuất trên TSMC 3nm[3]
- NVIDIA tuyên bố Rubin đạt hiệu năng suy luận gấp 5 lần Blackwell và hiệu năng huấn luyện gấp 3.5 lần, với 50 PFLOPS suy luận NVFP4 và 35 PFLOPS huấn luyện NVFP4 trên mỗi GPU[1][2][3]
- Nền tảng được quảng bá là giảm tới 10 lần chi phí token suy luận so với Blackwell; rack NVL72 được nêu là có thông lượng suy luận trên mỗi watt cao hơn tới 10 lần với chi phí trên mỗi token bằng một phần mười[1][2]
- Một rack NVL72 đầy đủ được định mức 3.6 EFLOPS sức mạnh tính toán suy luận và 2.5 EFLOPS huấn luyện, 220 nghìn tỷ bóng bán dẫn, 54TB LPDDR5X và 20.7TB HBM4[3], với băng thông NVLink 3.6TB/s trên mỗi GPU và 260TB/s trên toàn rack[2]
- Rack được làm mát bằng chất lỏng 100 phần trăm với thiết kế khay mô-đun không dây cáp; các nguồn nêu mức tiết kiệm khi lắp ráp theo ba cách - thời gian lắp đặt giảm "từ hai giờ xuống năm phút"[1], lắp ráp rack "từ 100 phút trên Blackwell xuống chỉ 6 phút trên Rubin"[3], và "lắp ráp và bảo trì nhanh hơn Blackwell tới 18 lần"[2]
Tài liệu tham khảo 3ĐỘ TIN CẬY 86%Độ tin cậy tổng thể: 86%Mức độ nguồn và tài liệu tham khảo của ghim củng cố các ngày của nó.Trung bình có trọng số về mức độ 3 tài liệu, gồm cả nguồn, ủng hộ thời điểm bắt đầu và kết thúc của ghim; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhấtHiện tất cả ghim có độ tin cậy từ 75% trở lên
Mục đầu tiên luôn là nguồn của ghim. Độ tin cậy tổng thể là trung bình có trọng số về mức độ mỗi tài liệu ủng hộ thời điểm bắt đầu và kết thúc được dùng ở trên; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhất.
- [1]90%gcn.com/nvidia-vera-rubin-chips-begin-shipping/20421gcn.com· Đăng 20 thg 9, 2026· Bắt đầu 21 thg 7, 2026 ✓· 42% điểm số
Nvidia[2] xác nhận vào ngày 21 tháng 7 năm 2026 rằng 'các hệ thống hiện đang được giao cho khách hàng'.
- [2]85%NVIDIA Kicks Off the Next Generation of AI With Rubinnvidianews.nvidia.com· Thêm 20 thg 9, 2026· 42% điểm số
Nvidia's own announcement of the Rubin platform and its six chips.
- [3]80%NVIDIA Launches Next-Generation Rubin AI Compute Platform at CES 2026servethehome.com· Xuất bản 5 thg 1, 2026· 16% điểm số
Covers the Rubin platform launch and its second-half 2026 availability.[1]
Đề xuất chỉnh sửa
Thiếu hay sai điều gì? Hãy nói bằng lời của bạn: một liên kết củng cố ghim này, một ngày bắt đầu hoặc kết thúc khác kèm lý do, hoặc một thông tin còn thiếu hay sai. AI đối chiếu với các nguồn của ghim này, tìm nguồn tốt hơn và thêm mọi trang ủng hộ bạn. Các nguồn của chính ghim vẫn được tính nhiều nhất. Hình ảnh thể hiện nội dung khác hoặc thể hiện kém cũng được xem xét, rồi bị hạ xuống hoặc thay thế.