- Mula
- 21 Jul 202690% KEYAKINANdaripada sumber
Sistem Nvidia Vera Rubin Mula Dihantar
Diterjemah secara automatik daripada asal
Tajuk asal: Nvidia Vera Rubin Systems Begin Shipping
- Pada 21 Julai NVIDIA mengesahkan platform Vera Rubin telah mencapai pengeluaran penuh, dengan Ian Buck, naib presiden pengkomputeran dipercepat, memberitahu wartawan di ibu pejabat NVIDIA bahawa sistem kini dihantar kepada pelanggan termasuk OpenAI, CoreWeave, Google Cloud, Microsoft Azure, Meta dan Dell[1]
- NVIDIA telah berkata di GTC Taipei pada 31 Mei bahawa platform itu meningkat ke pengeluaran penuh, dengan pembuat pelayan terkemuka Taiwan mengeluarkan sistem berasaskan Vera Rubin secara besar-besaran[1]
- Sumber tidak sepakat tentang bila penghantaran dijangka: pengumuman bilik berita 31 Mei, seperti yang dipetik oleh[1], menyatakan "production shipments of Vera Rubin are set to begin starting this fall", manakala taklimat 21 Julai menyatakan sistem sudah dihantar; akaun yang lebih baharu ialah yang menyatakan penghantaran[1]
- Mereka juga tidak sepakat tentang status pengeluaran platform pada pelancaran - siaran akhbar CES 5 Januari 2026 sudah menyatakan "NVIDIA Rubin is in full production, and Rubin-based products will be available from partners the second half of 2026"[2], manakala laporan ServeTheHome tentang acara yang sama menyebutnya "an 'everything remains on schedule' announcement" dan menyatakan "the hardware is not shipping yet, and the ramp-up for production wo not even start until the second half of the year"[3]
- Bilangan cip dalam platform juga dinyatakan secara tidak konsisten: kedua-dua sumber CES menggambarkan enam cip baharu - CPU Vera, GPU Rubin, Suis NVLink 6, SuperNIC ConnectX-9, DPU BlueField-4 dan Suis Ethernet Spectrum-6[2][3] - manakala[1] menyatakan bahawa pada 16 Mac 2026 di GTC di San Jose NVIDIA mengumumkan platform itu telah berkembang kepada tujuh cip dalam pengeluaran penuh dengan LPU NVIDIA Groq 3, dan di tempat lain dalam artikel yang sama masih menyebutnya enam[1]
- Produk berasaskan Rubin akan tersedia daripada rakan kongsi pada separuh kedua 2026, dengan AWS, Google Cloud, Microsoft dan OCI antara awan awam pertama, bersama Rakan Kongsi Awan NVIDIA CoreWeave, Lambda, Nebius dan Nscale[1][2][3]
- Microsoft akan melaksanakan sistem skala-rak Vera Rubin NVL72 dalam pusat data AI generasi seterusnya termasuk tapak kilang super AI Fairwater akan datang, yang "will scale to hundreds of thousands of NVIDIA Vera Rubin Superchips"[1][2]
- CoreWeave, antara penyedia awan pertama menerima perkakasan itu, memberitahu Bloomberg bahawa rak NVL72 mereka menghasilkan sepuluh kali ganda output token generasi sebelumnya[1]
- Dell Technologies, HPE, Lenovo dan Supermicro, bersama ASUS, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology, Wistron dan Wiwynn, menggunakan NVIDIA DSX untuk mempercepat peningkatan Vera Rubin[1]
- NVIDIA menjalankan kitaran pembangunan 18 bulan yang agresif daripada pelancaran Blackwell ke pengeluaran Rubin, berbanding 24 hingga 30 bulan yang lazimnya diambil oleh langkah sebegitu[1]
- Siaran CES membawa notis kenyataan berpandangan ke hadapan dan memberi amaran bahawa "Many of the products and features described herein remain in various stages and will be offered on a when-and-if-available basis"[2]
Ciri utama
- Rak Vera Rubin NVL72 utama menyepadukan 72 GPU Rubin dan 36 CPU Vera yang disambungkan oleh NVLink 6, dengan SuperNIC ConnectX-9 dan DPU BlueField-4[1][2][3]
- Setiap GPU Rubin membawa memori HBM4 288 GB dengan lebar jalur sehingga 22 TB/s, berbanding 8 TB/s bagi Blackwell Ultra B300[1]; ServeTheHome meletakkan 288GB dan 22 TB/saat yang sama pada 2.8x lebar jalur HBM3e Blackwell, pada bahagian dwi-die 336 bilion transistor yang dibina pada TSMC 3nm[3]
- NVIDIA mendakwa Rubin mencapai 5x prestasi inferens Blackwell dan 3.5x prestasi latihannya, dengan 50 PFLOPS inferens NVFP4 dan 35 PFLOPS latihan NVFP4 setiap GPU[1][2][3]
- Platform ini dipromosikan dengan pengurangan sehingga 10x kos token inferens berbanding Blackwell; rak NVL72 disebut sehingga 10x lebih tinggi daya pemprosesan inferens setiap watt pada satu persepuluh kos setiap token[1][2]
- Rak NVL72 penuh dinilai pada 3.6 EFLOPS pengkomputeran inferens dan 2.5 EFLOPS latihan, 220 trilion transistor, 54TB LPDDR5X dan 20.7TB HBM4[3], dengan lebar jalur NVLink 3.6TB/s setiap GPU dan 260TB/s merentasi rak[2]
- Rak itu 100 peratus disejukkan cecair dengan reka bentuk dulang modular tanpa kabel; sumber memberikan penjimatan pemasangan dalam tiga cara - pemasangan dipotong "from two hours to five minutes"[1], pemasangan rak "from 100 minutes on Blackwell to just 6 minutes on Rubin"[3], dan "up to 18x faster assembly and servicing than Blackwell"[2]
Rujukan 386% KEYAKINANKeyakinan keseluruhan: 86%Sejauh mana sumber dan rujukan pin menyokong tarikhnya.Purata berpemberat bagi sejauh mana 3 rujukan, termasuk sumber, menyokong masa mula dan tamat pin; sesebuah rujukan diambil kira separuh kurang bagi setiap 180 hari lebih lama daripada yang terbaharuTunjuk semua pin pada keyakinan 75% atau lebih baik
Entri pertama sentiasa sumber pin. Keyakinan keseluruhan ialah purata berpemberat bagi sejauh mana setiap rujukan menyokong masa mula dan tamat yang digunakan di atas; sesebuah rujukan diambil kira separuh kurang bagi setiap 180 hari lebih lama daripada yang terbaharu.
- [1]90%gcn.com/nvidia-vera-rubin-chips-begin-shipping/20421gcn.com· Disiarkan 20 Sep 2026· Bermula 21 Jul 2026 ✓· 42% daripada skor
Nvidia[2] mengesahkan pada 21 Julai 2026 bahawa 'systems are now shipping to customers'.
- [2]85%NVIDIA Kicks Off the Next Generation of AI With Rubinnvidianews.nvidia.com· Ditambah 20 Sep 2026· 42% daripada skor
Nvidia's own announcement of the Rubin platform and its six chips.
- [3]80%NVIDIA Launches Next-Generation Rubin AI Compute Platform at CES 2026servethehome.com· Diterbitkan 5 Jan 2026· 16% daripada skor
Covers the Rubin platform launch and its second-half 2026 availability.[1]
Cadangkan pembetulan
Ada yang tertinggal atau salah? Nyatakan dengan kata-kata anda sendiri: pautan yang menyokong pin ini, tarikh mula atau tamat yang berbeza beserta sebabnya, atau fakta yang tiada atau tersilap. AI menyemaknya berbanding sumber pin ini, mencari yang lebih baik, dan menambah mana-mana halaman yang menyokong anda. Sumber pin itu sendiri tetap paling diambil kira. Gambar yang menunjukkan sesuatu yang lain, atau menunjukkannya dengan buruk, turut dilihat, dan dialihkan ke bawah atau diganti.