- Início
- 21 de jul. de 202690% DE CONFIANÇAde a fonte
Sistemas Nvidia Vera Rubin começam a ser enviados
Traduzido automaticamente do original
Título original: Nvidia Vera Rubin Systems Begin Shipping
- Em 21 de julho, a NVIDIA confirmou que a plataforma Vera Rubin havia chegado à produção plena, com Ian Buck, vice-presidente de computação acelerada, dizendo a jornalistas na sede da NVIDIA que os sistemas já estão sendo enviados a clientes como OpenAI, CoreWeave, Google Cloud, Microsoft Azure, Meta e Dell[1]
- A NVIDIA havia dito na GTC Taipei, em 31 de maio, que a plataforma estava acelerando para a produção plena, com os principais fabricantes de servidores de Taiwan produzindo em escala sistemas baseados na Vera Rubin[1]
- As fontes divergem sobre quando as remessas estavam previstas: o anúncio da sala de imprensa de 31 de maio, como[1] o cita, dizia "as remessas de produção da Vera Rubin devem começar neste outono", enquanto o briefing de 21 de julho já tem sistemas sendo enviados; o relato mais recente é o das remessas[1]
- Elas também divergem sobre o status de produção da plataforma no lançamento - o comunicado da CES de 5 de janeiro de 2026 já dizia "a NVIDIA Rubin está em produção plena, e os produtos baseados na Rubin estarão disponíveis com parceiros no segundo semestre de 2026"[2], enquanto o relato da ServeTheHome sobre o mesmo evento a chamou de "um anúncio de 'tudo continua dentro do cronograma'" e observou que "o hardware ainda não está sendo enviado, e a aceleração da produção nem sequer vai começar até o segundo semestre do ano"[3]
- O número de chips da plataforma também é declarado de forma inconsistente: as duas fontes da CES descrevem seis novos chips - CPU Vera, GPU Rubin, NVLink 6 Switch, ConnectX-9 SuperNIC, BlueField-4 DPU e Spectrum-6 Ethernet Switch[2][3] - enquanto[1] diz que, em 16 de março de 2026, na GTC em San Jose, a NVIDIA anunciou que a plataforma havia se expandido para sete chips em produção plena com a NVIDIA Groq 3 LPU, e em outra parte do mesmo artigo ainda fala em seis[1]
- Os produtos baseados na Rubin devem estar disponíveis com parceiros no segundo semestre de 2026, com AWS, Google Cloud, Microsoft e OCI entre as primeiras nuvens públicas, ao lado dos NVIDIA Cloud Partners CoreWeave, Lambda, Nebius e Nscale[1][2][3]
- A Microsoft implantará sistemas em escala de rack Vera Rubin NVL72 em data centers de IA de nova geração, incluindo futuros locais da superfábrica de IA Fairwater, que "escalarão para centenas de milhares de NVIDIA Vera Rubin Superchips"[1][2]
- A CoreWeave, entre os primeiros provedores de nuvem a receber o hardware, disse à Bloomberg que seus racks NVL72 estão entregando dez vezes a produção de tokens da geração anterior[1]
- Dell Technologies, HPE, Lenovo e Supermicro, com ASUS, Foxconn, GIGABYTE, Pegatron, Quanta Cloud Technology, Wistron e Wiwynn, estão adotando o NVIDIA DSX para acelerar a produção da Vera Rubin[1]
- A NVIDIA manteve um ciclo de desenvolvimento agressivo de 18 meses entre o lançamento da Blackwell e a produção da Rubin, contra os 24 a 30 meses que um passo desses costuma levar[1]
- O comunicado da CES traz um aviso de declarações prospectivas e adverte que "Muitos dos produtos e recursos descritos aqui permanecem em vários estágios e serão oferecidos conforme e quando estiverem disponíveis"[2]
Principais recursos
- O rack principal Vera Rubin NVL72 integra 72 GPUs Rubin e 36 CPUs Vera conectadas por NVLink 6, com ConnectX-9 SuperNICs e BlueField-4 DPUs[1][2][3]
- Cada GPU Rubin tem 288 GB de memória HBM4 com até 22 TB/s de largura de banda, contra os 8 TB/s da Blackwell Ultra B300[1]; a ServeTheHome coloca os mesmos 288GB e 22 TB/segundo em 2,8x a largura de banda HBM3e da Blackwell, em uma peça de dois dies e 336 bilhões de transistores construída em TSMC 3nm[3]
- A NVIDIA afirma que a Rubin alcança 5x o desempenho de inferência da Blackwell e 3,5x o de treinamento, com 50 PFLOPS de inferência NVFP4 e 35 PFLOPS de treinamento NVFP4 por GPU[1][2][3]
- A plataforma é vendida com uma redução de até 10x no custo de tokens de inferência em relação à Blackwell; o rack NVL72 é citado com até 10x mais throughput de inferência por watt a um décimo do custo por token[1][2]
- Um rack NVL72 completo tem capacidade de 3,6 EFLOPS de computação de inferência e 2,5 EFLOPS de treinamento, 220 trilhões de transistores, 54TB de LPDDR5X e 20,7TB de HBM4[3], com 3,6TB/s de largura de banda NVLink por GPU e 260TB/s em todo o rack[2]
- O rack é 100 por cento refrigerado a líquido, com um design modular de bandejas sem cabos; as fontes dão a economia na montagem de três formas - instalação reduzida "de duas horas para cinco minutos"[1], montagem do rack "de 100 minutos na Blackwell para apenas 6 minutos na Rubin"[3] e "montagem e manutenção até 18x mais rápidas que a Blackwell"[2]
Referências 386% DE CONFIANÇAConfiança geral: 86%Quanto a fonte e as referências do pin sustentam suas datas.Média ponderada de quanto 3 referências, incluindo a fonte, sustentam os horários de início e fim do pin; uma referência conta metade a cada 180 dias a mais em relação à mais recenteMostrar todos os pins com confiança de 75% ou mais
A primeira entrada é sempre a fonte do pin. A confiança geral é uma média ponderada de quanto cada referência sustenta os horários de início e fim usados acima; uma referência conta metade a cada 180 dias a mais em relação à mais recente.
- [1]90%gcn.com/nvidia-vera-rubin-chips-begin-shipping/20421gcn.com· Postado em 20 de set. de 2026· Início 21 de jul. de 2026 ✓· 42% da pontuação
A Nvidia[2] confirmou em 21 de julho de 2026 que 'os sistemas já estão sendo enviados a clientes'.
- [2]85%NVIDIA Kicks Off the Next Generation of AI With Rubinnvidianews.nvidia.com· Adicionado em 20 de set. de 2026· 42% da pontuação
Nvidia's own announcement of the Rubin platform and its six chips.
- [3]80%NVIDIA Launches Next-Generation Rubin AI Compute Platform at CES 2026servethehome.com· Publicado em 5 de jan. de 2026· 16% da pontuação
Covers the Rubin platform launch and its second-half 2026 availability.[1]
Sugerir uma correção
Falta algo ou há um erro? Diga com suas palavras: um link que sustente este pin, uma data de início ou fim diferente e por quê, ou um fato que falta ou está errado. A IA confere isso com as fontes do pin, procura outras melhores e adiciona qualquer página que dê razão a você. As fontes do próprio pin continuam contando mais. Uma imagem que mostra outra coisa, ou mostra mal, também é analisada e rebaixada ou substituída.