A era da Vera Rubin começou. A plataforma de inteligência artificial mais rápida da NVIDIA e do mundo já está sendo entregue aos principais provedores de nuvem.
CoreWeave e Oracle recebem os primeiros sistemas NVIDIA Vera Rubin NVL72
A NVIDIA já iniciou a produção em larga escala da Vera Rubin, mas os principais provedores de nuvem focados em IA já começaram a receber as primeiras unidades para testes e validação.
No mês passado, a empresa também enviou os primeiros processadores Vera para grandes companhias do setor de inteligência artificial.
A Oracle e a CoreWeave estão entre as primeiras empresas a colocar em operação a plataforma NVIDIA Vera Rubin NVL72.
Os sistemas serão avaliados em conjunto com a NVIDIA para viabilizar o desempenho da próxima geração de IA em ambientes de ponta.
Mahesh Thiagarajan, vice-presidente executivo da Oracle Cloud Infrastructure, compartilhou as primeiras imagens do enorme rack NVL72, equipado com 72 GPUs Rubin e 36 CPUs Vera.
Os componentes foram desenvolvidos para cargas de trabalho de inteligência artificial e são apontados como a próxima grande aposta da NVIDIA após a geração Grace Blackwell, que continua registrando resultados de destaque em testes de IA, como os benchmarks MLPerf 6.0 divulgados recentemente.
OCI continues to push the frontier of AI infrastructure. We are among the first cloud providers to bring up an @nvidia Vera Rubin NVL72 rack for validation testing, working closely with NVIDIA to deliver next-generation accelerated computing to customers at cloud scale.
Pic 1:… pic.twitter.com/sMc7m5RS2f
— Mahesh Thiagarajan (@MThiagarajan_) June 10, 2026
Infraestrutura vai além dos chips
Segundo Jensen Huang, a inteligência artificial funciona como uma estrutura composta por cinco camadas, e o sistema Vera Rubin representa apenas uma delas.
- Leia tambem: NVIDIA aumenta preço das placas de vídeo pela terceira vez em 2026, com alta de até 30%
A plataforma depende de uma infraestrutura desenvolvida para alimentação elétrica, refrigeração, interconexões, redes e outros elementos necessários para seu funcionamento. Além do hardware, existe toda a camada de software construída pela NVIDIA ao longo de vários anos.
Essa base é formada pelo ecossistema CUDA e, no segmento de inteligência artificial, pela plataforma CUDA-X, amplamente utilizada para desenvolvimento e execução de aplicações de IA.
CoreWeave mostra instalação do sistema
O segundo sistema foi instalado na CoreWeave e apresentado por Jacob Yundt, diretor sênior de Arquitetura de Computação da empresa.
A companhia divulgou um vídeo mostrando o transporte do equipamento até o data center. De acordo com as imagens, foram necessárias entre três e quatro pessoas para movimentar a unidade e posicioná-la dentro da instalação.
- Leia tambem: DeepSeek diz que NVIDIA está "cavando a própria cova", mas admite vantagem do GB300 sobre chips da Huawei
O tamanho do equipamento dá uma ideia da escala dos racks utilizados em centros de dados voltados para inteligência artificial, que podem reunir milhares dessas estruturas em operação.
We are the first cloud provider to bring up and validate @nvidia Vera Rubin NVL72.
Not just the hardware. The full stack: software-defined liquid cooling (Valvey), unified rack control (Racky), CoreWeave Mission Control across the fleet.
Read the blog: https://t.co/hf7RJhV7oG pic.twitter.com/sEcmDQyN35
— CoreWeave (@CoreWeave) June 17, 2026
A CoreWeave também apresentou nomes próprios para parte de sua infraestrutura de refrigeração líquida definida por software e para seu sistema de gerenciamento unificado de racks, chamados Valvey e Racky.
Segundo a empresa, ela foi a primeira a iniciar a ativação e validação da plataforma NVIDIA Vera Rubin NVL72.
Produção em larga escala já começou
Como já havia sido informado anteriormente, a plataforma Vera Rubin começou sua trajetória com números expressivos.
- Leia tambem: NVIDIA lança driver Hotfix 610.82 para corrigir problemas de estabilidade em Halo: Campaign Evolved nas GPUs RTX 50
A NVIDIA informa que o sistema consegue realizar treinamento de modelos do tipo MoE utilizando apenas um quarto da quantidade de GPUs necessária em comparação com a geração Blackwell.
Nas tarefas de inferência, o custo por token seria até dez vezes menor. A produção em larga escala já está em andamento, e o terceiro trimestre marcará o início das primeiras operações da plataforma voltada para aplicações de IA agêntica.
