NVIDIA e CoreWeave implantam Vera Rubin NVL72 e Vera CPU para acelerar a produção de IA agente
CoreWeave lança as GPUs Vera Rubin NVL72 e as CPUs Vera da NVIDIA em sua nuvem, proporcionando ganhos de até 4,8× no throughput de tokens e inicializações de sandbox 3× mais rápidas para cargas de trabalho de IA agente.

1. Announcement and Key Players
Em 30 de setembro de 2026, a NVIDIA e a especialista em computação em nuvem CoreWeave anunciaram que sua infraestrutura de IA de próxima geração já está em produção. No evento CoreWeave Fully Connected em São Francisco, as empresas revelaram o sistema NVIDIA Vera Rubin NVL72 — emparelhado com Ethernet Spectrum‑X de 102,4 Tbps — e a primeira CPU NVIDIA Vera, desenvolvida especificamente para IA agente. A Cognition, o laboratório de IA aplicada por trás do engenheiro de software AI Devin, tornou‑se a primeira cliente a executar cargas de trabalho de produção na plataforma Vera Rubin.
2. Technical Details and Early Results
- Hardware rollout: A CoreWeave recebeu seus primeiros racks de produção Vera Rubin NVL72 e os disponibilizou através do CoreWeave Cloud, tornando‑se uma das primeiras provedoras de nuvem a expor a plataforma aos clientes. A implantação inclui 128 CPUs Vera, totalizando 11 264 núcleos em um único rack, suficiente para mais de 11 000 ambientes isolados simultâneos.
- Performance gains: A Cognition comparou o Vera Rubin NVL72 com um baseline GB200 NVL72 em uma carga de trabalho real de engenharia de software (amostrada do FrontierCode). Os testes mostraram até 4,8× maior throughput de tokens para inferência SWE‑2, traduzindo‑se em geração de código em tempo real mais rápida e raciocínio multi‑passo mais responsivo.
- Sandbox acceleration: Usando os CoreWeave Sandboxes, a CPU Vera alcançou mais de 3× de velocidade na inicialização de sandboxes de agentes e um ganho de desempenho geral de 1,7× na suíte Terminal‑Bench. Cada sandbox roda em um ambiente isolado por hardware, com switches Spectrum‑X e DPUs BlueField‑4 garantindo comunicação de baixa latência e segura.
- Software stack: A fábrica de IA opera sobre o NVIDIA Dynamo, um framework de inferência de código aberto que também alimenta o RL Rollouts — recurso em pré‑visualização privada que carrega novos checkpoints em implantações ao vivo sem necessidade de redeploy.
- CoreWeave Forge: Para fechar o ciclo entre produção e treinamento, a CoreWeave introduziu o Forge, um ambiente unificado que agrega Weights & Biases, ferramentas OpenPipe de pós‑treinamento e o projeto de notebooks marimo. Novos serviços incluem:
- CoreWeave ARIA – um assistente de pesquisa e codificação assistido por IA que analisa execuções, propõe experimentos e registra alterações no GitHub.
- CoreWeave Agent Lens – observabilidade para agentes em produção, melhorando a detecção de falhas em 20 % e reduzindo à metade os custos de correção.
- CoreWeave Sandboxes – agora GA, oferecendo execução isolada em CPU ou GPU para agentes, chamadas de ferramentas, RL e avaliações, tanto em infraestrutura serverless quanto em treinamento existente. Fine‑tuning supervisionado serverless e RL rodam 1,4× mais rápido a 40 % de custo menor que configurações auto‑gerenciadas.
- Early adopters: Além da Cognition, Canva, Capital One, MasterClass e a provedora de saúde Ennoble Care começaram a construir no Forge. A Ennoble Care usará GPUs NVIDIA RTX PRO 6000 reservadas no CoreWeave Kubernetes Service para documentação clínica e agentes de suporte à decisão.
Quotes:
“NVIDIA accelerated computing delivers value across generations,” said Ian Buck, VP of hyperscale and HPC at NVIDIA. “CoreWeave’s V100 GPUs are still running customer workloads nearly a decade after Volta launched, even as CoreWeave brings Vera Rubin NVL72 into production.”
“Agentic coding is a complex workload: long contexts, high concurrency and token volumes where cost per token decides what we can ship,” noted Silas Alberti, founding team member at Cognition. “Having all of it on one platform, with NVIDIA and CoreWeave engineers who work the hard problems alongside ours, matters more to us than any single spec.”
3. Industry Implications
O lançamento destaca uma mudança mais ampla rumo à IA agente, onde grandes modelos de linguagem atuam como engenheiros de software autônomos, clínicos ou bots de atendimento ao cliente. Ao oferecer uma plataforma full‑stack, multigeracional que abrange desde o treinamento até a inferência em tempo real, NVIDIA e CoreWeave buscam reduzir a fragmentação que historicamente atrasou a transição de protótipos para produção. A alegação de ROI de uma década nas GPUs V100 evidencia a longevidade do roadmap de hardware da NVIDIA — uma vantagem competitiva enquanto rivais como AWS, Azure e Google Cloud correm para oferecer suas próprias CPUs e redes otimizadas para IA.
A integração da Ethernet de alta taxa Spectrum‑X, DPUs BlueField‑4 e CPUs projetadas especificamente posiciona a parceria para atender às duas pressões simultâneas de serviço de baixa latência e treinamento massivamente paralelo que cargas de trabalho agentes exigem. À medida que mais empresas — particularmente nos setores de saúde, finanças e criatividade — adotam agentes de IA autônomos, a capacidade de criar milhares de ambientes sandbox isolados rapidamente pode se tornar um fator decisivo na escolha da nuvem.
---
All figures and quotes are taken from the NVIDIA blog post “From Training to Production, NVIDIA and CoreWeave Close the Loop on Agentic AI” dated September 30, 2026.


