A CoreWeave colocou no ar a plataforma Vera Rubin NVL72, da NVIDIA, na sua nuvem. O anúncio saiu no evento CoreWeave Fully Connected 2026, e com ele a nova geração de racks de IA da NVIDIA, que sucede os sistemas Blackwell, passa a ser alugada por hora a empresas.
O número que as duas empresas puseram na vitrine é de até 4,8 vezes mais tokens por segundo em comparação com o GB200 NVL72. A medida vale para inferência de agentes que trabalham com engenharia de software, não para qualquer carga de IA, e vem dos próprios fabricantes. A CPU Vera também ganhou métricas: abre ambientes isolados (sandboxes) três vezes mais rápido e rende 1,7 vez mais no Terminal-Bench, teste que mede agentes operando no terminal. A primeira cliente é a Cognition, dona do Devin, que vai usar o hardware para acelerar o agente de programação e o raciocínio em várias etapas.

Junto com o hardware veio a suíte CoreWeave Forge, voltada a quem coloca agentes em produção. Ela reúne o assistente ARIA, o Agent Lens, que transforma os registros dos agentes em relatórios de onde eles erram, sandboxes de CPU e GPU para testes e aprendizado por reforço, e um serviço de pós-treinamento que usa os dados de produção do cliente sem exigir um cluster próprio. A CoreWeave diz que o custo de implantação fica até 65% abaixo do cobrado pelas grandes nuvens, outra conta da própria empresa. Curiosidade do evento: ela ainda mantém em operação GPUs V100, da arquitetura Volta, quase dez anos depois do lançamento.

Para quem acompanha o mercado de IA, a chegada do Rubin à nuvem é o sinal de que a troca de geração começou fora dos laboratórios da NVIDIA. Os sistemas já tinham entrado na pauta por causa do reajuste de mais de 15% nos servidores de IA provocado pela falta de memória, o que ajuda a explicar por que alugar capacidade virou a porta de entrada para muitas empresas. A CoreWeave não divulgou o preço por hora das instâncias Vera Rubin.
