Em 30 de setembro de 2026, a CoreWeave anunciou a disponibilidade da NVIDIA Vera Rubin NVL72 na CoreWeave Cloud e apontou a Cognition como a primeira cliente a operar cargas de produção no sistema. A empresa também divulgou dois resultados da Cognition: até 4,8× a vazão total de tokens em inferência SWE-2 e, em uma carga separada de aprendizado por reforço, vazão de tokens de saída 3,8 vezes maior.
O que a Cognition mediu em cada carga
Segundo a CoreWeave, os engenheiros da Cognition mediram até 4,8 vezes a vazão total de tokens em inferência SWE-2 na NVIDIA Vera Rubin NVL72, em comparação com um cluster NVIDIA GB200 NVL72. Vazão é a quantidade processada por unidade de tempo.
O resultado de aprendizado por reforço é outro: a Cognition reportou vazão de tokens de saída 3,8 vezes maior nessa carga. As duas cifras se referem a tarefas e métricas diferentes; não são medidas intercambiáveis de desempenho.
Rack e sequência da implantação
Cada rack NVIDIA Vera Rubin NVL72 combina 72 GPUs Rubin e 36 CPUs Vera. A CoreWeave disse que o cluster da Cognition foi colocado de pé no início de setembro de 2026. Em 16 de setembro, a empresa anunciou clusters multinrack Vera Rubin NVL72 na CoreWeave Cloud; no anúncio de 30 de setembro, identificou a Cognition como cliente com cargas de produção no sistema.
A NeoTeo já publicou uma cobertura anterior sobre a infraestrutura Vera Rubin da CoreWeave.