Il 30 settembre 2026 CoreWeave ha annunciato che NVIDIA Vera Rubin NVL72 era disponibile su CoreWeave Cloud e ha indicato Cognition come primo cliente a eseguire carichi di produzione sul sistema. Secondo CoreWeave, il cluster di Cognition era stato allestito all’inizio di settembre. L’azienda ha inoltre riferito due risultati distinti ottenuti dagli ingegneri di Cognition.

Cognition porta i carichi di lavoro in produzione

La novità annunciata da CoreWeave è l’uso del sistema da parte di un cliente per carichi di produzione, non soltanto il dispiegamento dell’infrastruttura. Un precedente aggiornamento di NeoTeo su CoreWeave e Vera Rubin aveva seguito il tema dal lato dell’infrastruttura; l’annuncio del 30 settembre ha messo al centro i carichi di Cognition.

Che cosa misurano i risultati di Cognition

Per l’inferenza di SWE-2, gli ingegneri di Cognition hanno riferito fino a 4,8 volte il throughput totale di token su NVIDIA Vera Rubin NVL72 rispetto a una configurazione NVIDIA GB200 NVL72. Il throughput indica la quantità di token elaborati in un dato intervallo di tempo.

Per i carichi di apprendimento per rinforzo, Cognition ha riportato un risultato separato di 3,8× nel throughput dei token in uscita. Il primo dato riguarda il throughput totale nell’inferenza di SWE-2; il secondo i token in uscita nell’apprendimento per rinforzo. Sono metriche associate a carichi diversi.

La configurazione del rack e il dispiegamento

Un rack Vera Rubin NVL72 e le operazioni di scarico e movimentazione dell’attrezzatura in un data center

Ogni rack NVIDIA Vera Rubin NVL72 abbina 72 GPU Rubin e 36 CPU Vera. Il 16 settembre 2026 CoreWeave aveva annunciato cluster multinrack Vera Rubin NVL72 su CoreWeave Cloud; il 30 settembre ha poi indicato i carichi di Cognition in produzione sul sistema.

Il filmato mostra un rack in un data center, le operazioni di scarico e il personale che movimenta l’attrezzatura.