Le 30 septembre 2026, CoreWeave a annoncé la disponibilité de NVIDIA Vera Rubin NVL72 sur CoreWeave Cloud et a présenté Cognition comme le premier client à y exécuter des charges de production. L’annonce associe ainsi la mise à disposition de cette infrastructure à un usage client concret.
CoreWeave annonce Cognition en production sur Vera Rubin
CoreWeave indique que Cognition exécute des charges de production sur NVIDIA Vera Rubin NVL72. Selon l’entreprise, le cluster de Cognition a été mis en place au début de septembre. Cognition utilise les ressources de CoreWeave pour ses travaux liés à Devin, mais l’annonce rattache les résultats détaillés à des charges précises, plutôt qu’à l’ensemble de ces activités.
Deux résultats pour deux types de charge
Pour l’inférence de SWE-2, les ingénieurs de Cognition ont rapporté jusqu’à 4,8 fois le débit total de jetons sur NVIDIA Vera Rubin NVL72, par rapport à une configuration NVIDIA GB200 NVL72. Le débit de jetons mesure la quantité de jetons traités au fil du temps.
Cognition a également rapporté un débit de jetons de sortie multiplié par 3,8 pour des charges d’apprentissage par renforcement. Il s’agit d’un résultat distinct de celui obtenu pour l’inférence de SWE-2 : les deux chiffres portent sur des tâches et des mesures différentes.
Le rack NVL72 et les étapes du déploiement
Un rack NVIDIA Vera Rubin NVL72 réunit 72 GPU Rubin et 36 processeurs Vera. Le 16 septembre, CoreWeave avait annoncé la mise en service de clusters multi-racks sur son cloud. Son annonce du 30 septembre a ensuite nommé Cognition comme client exécutant des charges en production. Notre précédent article sur les racks Vera Rubin de CoreWeave revient sur le contexte matériel de ce déploiement.
La séquence montre deux étapes distinctes : la mise en service des clusters multi-racks, puis l’annonce de charges de production exécutées par Cognition. La vidéo présente un rack en centre de données, ainsi que des scènes de déchargement et de manutention du matériel.