CoreWeave ogłosił 30 września 2026 r. dostępność NVIDIA Vera Rubin NVL72 w CoreWeave Cloud i wskazał Cognition jako pierwszego klienta, który uruchomił na tym systemie obciążenia produkcyjne. Według CoreWeave klaster Cognition uruchomiono na początku września.

Co Cognition podała o wynikach SWE-2 i uczenia ze wzmocnieniem

Dla inferencji SWE-2 na NVIDIA Vera Rubin NVL72 Cognition podała do 4,8× łącznej przepustowości tokenów w porównaniu z bazowym klastrem NVIDIA GB200 NVL72. Przepustowość tokenów opisuje tempo ich przetwarzania; wynik dotyczy konkretnego zadania inferencyjnego i wskazanego systemu odniesienia.

W odrębnym obciążeniu uczenia ze wzmocnieniem Cognition podała 3,8× przepustowości tokenów wyjściowych. To inna miara i inne zadanie niż inferencja SWE-2: pierwsza liczba dotyczy łącznej przepustowości tokenów, a druga — tokenów wyjściowych.

Konfiguracja racka i wdrożenie

Szafa NVIDIA Vera Rubin NVL72 w centrum danych; nagranie pokazuje także rozładunek sprzętu i pracę techników.

Jeden rack NVIDIA Vera Rubin NVL72 łączy 72 procesory graficzne Rubin i 36 procesorów Vera. 16 września 2026 r. CoreWeave ogłosił wielorackowe klastry Vera Rubin NVL72 w swojej chmurze. 30 września firma poinformowała o dostępności systemu i obciążeniach produkcyjnych Cognition — to kolejny etap wdrożenia. Wcześniejszy materiał o infrastrukturze CoreWeave znajduje się tutaj.

Krótki materiał z centrum danych pokazuje rack, rozładunek sprzętu oraz techników obsługujących infrastrukturę.