El 30 de septiembre de 2026, CoreWeave anunció que NVIDIA Vera Rubin NVL72 estaba disponible en CoreWeave Cloud y señaló a Cognition como su primer cliente con cargas de producción en el sistema. La compañía situó el hito en una aplicación concreta de la infraestructura de IA: cargas de trabajo reales de un cliente, junto con resultados comunicados para inferencia y aprendizaje por refuerzo.

El anuncio amplía la cobertura anterior de NeoTeo sobre la infraestructura Vera Rubin de CoreWeave con el uso de producción atribuido a Cognition.

Qué midió Cognition en SWE-2 y en aprendizaje por refuerzo

Cognition comunicó hasta 4,8 veces el rendimiento total de tokens en inferencia SWE-2 con NVIDIA Vera Rubin NVL72 frente a una configuración de referencia con NVIDIA GB200 NVL72. La cifra corresponde a una prueba de inferencia realizada por ingenieros de Cognition en CoreWeave Cloud.

Por separado, Cognition cifró en 3,8× el rendimiento de tokens de salida para cargas de aprendizaje por refuerzo. Son métricas distintas: la primera corresponde al rendimiento total de tokens en inferencia SWE-2; la segunda, a tokens de salida en aprendizaje por refuerzo.

La configuración del rack y el contexto del despliegue

El recorrido muestra un rack en un centro de datos, tareas de descarga y técnicos manipulando el equipo.

CoreWeave indicó que cada rack NVIDIA Vera Rubin NVL72 reúne 72 GPU Rubin y 36 CPU Vera. El 16 de septiembre, la compañía había anunciado clústeres Vera Rubin NVL72 de varios racks en su nube; el 30 de septiembre identificó las cargas de producción de Cognition en el sistema. CoreWeave también dijo que el clúster de Cognition se puso en marcha a comienzos de septiembre.

El recorrido del rack muestra equipos en un centro de datos, su descarga y técnicos manipulando la infraestructura.