Op 30 september 2026 maakte CoreWeave bekend dat NVIDIA Vera Rubin NVL72 beschikbaar was op CoreWeave Cloud. Het bedrijf noemde Cognition als eerste klant die productieworkloads op het systeem draaide.
De aankondiging sluit aan op eerdere berichtgeving over de Vera Rubin-infrastructuur van CoreWeave en voegt Cognitions klantworkloads en de door het bedrijf gemelde resultaten toe.
Wat Cognition meldde over SWE-2 en reinforcement learning
Cognition meldde dat zijn engineers bij SWE-2-inferentie op NVIDIA Vera Rubin NVL72 tot 4,8 keer de totale tokendoorvoer haalden van een NVIDIA GB200 NVL72-baseline. Tokendoorvoer is de hoeveelheid tokens die een systeem per tijdseenheid verwerkt.
Voor een afzonderlijke workload voor reinforcement learning (versterkend leren) rapporteerde Cognition een outputtokendoorvoer van 3,8×. Dat cijfer hoort bij een andere taak en een andere maatstaf dan het resultaat voor SWE-2-inferentie. Beide resultaten zijn door Cognition gemeld.
De rackconfiguratie en de inzet in context
Elk NVIDIA Vera Rubin NVL72-rack combineert 72 Rubin-GPU's met 36 Vera-CPU's. CoreWeave meldde dat het cluster van Cognition begin september was opgebouwd. Op 16 september kondigde CoreWeave multi-rackclusters met Vera Rubin NVL72 aan; op 30 september volgde de bekendmaking over Cognitions productieworkloads op het systeem.