NVIDIA-GPU’s huren kan via grote cloudproviders en gespecialiseerde GPU-clouds. Bedrijven kunnen ook GPU’s zelf kopen en door een provider laten beheren, capaciteit contractueel vastleggen of servers in hun eigen datacenter gebruiken. Welke route past, hangt af van de gewenste capaciteit, de beschikbare infrastructuur en hoeveel technisch beheer je zelf wilt doen.

Zes manieren om NVIDIA-GPU-capaciteit te krijgen

Een hyperscaler is een grote cloudprovider met een breed aanbod aan beheerde diensten. Een neocloud is een cloudprovider die zich vooral op GPU-infrastructuur richt. Samen met eigen hardware en contracten voor grote capaciteit vormen ze zes verschillende routes:

ToegangsrouteWie levert of beheert de hardware?Wat de route biedtBelangrijkste praktische afweging
Hyperscaler-cloudEen grote cloudprovider levert en beheert de GPU-infrastructuur.GPU’s in combinatie met beheerde clouddiensten en vertrouwde zakelijke infrastructuur.De beschikbare capaciteit sluit mogelijk niet aan op het moment waarop je die nodig hebt.
Grote neocloudEen gespecialiseerde provider bouwt en beheert GPU-infrastructuur.Een alternatief voor bedrijven die grote hoeveelheden GPU-capaciteit nodig hebben.Voor nieuwe capaciteit kunnen vooruitbetalingen en een levertijd van maanden gelden.
Kleine of regionale neocloudDe provider levert GPU-toegang; de precieze beheergrens verschilt per dienst.Mogelijk meer flexibiliteit, regionale plaatsing of toegang tot bare-metal-GPU’s.Je kunt meer software- en hardwarewerk zelf moeten uitvoeren.
Eigen GPU’s bij Oracle laten beherenDe klant levert de GPU’s; Oracle beheert de infrastructuur.GPU’s gebruiken zonder zelf alle faciliteiten en operationele teams te verzorgen.Je moet de hardware eerst zelf aanschaffen.
Grote capaciteitsafspraakEen bedrijf met een omvangrijke GPU-vloot levert contractueel vastgelegde rekenkracht.Een grote hoeveelheid capaciteit in één afspraak.De omvang en verplichtingen kunnen buiten het bereik van kleinere bedrijven vallen.
Eigen servers op locatieHet bedrijf koopt, installeert en beheert de GPU-servers zelf.Directe controle over de eigen infrastructuur.Dit vraagt kapitaal, stroom, datacenterruimte en medewerkers met de juiste kennis.

Hyperscalers en grote neoclouds

Bij een hyperscaler krijg je GPU’s binnen een breder cloudplatform. Amazon, Microsoft en Google zijn voorbeelden van zulke aanbieders. Die combinatie kan aantrekkelijk zijn als je ook andere beheerde clouddiensten nodig hebt. De keerzijde: grote cloudproviders hebben niet altijd genoeg GPU-capaciteit voor iedere klant op het gewenste moment.

Neoclouds richten hun infrastructuur sterker op GPU’s. Sommige bedrijven gebruiken meerdere aanbieders: de CEO van Modal zei dat het bedrijf inmiddels met 25 neocloudproviders werkt. Dat voorbeeld laat zien hoe een organisatie haar capaciteit over partijen kan spreiden wanneer één route niet volstaat.

Bij grote uitbreidingen kunnen vooruitbetalingen en maanden aan voorbereiding meespelen. Mike Intrator, CEO van CoreWeave, omschreef de capaciteit op korte termijn tijdens een bedrijfsbijeenkomst in augustus als vrijwel uitverkocht. Een grote neocloud is dus niet automatisch een directe oplossing zodra extra GPU’s nodig zijn.

Specialistische clouds en bare metal

Kleinere en regionale GPU-clouds kunnen flexibeler zijn en bare-metal-toegang aanbieden. Bare metal geeft rechtstreeks toegang tot fysieke servers, in plaats van alleen een virtuele machine binnen een gedeelde abstractielaag. Dat kan aantrekkelijk zijn als je de omgeving nauwkeuriger wilt afstemmen, maar brengt ook meer technisch werk voor je team mee.

De prijs hangt onder meer af van het GPU-model, de configuratie en het type dienst. Een uurtarief op zichzelf vertelt daarom niet hoeveel een complete workload kost. Houd ook rekening met de beheerstaken en met de voorwaarden van het specifieke aanbod.

Eigen GPU’s laten beheren door een provider

Bij het model ‘bring your own hardware’ koopt de klant de GPU’s en verzorgt een cloudprovider de infrastructuur. Oracle beschrijft zo’n route voor bedrijven die de hardware kunnen aanschaffen, maar zelf onvoldoende stroomvoorziening, datacenterruimte of gespecialiseerd personeel hebben om die te beheren.

Je houdt daarmee zelf de investering in de GPU’s, terwijl de provider een deel van het operationele werk op zich neemt. Dat is iets anders dan GPU’s huren: de klant brengt in dit model de hardware in.

Grote capaciteitsafspraken en eigen servers

Een onderhandelde capaciteitsafspraak is bedoeld voor grote hoeveelheden rekenkracht en kan aanzienlijke verplichtingen meebrengen. Dat maakt dit model iets anders dan losse GPU’s per uur afnemen.

Bij eigen servers komt zowel de aanschaf als de dagelijkse bedrijfsvoering bij je organisatie te liggen. Dropbox en Everpure zijn voorbeelden van bedrijven die eigen GPU’s in hun datacenters gebruiken. Voor deze route moet je niet alleen de investering in apparatuur meenemen, maar ook stroom, ruimte en de mensen die de systemen beheren.

Welke route past bij je workload?

Begin met de vraag wanneer en hoeveel capaciteit je nodig hebt. Voor een beheerde cloudomgeving met aanvullende diensten ligt een hyperscaler voor de hand; bij een grote GPU-behoefte kunnen neoclouds een alternatief vormen. Bij beide routes speelt de beschikbare capaciteit mee.

Kijk daarna naar het werk dat je team zelf kan uitvoeren. Bare-metal-toegang en eigen servers geven meer directe verantwoordelijkheid voor de technische omgeving. Heb je GPU’s maar niet de benodigde faciliteiten of beheerders, dan past het model waarbij Oracle klanteneigendom beheert mogelijk beter. Ontbreekt ook het kapitaal voor eigen hardware, dan is capaciteit huren een andere route.

NVIDIA beschrijft GPU-cloudtoegang via grote cloudplatforms en NVIDIA Cloud Partners. De chipmaker levert daarmee toegang via het cloud-ecosysteem; de GPU-aanbieder of operator bepaalt hoe de klant de capaciteit afneemt en beheert.