Apple zou een terugkeer naar de markt voor extern verkochte zakelijke servers voorbereiden met een systeem voor AI-inference. Het voorgestelde apparaat zou ontwikkelaars, bedrijven en overheden helpen om al getrainde AI-modellen op eigen infrastructuur te draaien. Twee of vier toekomstige M8 Ultra-processors worden genoemd, naast een mogelijke verbinding met Nvidia NVLink Fusion.

Het plan bevindt zich nog in de ontwerpfase en kan worden aangepast of geschrapt. Een mogelijk doeljaar is 2029.

Apple zou opnieuw zakelijke servers willen verkopen

Apple verkocht eerder servers onder de naam Xserve, maar stopte daarmee in 2011. De nieuwe plannen zouden het bedrijf opnieuw naar de markt voor extern beheerde bedrijfsinfrastructuur brengen — dit keer met AI als hoofddoel.

De beoogde klanten zijn ontwikkelaars, bedrijven en overheden die modellen op hun eigen systemen willen uitvoeren. Dat past bij de groeiende belangstelling voor lokale of soevereine AI: organisaties houden hun gegevens en modeluitvoer binnen hun eigen infrastructuur, in plaats van alle verwerking naar een externe dienst te sturen.

Wat de M8 Ultra-server zou moeten doen

Een interview over Apples mogelijke terugkeer naar de servermarkt, met uitleg over AI-inference, M8 Ultra en NVLink Fusion.

De voorgestelde server zou vooral AI-inference uitvoeren. Daarbij gebruikt een systeem een al getraind model om bijvoorbeeld antwoorden te genereren of taken uit te voeren. Dat verschilt van training, waarbij een model met grote hoeveelheden gegevens wordt ontwikkeld of aangepast.

De berichtgeving over het plan noemt inference als de voornaamste werklast. Daarmee zou Apple zich richten op een ander onderdeel van AI-infrastructuur dan systemen die hoofdzakelijk voor modeltraining worden ingezet.

Twee configuraties en een mogelijke Nvidia-verbinding

Voor de server worden twee configuraties genoemd: een uitvoering met twee M8 Ultra-processors en een krachtigere variant met vier M8 Ultra-processors. Het gaat om voorgestelde opties, niet om een definitieve productconfiguratie.

Apple zou daarnaast hebben gekeken naar NVLink Fusion, Nvidia-technologie voor communicatie tussen processors. Dat maakt Nvidia in dit plan mogelijk een leverancier van interconnecttechnologie — de verbinding tussen rekenchips — en niet automatisch van de GPU’s die de berekeningen uitvoeren.

Of NVLink Fusion uiteindelijk wordt gebruikt, staat nog open. Hetzelfde geldt voor de vraag of een eventuele Apple-server Nvidia-GPU’s zou bevatten. De genoemde M8 Ultra-processors vormen het hart van het voorgestelde ontwerp.

Dit is iets anders dan Private Cloud Compute

Apple heeft al een afzonderlijke infrastructuur voor zware Apple Intelligence-taken: Private Cloud Compute. Die omgeving is uitgebreid naar systemen van Google Cloud. Apple beschrijft daarbij Nvidia-GPU’s, Intel-processors met TDX en Googles Titan-chip als onderdelen van de uitgebreide infrastructuur.

OnderdeelVoorgestelde externe serverUitgebreide Private Cloud Compute
GebruikersOntwikkelaars, bedrijven en overhedenApple-diensten en gebruikers van Apple Intelligence
RekenchipsTwee of vier M8 Ultra-processors worden genoemdNvidia-GPU’s, Intel-processors met TDX en Googles Titan-chip
AI-taakVooral inference met al getrainde modellenApple Intelligence-verwerking in Apples cloudinfrastructuur
Nvidia-rolNVLink Fusion wordt als mogelijke processorverbinding genoemdNvidia-GPU’s en Confidential Computing maken deel uit van de Google Cloud-uitbreiding
TijdMogelijk doeljaar: 2029Apple heeft de uitbreiding naar Google Cloud aangekondigd

De twee trajecten hebben dus een verschillende bestemming. Private Cloud Compute ondersteunt Apples eigen diensten, terwijl de voorgestelde server bedoeld zou zijn voor organisaties die zelf AI-modellen willen draaien. De Google Cloud-infrastructuur met Nvidia-GPU’s is daarmee geen beschrijving van de hardware in de mogelijke M8 Ultra-server.

Apple zegt dat Private Cloud Compute gebruikmaakt van stateless computation, controleerbare garanties, geen bevoorrechte runtime-toegang, non-targetability en verifieerbare transparantie. Ook houdt Apple naar eigen zeggen volledige controle over de PCC-software: Apple-apparaten vertrouwen alleen software die cryptografisch door Apple is goedgekeurd.

Een plan met een lange aanlooptijd

Het genoemde doeljaar 2029 ligt jaren na de berichtgeving over het voorstel. Tot die tijd kunnen de processorconfiguratie, de rol van Nvidia en de timing nog veranderen. Het project kan volgens de berichtgeving ook worden geschrapt.

Voorlopig draait het verhaal daarom om een mogelijke nieuwe productcategorie voor Apple: een extern verkochte AI-server die eigen Apple-silicon combineert met infrastructuur voor organisaties die inference op locatie willen uitvoeren.