OpenAI wil zijn Jalapeño-chip eerst inzetten om aan de eigen groeiende computervraag te voldoen. Hardwarevicepresident Richard Ho zei dat bredere inzet mogelijk is, maar plaatste OpenAI’s eigen behoefte voorop. Daarmee beschreef hij een interne prioriteit, geen aangekondigde uitrol naar andere klanten.
OpenAI geeft eigen computervraag voorrang
Jalapeño is een ASIC: een toepassingsspecifieke chip die is ontworpen voor een afgebakende taak. De chip is gericht op AI-inferentie, het uitvoeren van een getraind model om antwoorden te genereren, en niet op het trainen van modellen. Ho noemde efficiëntie een belangrijk ontwerpdoel.
Ho liet de mogelijkheid open dat Jalapeño ook buiten OpenAI kan worden ingezet. Zijn boodschap was dat OpenAI eerst de eigen, groeiende vraag naar rekenkracht wil bedienen.
Programmeerbaar en gedemonstreerd met meerdere modellen
Ho omschreef Jalapeño als programmeerbaar en niet vastgelegd op OpenAI-modellen. Tijdens demonstraties draaide de chip GPT-OSS, DeepSeek R1 en Kimi K2.5. Die voorbeelden tonen welke modellen in de demonstraties aan bod kwamen; ze zeggen niet dat de prestaties voor elk model gelijk zijn.
De besproken InferenceX-configuratie
De openbare InferenceX-tests die Ho besprak, gebruikten een vaste configuratie van 8.000 inputtokens en 1.000 outputtokens. Inputtokens zijn de tokens in de prompt; outputtokens zijn de tokens die het model als antwoord genereert. Die aantallen beschrijven de gebruikte testinstelling.
Ontwerpwerk en productieplan volgens Ho
Ho zei dat OpenAI in november 2025 vanaf nul aan het ontwerp begon en dat het traject tot tape-out negen maanden duurde, met hulp van AI-tools. Tape-out is het moment waarop een chipontwerp wordt afgerond voor de productie van de fysieke chip.
Voor de productie schetste Ho een mogelijke eerste stap met een zeer kleine hoeveelheid chips voor tests in een productieomgeving, als dat haalbaar was. Daarna was een grotere opschaling in 2027 het plan.