OpenAI darà priorità alle proprie esigenze di calcolo per Jalapeño, il chip progettato per l’inferenza dell’intelligenza artificiale. In un’intervista pubblicata il 28 settembre 2026, il vicepresidente hardware Richard Ho ha detto che la domanda interna di OpenAI è in crescita e viene prima; ha lasciato aperta la possibilità di un impiego più ampio, senza annunciare vendite o clienti esterni.

OpenAI mette al primo posto il proprio fabbisogno di calcolo

Jalapeño è un ASIC, cioè un circuito integrato progettato per compiti specifici. Ho ha indicato l’efficienza come principale obiettivo del chip e ha spiegato che l’uso interno è la priorità di OpenAI. Un impiego più ampio resta una possibilità, non una distribuzione esterna annunciata.

Un ASIC programmabile, mostrato con più modelli

Jalapeño è progettato per l’inferenza: la fase in cui un modello già addestrato genera risposte. Ho lo ha descritto come programmabile e non vincolato ai soli modelli di OpenAI. Le dimostrazioni hanno coinvolto GPT-OSS, DeepSeek R1 e Kimi K2.5; questi esempi non indicano prestazioni identiche su ogni modello.

La configurazione pubblica di InferenceX

La configurazione InferenceX citata da Ho prevedeva 8.000 token in ingresso e 1.000 in uscita. È il profilo usato per i confronti pubblici menzionati nell’intervista: un riferimento concreto per quel test, non una descrizione di ogni possibile carico di lavoro.

Il design e il piano produttivo raccontati da Ho

Ho ha riferito che la progettazione di Jalapeño è iniziata da zero nel novembre 2025 e ha richiesto nove mesi fino al tape-out, con l’aiuto di strumenti di IA. Il tape-out è la fase in cui il progetto del chip viene finalizzato per la produzione.

Nell’intervista pubblicata nel settembre 2026, Ho ha descritto il piano di avviare, se possibile, test in ambiente produttivo con un lotto molto piccolo, prima di una crescita più consistente della produzione prevista nel 2027.