OpenAI will Jalapeño zunächst einsetzen, um den eigenen wachsenden Rechenbedarf zu decken. Das sagte Hardware-Vizepräsident Richard Ho in einem am 28. September 2026 veröffentlichten Interview. Eine spätere Nutzung außerhalb des Unternehmens schloss er nicht aus.
Ho lässt eine Nutzung außerhalb OpenAIs offen
Ho zufolge wächst OpenAIs Bedarf an Rechenleistung so stark, dass dessen Deckung Vorrang hat. Jalapeño ist ein eigens entwickelter ASIC, also ein anwendungsspezifischer integrierter Schaltkreis. Sein Schwerpunkt ist die Inferenz: das Ausführen trainierter KI-Modelle, um Antworten zu erzeugen.
Eine breitere Nutzung des Chips bleibt für Ho eine Möglichkeit. Als erste Aufgabe nannte er jedoch die Versorgung von OpenAIs eigener Infrastruktur. Das ist die entscheidende Einordnung für alle, die Jalapeño als käuflichen Beschleuniger für andere Unternehmen betrachten.
Ein programmierbarer ASIC für Inferenz
Ho beschrieb Jalapeño als programmierbar und nicht auf OpenAI-Modelle festgelegt. Bei öffentlichen Demonstrationen lief der Chip mit GPT-OSS, DeepSeek R1 und Kimi K2.5. Diese Beispiele zeigen, welche Modelle demonstriert wurden; sie sagen nichts über eine identische Leistung bei allen Modellen aus.
OpenAI stellte Jalapeño im August 2026 auf der Konferenz Hot Chips vor. Eine frühere Einordnung des Chips bietet NeoTeos Jalapeño-Erklärstück.
Die öffentliche InferenceX-Konfiguration
Die im Interview besprochenen öffentlichen InferenceX-Tests verwendeten eine feste Konfiguration: 8.000 Eingabetokens und 1.000 Ausgabetokens. Das beschreibt den Umfang der jeweiligen Testanfragen und -antworten; die Konfiguration ist ein konkreter Rahmen für diese öffentlichen Tests.
Ho beschreibt Entwicklungszeit und Produktionsplan
Ho sagte, die Entwicklung von Jalapeño habe im November 2025 von Grund auf begonnen und bis zum Tape-out neun Monate gedauert. Beim Tape-out wird der fertige Chipentwurf an die Fertigung übergeben. KI-Werkzeuge unterstützten das Entwicklungsteam.
Für den weiteren Ablauf beschrieb Ho einen Plan: Wenn möglich, sollte zunächst eine sehr kleine Stückzahl in einer Produktionsumgebung getestet werden. Einen umfangreicheren Produktionshochlauf sah er für 2027 vor.