Richard Ho, wiceprezes OpenAI ds. sprzętu, powiedział 28 września 2026 r., że rosnące zapotrzebowanie firmy na moc obliczeniową ma pierwszeństwo przy wykorzystaniu układu Jalapeño. Szersze użycie pozostaje możliwe, ale Ho jako pierwszy cel wskazał obsługę potrzeb OpenAI.
OpenAI stawia na własne potrzeby obliczeniowe
Jalapeño to układ ASIC, czyli scalony układ zaprojektowany do określonego zastosowania. OpenAI opracowało go z myślą o inferencji — wykonywaniu obliczeń przez wytrenowany model, na przykład podczas generowania odpowiedzi. Richard Ho wskazał efektywność i obniżenie kosztów infrastruktury jako główne cele projektu.
Ho dopuścił możliwość wykorzystania Jalapeño także poza OpenAI. Priorytet jest jednak konkretny: zaspokojenie rosnącego popytu obliczeniowego samej firmy.
Programowalny układ pokazany z kilkoma modelami
Ho opisał Jalapeño jako układ programowalny, nieprzeznaczony wyłącznie dla modeli OpenAI. Podczas publicznych demonstracji uruchomiono na nim GPT-OSS, DeepSeek R1 i Kimi K2.5.
Jalapeño koncentruje się na inferencji, a nie na trenowaniu modeli. Demonstracje z wymienionymi modelami pokazują, że układ można programować do pracy z różnymi modelami; same w sobie nie opisują jednak jego wydajności w każdym możliwym obciążeniu.
Co obejmowała publiczna konfiguracja InferenceX
Omawiane przez Ho publiczne testy InferenceX wykorzystywały 8 000 tokenów wejściowych i 1 000 tokenów wyjściowych. Tokeny to jednostki, na które model dzieli tekst podczas przetwarzania. Te liczby określają konfigurację testu, a nie jeden uniwersalny scenariusz pracy Jalapeño.
Projekt i plan produkcji opisany przez Ho
Ho powiedział, że prace nad Jalapeño od podstaw rozpoczęły się w listopadzie 2025 r. i trwały dziewięć miesięcy — od rozpoczęcia projektu do etapu tape-out, czyli przygotowania projektu układu do produkcji. Inżynierów wspierały narzędzia AI.
W wywiadzie z września 2026 r. Ho mówił o możliwym wyprodukowaniu bardzo małej liczby układów do testów w środowisku produkcyjnym, jeśli będzie to możliwe. Większe zwiększenie produkcji planowano na 2027 r.