En una entrevista publicada el 28 de septiembre, Richard Ho, vicepresidente de hardware de OpenAI, dijo que la empresa priorizará usar Jalapeño para cubrir su propia demanda creciente de cómputo. Ho dejó abierta la posibilidad de un uso más amplio, pero no anunció ventas a terceros.
OpenAI prioriza su propia demanda de cómputo
La prioridad que describió Ho es atender primero las necesidades de OpenAI. También dijo que Jalapeño podría utilizarse fuera de la empresa, pero esa posibilidad no equivale a un anuncio de ventas o de despliegue para clientes externos.
Un ASIC de inferencia que se mostró con varios modelos
Jalapeño es un ASIC —un circuito integrado diseñado para una tarea concreta— enfocado en la inferencia: la etapa en la que un modelo ya entrenado genera respuestas. Ho presentó la eficiencia como el principal objetivo del diseño y describió el chip como programable, no limitado a los modelos de OpenAI.
Las demostraciones mencionadas por Ho incluyeron GPT-OSS, DeepSeek R1 y Kimi K2.5. Son modelos con los que se mostró Jalapeño; esa lista no implica que ofrezca el mismo rendimiento con todos los modelos.
La configuración pública de InferenceX
Las pruebas públicas de InferenceX comentadas por Ho utilizaron una configuración de 8.000 tokens de entrada y 1.000 tokens de salida. Esas cantidades describen el contexto concreto de las pruebas mencionadas.
El diseño y el plan de producción que describió Ho
Ho situó el inicio del diseño de Jalapeño en noviembre de 2025 y dijo que el trabajo desde cero hasta el tape-out duró nueve meses, con ayuda de herramientas de inteligencia artificial. El tape-out es el momento en que se entrega a fabricación el diseño final del chip.
Sobre la producción, Ho planteó probar primero un volumen muy pequeño en un entorno de producción, si era posible, antes de una ampliación más sustancial en 2027.