Em entrevista publicada em 28 de setembro, Richard Ho, vice-presidente de hardware da OpenAI, disse que a empresa priorizará o uso do Jalapeño para atender à própria demanda computacional, que está crescendo. Ho também considerou possível o uso do chip por terceiros, mas afirmou que as necessidades da OpenAI vêm primeiro.
OpenAI prioriza a própria demanda computacional
Jalapeño é um ASIC — circuito integrado de aplicação específica — voltado à inferência, a etapa em que um modelo já treinado processa uma solicitação e gera uma resposta. Ho apontou a eficiência como o principal objetivo do projeto.
A possibilidade de uso por outras empresas não equivale a uma decisão de venda: Ho deixou essa opção em aberto, enquanto definiu a demanda interna como prioridade. A declaração não apresentou uma implantação comercial para clientes externos.
Um ASIC de inferência demonstrado com vários modelos
Ho descreveu Jalapeño como programável e não limitado a modelos da OpenAI. A demonstração pública incluiu GPT-OSS, DeepSeek R1 e Kimi K2.5. Esses exemplos mostram os modelos apresentados no chip, sem estabelecer desempenho equivalente para todos os modelos.
A configuração pública do InferenceX
As comparações públicas do InferenceX mencionadas por Ho usaram uma configuração de 8.000 tokens de entrada e 1.000 tokens de saída. Esses valores delimitam a configuração descrita para os testes públicos.
O projeto e o plano de produção descritos por Ho
Ho disse que o trabalho de desenvolvimento do Jalapeño começou do zero em novembro de 2025 e levou nove meses até o tape-out, a etapa em que o projeto final do chip é enviado para fabricação. Engenheiros usaram ferramentas de IA como apoio durante o desenvolvimento.
Na entrevista, Ho descreveu a possibilidade de colocar um volume muito pequeno em um ambiente de produção para testes, se possível, antes de uma expansão mais significativa prevista para 2027.