Em entrevista publicada em 28 de setembro, Richard Ho, vice-presidente de hardware da OpenAI, disse que a empresa priorizará o uso do Jalapeño para atender à própria demanda computacional, que está crescendo. Ho também considerou possível o uso do chip por terceiros, mas afirmou que as necessidades da OpenAI vêm primeiro.

OpenAI prioriza a própria demanda computacional

Jalapeño é um ASIC — circuito integrado de aplicação específica — voltado à inferência, a etapa em que um modelo já treinado processa uma solicitação e gera uma resposta. Ho apontou a eficiência como o principal objetivo do projeto.

A possibilidade de uso por outras empresas não equivale a uma decisão de venda: Ho deixou essa opção em aberto, enquanto definiu a demanda interna como prioridade. A declaração não apresentou uma implantação comercial para clientes externos.

Um ASIC de inferência demonstrado com vários modelos

Ho descreveu Jalapeño como programável e não limitado a modelos da OpenAI. A demonstração pública incluiu GPT-OSS, DeepSeek R1 e Kimi K2.5. Esses exemplos mostram os modelos apresentados no chip, sem estabelecer desempenho equivalente para todos os modelos.

A configuração pública do InferenceX

As comparações públicas do InferenceX mencionadas por Ho usaram uma configuração de 8.000 tokens de entrada e 1.000 tokens de saída. Esses valores delimitam a configuração descrita para os testes públicos.

O projeto e o plano de produção descritos por Ho

Ho disse que o trabalho de desenvolvimento do Jalapeño começou do zero em novembro de 2025 e levou nove meses até o tape-out, a etapa em que o projeto final do chip é enviado para fabricação. Engenheiros usaram ferramentas de IA como apoio durante o desenvolvimento.

Na entrevista, Ho descreveu a possibilidade de colocar um volume muito pequeno em um ambiente de produção para testes, se possível, antes de uma expansão mais significativa prevista para 2027.