O Jalapeño é um acelerador personalizado da OpenAI para inferência de modelos de linguagem de grande porte (LLMs): a etapa em que um modelo treinado gera respostas. A OpenAI afirma que seus modelos ajudaram em tarefas específicas de projeto, otimização e verificação. Engenheiros continuaram tomando as decisões, e a Broadcom assumiu boa parte do desenho físico do chip.
O que é o Jalapeño e onde a IA entrou
OpenAI e Broadcom anunciaram o Jalapeño em 24 de junho de 2026 como um acelerador para inferência e a primeira geração de uma plataforma de computação planejada para várias gerações. A OpenAI o projetou para cargas de trabalho de LLMs. A apresentação do chip detalha sua finalidade de inferência.
Segundo a OpenAI, seus modelos ajudaram a explorar implementações, otimizar circuitos aritméticos e encurtar ciclos de projeto, medição e verificação. Isso é assistência em partes do trabalho de engenharia, não um processo em que a IA cria o chip sozinha.
Por que algumas etapas combinavam com a IA
A assistência se concentrou especialmente em tarefas de projeto mais próximas do software. O fluxo usava XLS, uma cadeia de síntese de alto nível: em termos simples, ela permite descrever circuitos em uma forma mais abstrata antes de convertê-los em uma implementação de hardware.
Esse tipo de trabalho deu aos modelos espaço para ajudar a explorar alternativas e acelerar etapas do desenvolvimento. Ainda assim, engenheiros avaliaram as opções e mantiveram o controle das decisões de projeto.
Como OpenAI, Broadcom e Celestica dividiram o trabalho
A OpenAI conduziu o projeto do sistema de ponta a ponta. A Broadcom cuidou de boa parte do desenho físico, incluindo o trabalho de implementação a partir das portas lógicas. A Celestica participou da integração de placas, racks e sistemas.
A equipe de projeto da OpenAI teve, em média, menos de 100 pessoas; esse número não inclui o pessoal da Broadcom. O tamanho do grupo ajuda a dimensionar o projeto, mas não muda a divisão de tarefas: modelos apoiaram etapas delimitadas, enquanto equipes humanas e parceiros responderam pela engenharia e pela implementação.
O que os dois prazos medem
O intervalo de nove meses corresponde ao percurso do primeiro RTL — a descrição lógica do circuito — ao tape-out, quando o projeto final segue para fabricação. Já o prazo de menos de 20 meses conta da concepção da arquitetura até o primeiro silício. São marcos diferentes, com pontos de partida e chegada próprios.