OpenAI a utilisé ses modèles pour aider à concevoir Jalapeño, son accélérateur d’inférence destiné aux grands modèles de langage. Ils ont contribué à certaines tâches de conception, d’optimisation et de vérification, tandis que les ingénieurs sont restés responsables des décisions et que Broadcom a assuré une grande partie de la conception physique du circuit. OpenAI et Broadcom ont annoncé la puce le 24 juin 2026.
Jalapeño est conçu pour exécuter des modèles déjà entraînés et produire leurs réponses. OpenAI avait présenté la puce comme un accélérateur spécialisé dans l’inférence.
Où l’IA a aidé dans la conception de Jalapeño
OpenAI indique que ses modèles ont aidé les équipes à explorer des implémentations, à raccourcir les boucles de conception, de mesure et de vérification, et à optimiser des circuits arithmétiques. L’assistance se prêtait particulièrement aux tâches logicielles de l’amont du processus.
Le flux de travail faisait appel à XLS, une chaîne de synthèse de haut niveau. Cette méthode s’appuie sur des descriptions proches du logiciel pour élaborer la logique matérielle. Ce terrain plus familier aux modèles d’IA leur permettait d’aider les ingénieurs à examiner différentes pistes de conception.
Le rôle des ingénieurs, d’OpenAI et de Broadcom
Les ingénieurs d’OpenAI ont dirigé le travail et conservé la responsabilité des décisions finales. OpenAI a pris en charge la conception du système dans son ensemble; Broadcom a réalisé une grande partie de la conception physique, qui traduit la logique du circuit en une implantation concrète. Celestica a contribué à l’intégration des cartes, des racks et du système.
Le groupe de conception d’OpenAI comptait en moyenne moins de 100 personnes, sans inclure les équipes de Broadcom. L’IA a donc servi d’outil dans un travail mené par des équipes spécialisées, avec des responsabilités distinctes entre conception du système, mise en œuvre physique et intégration.
Ce que mesurent les délais de conception
Le passage du premier RTL au tape-out a pris neuf mois. Le RTL, ou description logique du circuit, précise le fonctionnement du matériel; le tape-out correspond à l’envoi de la conception finalisée pour fabrication.
Un autre délai, inférieur à 20 mois, va du concept d’architecture aux premières puces. Ces deux durées portent sur des étapes différentes du projet : la première commence au RTL et s’achève au tape-out, la seconde part du concept d’architecture et va jusqu’au premier silicium.