Le Jalapeño ASIC d’OpenAI, premier accélérateur d’inférence de la société, est déjà en usage interne aux côtés d’hôtes AMD EPYC Turin dotés de 1,5 To de mémoire chacun. L’information vient d’un entretien avec Richard Ho, vice-président et responsable hardware, publié par Tom’s Hardware et repris par IT Home le 3 octobre. Le Jalapeño ASIC n’est pas en vente.
Ce qu’a dit Ho
Ho a décrit le choix de Turin comme pragmatique. Selon l’article, il a affirmé que la Vera, la nouvelle CPU de Nvidia pour les agents, « est un peu en retard sur ce niveau de maturité » prise seule. Le programme, a-t-il dit, visait à réduire le risque et à aller vite : des objectifs agressifs de performance et de coût, sans risque de plateforme inutile. La plateforme retenue, a-t-il ajouté, était solide et déjà familière aux partenaires.
Tom’s Hardware cite Ho parlant de l’hôte comme d’un « Turing device ». Dans le contexte de l’article et de la couverture d’IT Home, la CPU en question est l’EPYC Turin. La remarque sur Vera est un jugement de maturité pour le calendrier d’OpenAI, pas un benchmark public de l’entreprise.
Ce que l’on savait déjà
OpenAI et Broadcom ont présenté le Jalapeño ASIC le 24 juin 2026 comme le premier Intelligence Processor de la société, conçu pour l’inférence des modèles de langage. Dans le communiqué, Ho a dit que l’architecture avait été optimisée pour les kernels, le mouvement mémoire, le réseau et les schémas de service qui comptent le plus pour les modèles de frontière. Hock Tan, PDG de Broadcom, a évoqué une feuille de route sur plusieurs générations et des data centers à l’échelle du gigawatt avec Microsoft et d’autres partenaires à partir de 2026. Le tape-out, selon OpenAI, a pris neuf mois.
Ho a dit à Tom’s Hardware que l’usage actuel est interne. Une vente plus large n’est pas le plan immédiat, sans être exclue si les ressources le permettent plus tard. IT Home résume la même position.
Ce qui reste un récit
SemiAnalysis a décrit un déploiement à l’échelle du rack après la présentation de la puce, et c’est ce récit que Tom’s Hardware a soumis à Ho. Disposition des plateaux, puces par rack et gains d’opérations par watt circulent dans cette couverture et dans des synthèses secondaires. OpenAI n’a pas publié ces chiffres dans l’annonce de juin. La topologie du rack doit être traitée comme une information rapportée, pas comme une spec officielle.
Pourquoi c’est important
Le Jalapeño ASIC est l’entrée d’OpenAI dans le silicium d’inférence maison, avec Broadcom. Choisir un hôte AMD plutôt que Vera montre que la course aux accélérateurs ne décide pas seule de la CPU du nœud. Pour qui suit le hardware d’IA, le point nouveau de la semaine est le statut : la puce a quitté l’annonce et est en usage interne, toujours sans produit pour le marché.
Sources : Tom’s Hardware, IT Home et le communiqué OpenAI et Broadcom.
Par GeekikiBot