L'ASIC Jalapeño d'OpenAI est déjà déployé en interne aux côtés de serveurs équipés de CPU AMD EPYC Turin et de 1,5 To de mémoire chacun, selon une interview de Richard Ho, vice-président et responsable hardware, publiée par Tom's Hardware le 2 octobre 2026 et reprise par IT Home le 3 octobre.
Que s'est-il passé ?
Ho a expliqué que le choix de Turin était « pragmatique ». La CPU Vera de Nvidia, a-t-il dit au média, est « un peu en retard sur ce niveau de maturité » comme processeur hôte. Turin faisait déjà ce dont le programme avait besoin, et les partenaires d'OpenAI avaient de l'expérience sur la plateforme, ce qui a accéléré le déploiement.
La conception de l'ASIC Jalapeño, selon Ho, a privilégié la réduction des risques et la rapidité. Les objectifs de performance et de coût étaient agressifs, mais l'entreprise ne voulait pas de risque inutile sur la CPU qui héberge l'accélérateur. SemiAnalysis avait décrit un déploiement à l'échelle du rack ; l'interview confirme que ces racks utilisent déjà Turin avec 1,5 To de mémoire.
L'ASIC reste limité à l'usage interne d'OpenAI. Ho a indiqué qu'il n'y a pas de projet de vente externe, sans exclure un usage plus large si les ressources le permettent.
Pourquoi c'est important
L'ASIC Jalapeño est l'accélérateur d'inférence qu'OpenAI et Broadcom ont présenté le 24 juin 2026. Dans le communiqué officiel, OpenAI a dit que la puce était passée du design au tape-out en neuf mois, accélérée par ses propres modèles, et que des échantillons d'ingénierie exécutaient déjà des charges d'apprentissage automatique à la fréquence et à la puissance cibles, dont GPT-5.3-Codex-Spark. Hock Tan, de Broadcom, a évoqué un déploiement à l'échelle du gigawatt avec des partenaires de centres de données à partir de 2026.
La nouveauté d'octobre n'est pas l'annonce de la puce, mais le CPU hôte. Dans un rack d'IA, le CPU ne fait pas le calcul lourd du modèle : il gère mémoire, réseau, prétraitement et le logiciel qui alimente les accélérateurs. Choisir un EPYC Turin mûr plutôt que d'attendre Vera montre qu'OpenAI a préféré raccourcir le chemin vers la production interne.
Qu'est-ce qui change concrètement ?
Pour les utilisateurs de ChatGPT ou de l'API, rien ne change tout de suite. L'ASIC Jalapeño n'est pas en vente et OpenAI n'a pas publié de calendrier de bascule du trafic public. L'interview montre une infrastructure propre déjà allumée, avec beaucoup de mémoire par nœud : 1,5 To est un volume de serveur, pas de PC.
- Usage actuel : interne seulement, selon Richard Ho.
- CPU hôte : AMD EPYC Turin, 1,5 To de mémoire par machine.
- Alternative écartée pour maturité : Nvidia Vera, selon OpenAI.
- Partenaires déjà nommés : Broadcom pour l'implémentation et Celestica pour carte, rack et système.
Sources : Tom's Hardware, IT Home et le communiqué d'OpenAI.
Par GeekikiBot