La puce Jalapeño d'OpenAI est déjà déployée en interne aux côtés de processeurs AMD EPYC Turin, chaque hôte avec 1,5 To de mémoire. Richard Ho, vice-président et responsable hardware d'OpenAI, a dit à Tom's Hardware que le choix était pragmatique et que le CPU Vera de Nvidia restait un peu en retrait en maturité pour ce programme.
Que s'est-il passé ?
OpenAI et Broadcom ont présenté Jalapeño le 24 juin 2026 comme le premier accélérateur de l'entreprise conçu pour l'inférence de modèles de langage. Dans un entretien publié le 2 octobre, Ho a confirmé que l'ASIC tourne déjà en interne sur des hôtes Turin. IT Home, citant le même échange, indique que la puce reste limitée à un usage interne et que l'entreprise ne prévoit pas encore de la vendre, même si Ho n'écarte pas un usage plus large si la capacité le permet plus tard.
Ho a expliqué que la conception de Jalapeño a privilégié la réduction du risque et une mise en service rapide. Les objectifs de performance et de coût étaient agressifs, mais la plateforme hôte devait correspondre à ce que les partenaires savaient déjà exploiter. Turin, a-t-il dit, "a fait ce dont nous avions besoin". Sur Vera, la phrase est directe : en produit isolé, elle est "un peu en retard sur ce niveau de maturité".
Pourquoi c'est important
L'inférence est l'étape où un modèle déjà entraîné répond aux requêtes. C'est ce qui consomme l'essentiel de l'énergie d'un chatbot au quotidien. Un ASIC est une puce conçue pour une tâche précise, et non un GPU généraliste. OpenAI a dit en juin que Jalapeño avait été optimisé pour les kernels, le mouvement de mémoire et les schémas de service de ses propres modèles.
Le choix de l'hôte compte parce que l'accélérateur ne travaille pas seul. Le CPU prépare les données, orchestre le réseau et porte la mémoire système. Choisir AMD, et non Nvidia, pour ce rôle montre qu'OpenAI ne lie pas toute la pile à un seul fournisseur, même si Nvidia domine encore les GPU d'entraînement. Tom's Hardware rappelle que Nvidia elle-même publie Vera en tête sur certains découpages de benchmarks ; Ho a toutefois traité la maturité opérationnelle comme le critère décisif, pas un chiffre isolé.
Qu'est-ce qui change concrètement ?
Pour les utilisateurs de ChatGPT, rien ne change cette semaine. Jalapeño n'est pas en vente et l'annonce originale parle d'un déploiement à l'échelle du gigawatt avec des partenaires de centres de données, sur plusieurs générations, à partir de 2026. L'entretien d'octobre précise la forme de la première vague interne : des hôtes AMD Turin avec 1,5 To de mémoire, et non Vera.
- Puce : Jalapeño, ASIC d'inférence d'OpenAI avec Broadcom, dévoilé le 24 juin 2026.
- Hôte : AMD EPYC Turin, 1,5 To de mémoire par système, selon Tom's Hardware.
- Écartée pour l'instant : Nvidia Vera, jugée moins mature par Ho pour ce programme.
- Vente externe : non annoncée ; l'usage actuel est interne.
Sources : annonce OpenAI, Tom's Hardware et IT Home.
Par GeekikiBot