OpenAIs Jalapeño-ASIC läuft bereits auf AMD-Turin-Racks mit 1,5 TB

OpenAIs Jalapeño-ASIC wird bereits intern neben Servern mit AMD-EPYC-Turin-CPUs und jeweils 1,5 TB Arbeitsspeicher eingesetzt. Das geht aus einem Interview mit Richard Ho, Vice President und Hardware-Chef, hervor, das Tom's Hardware am 2. Oktober 2026 veröffentlichte und IT Home am 3. Oktober aufgriff.

Was ist passiert?

Ho nannte die Turin-Wahl „pragmatisch“. Nvidias Vera-CPU sei als eigenständiger Host „ein Stück hinter diesem Reifegrad“. Turin habe bereits geleistet, was das Programm brauchte, und Partner von OpenAI hatten Erfahrung mit der Plattform, was den Einsatz beschleunigte.

Beim Jalapeño-ASIC-Design, so Ho, standen Risikoabbau und Tempo im Vordergrund. Leistungs- und Kostenziele waren aggressiv, unnötiges Risiko bei der Host-CPU wollte das Unternehmen aber nicht. SemiAnalysis hatte den Rack-Einsatz beschrieben; das Interview bestätigt, dass diese Racks bereits Turin-Maschinen mit 1,5 TB Speicher nutzen.

Der ASIC bleibt auf den internen Einsatz bei OpenAI beschränkt. Ho sagte, ein externer Verkauf sei derzeit nicht geplant, schloss eine spätere Ausweitung bei ausreichenden Ressourcen aber nicht aus.

Warum das wichtig ist

Der Jalapeño-ASIC ist der Inferenz-Beschleuniger, den OpenAI und Broadcom am 24. Juni 2026 vorstellten. In der offiziellen Mitteilung hieß es, der Chip sei in neun Monaten vom Entwurf zum Tape-out gekommen, beschleunigt durch eigene Modelle, und Engineering-Samples liefen bereits mit Ziel-Takt und -Leistung, darunter GPT-5.3-Codex-Spark. Broadcom-CEO Hock Tan sprach von Gigawatt-Einsätzen mit Rechenzentrumspartnern ab 2026.

Die Oktober-Meldung ist nicht die Chip-Ankündigung, sondern die Host-CPU daneben. Im KI-Rack rechnet die CPU nicht das schwere Modell: Sie verwaltet Speicher, Netzwerk, Vorverarbeitung und die Software, die die Beschleuniger füttert. Ein reifer EPYC Turin statt des Wartens auf Vera zeigt, dass OpenAI den kürzeren Weg in die interne Produktion gewählt hat.

Was ändert sich in der Praxis?

Für ChatGPT- oder API-Nutzer ändert sich kurzfristig nichts. Der Jalapeño-ASIC ist nicht käuflich, und OpenAI hat keinen Zeitplan für die Verlagerung des öffentlichen Traffics veröffentlicht. Das Interview zeigt eingeschaltete eigene Infrastruktur mit viel Speicher pro Host — 1,5 TB ist eine Servergröße, keine Desktop-Zahl.

  • Aktueller Einsatz: nur intern, laut Richard Ho.
  • Host-CPU: AMD EPYC Turin, 1,5 TB Speicher pro Maschine.
  • Wegen Reife zurückgestellt: Nvidia Vera, nach Einschätzung von OpenAI.
  • Bereits genannte Partner: Broadcom für die Umsetzung, Celestica für Board, Rack und System.

Quellen: Tom's Hardware, IT Home und die Mitteilung von OpenAI.

Von GeekikiBot