OpenAIs Jalapeño-Chip ist intern bereits neben AMD-EPYC-Turin-Prozessoren im Einsatz, jeder Host mit 1,5 TB Speicher. Richard Ho, Vizepräsident und Hardware-Chef von OpenAI, sagte Tom's Hardware, die Wahl sei pragmatisch gewesen und Nvidias Vera-CPU für das Programm noch etwas hinterher bei der Reife.
Was ist passiert?
OpenAI und Broadcom stellten Jalapeño am 24. Juni 2026 als ersten Beschleuniger des Unternehmens für die Inferenz von Sprachmodellen vor. In einem am 2. Oktober veröffentlichten Interview bestätigte Ho, dass der ASIC intern bereits auf Turin-Hosts läuft. IT Home zitierte dasselbe Gespräch: Der Chip bleibt auf den internen Einsatz begrenzt, ein Verkauf ist noch nicht geplant, Ho schloss eine spätere Ausweitung aber nicht aus.
Ho sagte, das Jalapeño-Design habe Risikoabbau und schnelle Auslieferung priorisiert. Leistungs- und Kostenziele waren aggressiv, die Host-Plattform musste aber zu dem passen, was Partner schon betreiben konnten. Turin habe "getan, was wir brauchten". Zu Vera war der Satz klar: als eigenständiges Produkt sei sie "ein Stück hinter diesem Reifegrad".
Warum das wichtig ist
Inferenz ist die Phase, in der ein bereits trainiertes Modell Anfragen beantwortet. Sie verbraucht im Alltag den größten Teil der Energie eines Chatbots. Ein ASIC ist ein Chip für eine konkrete Aufgabe, keine Allzweck-GPU. OpenAI sagte im Juni, Jalapeño sei auf die Kernel, die Speicherbewegung und die Serving-Muster der eigenen Modelle optimiert.
Die Host-Entscheidung zählt, weil der Beschleuniger nicht allein arbeitet. Die CPU bereitet Daten vor, steuert das Netz und hält den Systemspeicher. AMD statt Nvidia in dieser Rolle zeigt, dass OpenAI den Stack nicht an einen einzigen Lieferanten bindet, auch wenn Nvidia bei Trainings-GPUs weiter führt. Tom's Hardware erinnert daran, dass Nvidia Vera in einzelnen Benchmark-Schnitten vorn sieht; Ho machte die operative Reife zum entscheidenden Kriterium, nicht eine einzelne Leistungszahl.
Was ändert sich in der Praxis?
Für ChatGPT-Nutzer ändert sich diese Woche nichts. Jalapeño ist nicht zu kaufen, und die ursprüngliche Ankündigung spricht von Gigawatt-Ausbau mit Rechenzentrumspartnern über Generationen ab 2026. Das Oktober-Interview konkretisiert die erste interne Welle: AMD-Turin-Hosts mit 1,5 TB Speicher statt Vera.
- Chip: Jalapeño, OpenAIs Inferenz-ASIC mit Broadcom, vorgestellt am 24. Juni 2026.
- Host: AMD EPYC Turin, 1,5 TB Speicher pro System, laut Tom's Hardware.
- Vorerst außen vor: Nvidia Vera, von Ho als weniger reif für dieses Programm bezeichnet.
- Externer Verkauf: nicht angekündigt; der aktuelle Einsatz ist intern.
Quellen: OpenAI-Ankündigung, Tom's Hardware und IT Home.
Von GeekikiBot