Der Modus GPT-6 Astra Ultrafast ist in der OpenAI-API und für berechtigte ChatGPT-Work- und Codex-Konten verfügbar. Nvidia bestätigte das am 1. Oktober im Blog: Der Modus läuft auf Blackwell-GPUs und erzeugt bis zu achtmal mehr Tokens pro Zeiteinheit als Astra Standard.
Nvidia beschreibt den Gewinn als Ergebnis von Inferenz-Optimierungen, die OpenAIs eigene Modelle auf der Blackwell-Architektur vorgenommen haben. Das Ziel ist kein isolierter Benchmark. Es ist die Schleife, in der ein Agent Code schreibt, ein Werkzeug aufruft, das Ergebnis prüft und den nächsten Schritt entscheidet. In solchen Schleifen summiert sich die Latenz.
Was OpenAI gesagt hat
Philippe Tillet, Inference Lead bei OpenAI, sagte in Nvidias Text, die Investitionen des Unternehmens in Tools und Dokumentation hätten es den Modellen ermöglicht, Blackwell- und Rubin-GPUs gut zu programmieren. Astra verwandle dieses Wissen in Hochleistungs-Kernel, und Ultrafast mache daraus schnellere Antworten, während Agenten Code schreiben, Werkzeuge nutzen und komplexe Aufgaben bearbeiten.
Uday Ruddarraju, CTO Compute bei OpenAI, sagte, das Unternehmen habe interne Modelle genutzt, um die Inferenz auf Nvidia-GPUs zu optimieren, und die Programmierbarkeit der Plattform habe die Beschleunigung von Ultrafast ermöglicht. Beide Aussagen stammen aus Nvidias Veröffentlichung, nicht aus einer separaten OpenAI-Mitteilung.
Was die Ankündigung nicht sagt
Der Beitrag nennt keinen Preis, kein Kontingent und keine vollständige Liste berechtigter Tarife. Nvidia verweist auf den Ultrafast-Guide von OpenAI für Zugang, Preis und Umsetzung. Einen öffentlichen Vergleich mit GPT-6.1 Sol, dem günstigeren Mittelklasse-Modell vom DevDay, gibt es ebenfalls nicht.
Der Text stellt klar, dass die Leistungsarbeit mit dem Start nicht endet: OpenAI nutzt weiter eigene Modelle, um die Inferenz-Software zu verfeinern. Das ist eine Aussage zum Prozess, kein Versprechen eines neuen Multiplikators.
Quellen
Transparenz: Dieser Inhalt wurde mit Hilfe künstlicher Intelligenz erstellt, bearbeitet oder geprüft. Die Angaben wurden mit öffentlichen Beiträgen auf X und verfügbaren Internetquellen abgeglichen. Prüfen Sie die Originalquellen für den vollständigen Kontext.
Por GeekikiBot