GPT-6 Astra Ultrafast arrive sur l’API avec jusqu’à 8x plus de tokens sur Blackwell

Le mode GPT-6 Astra Ultrafast est disponible dans l’API OpenAI et pour les comptes éligibles ChatGPT Work et Codex. Nvidia l’a confirmé le 1er octobre sur son blog : le mode tourne sur des GPU Blackwell et génère jusqu’à 8 fois plus de tokens par unité de temps que Astra Standard.

Nvidia présente ce gain comme le résultat d’optimisations d’inférence réalisées par les modèles d’OpenAI sur l’architecture Blackwell. La cible n’est pas un benchmark isolé. C’est la boucle dans laquelle un agent écrit du code, appelle un outil, vérifie le résultat et décide de l’étape suivante. Dans ce type de boucle, la latence s’accumule.

Ce qu’OpenAI a dit

Philippe Tillet, responsable de l’inférence chez OpenAI, a déclaré dans le texte de Nvidia que l’investissement de l’entreprise dans les outils et la documentation a permis aux modèles de bien programmer les GPU Blackwell et Rubin. Selon lui, Astra transforme ce savoir en kernels haute performance, et Ultrafast en fait des réponses plus rapides pendant que les agents écrivent du code, utilisent des outils et traitent des tâches complexes.

Uday Ruddarraju, CTO compute d’OpenAI, a dit que l’entreprise a utilisé des modèles internes pour optimiser l’inférence sur les GPU Nvidia et que la programmabilité de la plateforme a aidé à livrer l’accélération d’Ultrafast. Les deux propos sont des déclarations publiées par Nvidia, pas une note distincte d’OpenAI.

Ce que l’annonce ne dit pas

Le billet ne publie ni prix, ni quota, ni liste complète des offres éligibles. Nvidia renvoie vers le guide Ultrafast d’OpenAI pour l’accès, le tarif et l’implémentation. Il n’y a pas non plus de comparaison publique avec GPT-6.1 Sol, le modèle intermédiaire moins cher annoncé au DevDay.

Le texte précise que le travail de performance ne s’arrête pas au lancement : OpenAI continue d’utiliser ses propres modèles pour affiner le logiciel d’inférence. C’est une déclaration de processus, pas une promesse de nouveau multiplicateur.

Sources

Transparence : Ce contenu a été créé, édité ou relu avec l’aide d’une intelligence artificielle. Les informations ont été croisées avec des publications publiques sur X et des sources disponibles sur internet. Consultez les sources originales pour le contexte complet.

Por GeekikiBot