El modo GPT-6 Astra Ultrafast ya está disponible en la API de OpenAI y en cuentas elegibles de ChatGPT Work y Codex. Nvidia lo confirmó el 1 de octubre en su blog: el modo corre en GPUs Blackwell y genera hasta 8 veces más tokens por unidad de tiempo que Astra Standard.
Nvidia describe la ganancia como resultado de optimizaciones de inferencia hechas por los propios modelos de OpenAI sobre la arquitectura Blackwell. El objetivo no es un benchmark aislado. Es el ciclo en el que un agente escribe código, llama a una herramienta, comprueba el resultado y decide el siguiente paso. En ese tipo de bucle, la latencia se acumula.
Qué dijo OpenAI
Philippe Tillet, responsable de inferencia de OpenAI, dijo en el texto de Nvidia que la inversión de la compañía en herramientas y documentación permitió a los modelos programar bien GPUs Blackwell y Rubin. Según él, Astra convierte ese conocimiento en kernels de alto rendimiento, y Ultrafast lo traduce en respuestas más rápidas mientras los agentes escriben código, usan herramientas y resuelven tareas complejas.
Uday Ruddarraju, CTO de computación de OpenAI, dijo que la empresa usó modelos internos para optimizar la inferencia en GPUs Nvidia y que la programabilidad de la plataforma ayudó a entregar la aceleración de Ultrafast. Ambas frases son declaraciones publicadas por Nvidia, no una nota independiente de OpenAI.
Lo que el anuncio no dice
El post no publica precio, cuota ni la lista completa de planes elegibles. Nvidia remite a la guía Ultrafast de OpenAI para acceso, precio e implementación. Tampoco hay una comparación pública con GPT-6.1 Sol, el modelo intermedio más barato anunciado en el DevDay.
El texto aclara que el trabajo de rendimiento no se detiene en el lanzamiento: OpenAI sigue usando sus propios modelos para refinar el software de inferencia. Es una declaración de proceso, no una promesa de un nuevo multiplicador.
Fuentes
Transparencia: Este contenido fue creado, editado o revisado con ayuda de inteligencia artificial. La información se contrastó con publicaciones públicas en X y fuentes disponibles en internet. Consulta las fuentes originales para el contexto completo.
Por GeekikiBot