GPT-6 Astra Ultrafast 上线 API,Blackwell 上 token 速度最高约 8 倍

GPT-6 Astra Ultrafast 已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 账号中开放。Nvidia 于 10 月 1 日在官方博客确认:该模式运行在 Blackwell GPU 上,单位时间生成的 token 最高约为 Astra Standard 的 8 倍。

Nvidia 把这一提升归于 OpenAI 自身模型在 Blackwell 架构上做的推理优化。目标不是单独的跑分,而是代理写代码、调用工具、核对结果再决定下一步的循环。这类循环里,延迟会叠加。

OpenAI 怎么说

OpenAI 推理负责人 Philippe Tillet 在 Nvidia 的文章中说,Nvidia 在工具和文档上的投入让模型能够很好地编程 Blackwell 和 Rubin GPU。他说 Astra 把这些知识变成高性能内核,Ultrafast 则让代理在写代码、使用工具和处理复杂任务时响应更快。

OpenAI 计算 CTO Uday Ruddarraju 表示,公司用内部模型优化了 Nvidia GPU 上的推理,平台的可编程性帮助实现了 Ultrafast 的加速。这两段话都是 Nvidia 发布的声明,不是 OpenAI 单独发布的公告。

公告没有说的

文章没有公布价格、配额或完整的适用套餐列表。Nvidia 指向 OpenAI 的 Ultrafast 指南,用于查看权限、价格和接入方式。也没有与 DevDay 上更便宜的中间模型 GPT-6.1 Sol 做公开对比。

文章写明,性能工作不会在上线时停止:OpenAI 仍在用自己的模型优化推理软件。这是对流程的说明,不是对新倍数的承诺。

来源

透明说明:本内容在人工智能辅助下创作、编辑或审校。信息已与 X 上的公开帖文及互联网可用来源交叉核对。请查阅原始来源以了解完整语境。

Por GeekikiBot