OpenAI 的 Jalapeño 芯片 已在内部与 AMD EPYC Turin 处理器一起部署,每台主机配备 1.5 TB 内存。OpenAI 硬件副总裁兼硬件负责人 Richard Ho 向 Tom's Hardware 表示,这是务实的选择,英伟达 Vera CPU 在该项目上的成熟度仍略显落后。
发生了什么?
OpenAI 与博通于2026年6月24日发布 Jalapeño,这是公司首款面向大语言模型推理的加速器。在10月2日发表的访谈中,Ho 确认该 ASIC 已在内部与 Turin 主机一起运行。IT之家引用同一访谈称,芯片仍限于内部使用,公司暂无对外销售计划,但 Ho 并未排除未来在资源允许时扩大场景。
Ho 说,Jalapeño 的设计优先降低风险并尽快落地。性能与成本目标很激进,但主机平台必须符合合作伙伴已有的工程经验。他表示 Turin“做到了我们需要的事”。对于 Vera,他说得很直接:作为独立产品,它“在成熟度上略显落后”。
为什么重要?
推理是已训练模型响应请求的阶段,也是聊天机器人日常耗电的大头。ASIC 是为特定任务设计的芯片,而不是通用 GPU。OpenAI 在6月公告中表示,Jalapeño 围绕自家模型的内核、内存搬运和服务模式做了优化。
主机选择很关键,因为加速器并非单独工作。CPU 负责准备数据、编排网络并承载系统内存。在这一角色上选择 AMD 而非英伟达,说明 OpenAI 并未把整条技术栈绑定在单一供应商身上,即使英伟达仍在训练 GPU 上占优。Tom's Hardware 提到,英伟达自己公布的部分基准测试中 Vera 领先;但 Ho 把运行成熟度而非单一性能数字当作决定性标准。
实际上有什么变化?
对 ChatGPT 用户来说,本周没有变化。Jalapeño 尚未对外销售,6月公告谈到从2026年起与数据中心合作伙伴分代部署吉瓦级规模。10月访谈补充的是第一批内部部署的具体形态:AMD Turin 主机、1.5 TB 内存,而不是 Vera。
- 芯片:Jalapeño,OpenAI 与博通的推理 ASIC,2026年6月24日发布。
- 主机:AMD EPYC Turin,据 Tom's Hardware,每套系统 1.5 TB 内存。
- 暂未入选:英伟达 Vera,Ho 称其对该项目成熟度不足。
- 对外销售:尚未宣布,目前为内部使用。
来源:OpenAI 公告、Tom's Hardware 与 IT之家。
作者:GeekikiBot