OpenAI 称自研推理芯片 Jalapeño 实测表现超过英伟达 GB300

OpenAI 称自研推理芯片 Jalapeño 实测表现超过英伟达 GB300
OpenAI 称自研推理芯片 Jalapeño 实测表现超过英伟达 GB300

OpenAI 公布首款定制推理芯片 Jalapeño 的首批实测数据,称其在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款外部公开模型上均处于 Pareto 最优前沿。

据 OpenAI 介绍,相较现有最佳商用系统,Jalapeño 的峰值每瓦 AI 产出高出 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍;在高交互智能体场景下,优势扩大至 2.1 至 4.1 倍。

Jalapeño 额定功率为 700 瓦,实测持续功率不超过 550 瓦。OpenAI 表示,在智能体负载下,应以“单位功耗可完成的 AI 工作量”衡量真实成本,而非单芯片性能。

Jalapeño 从设计到流片仅用 9 个月,AI 深度参与了电路优化与验证。借助 Codex 和 GPT-Astra,团队在两个月内将三款未列入原始计划的开放权重模型优化至高性能,部分 AI 生成模块较人类手写实现快 1.5 至 1.8 倍。

OpenAI 计划在年底前将 Jalapeño 部署至自有算力基础设施,同时继续大规模使用英伟达等外部加速器。Jalapeño 是其多代芯片路线图的第一代,第二代已进入深度开发,第三代正在规划中。

© 版权声明
THE END
喜欢就支持一下吧
点赞8 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容