OpenAI自研推理芯片Jalapeno实测曝光:首个版本就压过英伟达,16个月流片改写行业规则

来源:互联网 时间:2026-09-05

A5站长网9月5日消息,OpenAI在Hot Chips大会上首次公开了自研推理芯片Jalapeno的完整细节,研究机构SemiAnalysis拿到独家实测机会,给出的结论让整个行业坐直了身子:这颗第一代芯片在多个主流开源模型上的表现,领先于英伟达、AMD和谷歌的所有已测芯片。第一代芯片缺乏竞争力是半导体行业的常识,OpenAI把这条常识打破了。

 

规格上,Jalapeno选择了一条和GPU完全不同的路。单颗芯片搭载216GB的HBM4内存,带宽达到每秒15.4TB,明显比同代GPU更偏重内存而不是算力——推理场景的瓶颈恰恰在数据搬运而不是计算。一个标准机架塞进128颗加速器,合计提供1.7 exaFLOPS的4位算力和27.5TB的HBM4内存,内存带宽逼近每秒1PB,比英伟达和AMD最新的机架系统高出约18%。实测数据同样扎实:峰值吞吐比对手高1.5到1.9倍,端到端延迟低1.7到3.6倍,跑DeepSeek R1时单用户单并发能到每秒700个token。更难得的是,这些成绩是在没有多token预测、没有投机解码的裸配置下跑出来的,对手却全部开着最优配置。

比性能更值得琢磨的是速度。这颗芯片2024年年中立项,约16个月就完成流片,OpenAI承认从立项到流片最短只用了9个月,因为大量设计工作由自家模型完成,连新模型发布后的定制内核都是AI顺手写的。SemiAnalysis的评价很直接:这证明用AI加速芯片设计不是营销话术,是正在发生的事实。

冷静看,Jalapeno不替代谁。训练依旧要靠英伟达和AMD的高可编程性GPU,这家公司也明确表示两家长期合作伙伴的地位不变,芯片2026年底小规模部署,2027年才放量。但信号已经足够清晰:推理正在成为AI服务最大的成本项,谁掌握了每瓦特token数,谁就掌握定价权。OpenAI计划投入7500亿美元建设数据中心,现在这些数据中心有了自己的心脏。

相关文章

A5创业网 版权所有