行业机会
2026-09-13
OpenAI 自研推理芯片 Jalapeño 跑分出炉:功耗仅 700W,据称比英伟达 GB300 更快更省电
OpenAI 自研推理芯片 Jalapeño 跑分出炉:功耗仅 700W,据称比英伟达 GB300 更快更省电
发生了什么
9 月 13 日(Hot Chips 2026 大会期间),OpenAI 首次公开了它与博通(Broadcom)联合研发的自研 AI 推理芯片 Jalapeño 的完整架构与实测跑分。
几个关键数字:
- 整封装功耗约 700W,配 6 颗 HBM4 高带宽内存,带宽 15.4 TB/s;
- 在第三方机构 SemiAnalysis 的公开基准 InferenceX 上,Jalapeño 的每千瓦吞吐量比英伟达 GB200/GB300 高约 1.5–1.9 倍,端到端延迟低约 1.7–3.6 倍;
- 它只负责「推理」——也就是模型训练好后回答用户请求这一步,不参与训练;OpenAI 计划 2026 年底起在自家数据中心小批量上线,2027 年扩大部署。
对我有什么用
过去大模型推理几乎全靠英伟达 GPU。OpenAI 自己下场造芯片,意味着头部实验室开始把「算力成本」这件事攥回自己手里:芯片专为低延迟、低功耗推理设计,目标是在同样的电费下多干几倍的活。对行业来说,这是「大模型公司不想只当英伟达客户」的明确信号。
不过要冷静看:英伟达下一代 Vera Rubin 平台已经开始出货,且训练芯片仍是英伟达的天下;Jalapeño 的对比对象主要是上一代 Blackwell,并不等于全面超越。
我可以怎么做
- 你暂时用不到这块芯片本身,但它直接影响你用的产品:ChatGPT、API 调用如果跑在更省电的芯片上,响应更快、单次成本更低,未来可能体现为新功能更便宜、高峰期不那么卡。
- 关注「推理芯片」这件事,能帮你理解为什么有些 AI 产品突然降价——底层算力成本下来了。
温馨提醒
- 这是 OpenAI 自己公布的跑分,第三方 SemiAnalysis 到场见证了测试,但对比用的是英伟达「上一代」旗舰,并非最新平台,结论别过度 extrapolate。
- 芯片 2026 年底才小规模上线,距离大规模影响你的日常体验还有时间。
- 它不训练模型,所以「模型变聪明」和这块芯片无关,别混淆。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法