公司

OpenAI 公布自研推理芯片 Jalapeño 首批结果:称同功耗更高吞吐并更低时延

  • NVDA
  • AVGO
  • TSM

OpenAI 发布其首款自研推理芯片 Jalapeño 的实测结果,称在多款公开模型上实现更高每瓦性能与更低端到端时延,并计划年内开始在自有算力中部署。公司同时强调将继续大规模使用英伟达及其他伙伴加速器。

01要点

  • OpenAI 称 Jalapeño 在 GPT‑OSS 120B、DeepSeek R1、Kimi K2.5 1T 等模型上,峰值吞吐每瓦约为对照系统的 1.5–1.9 倍,端到端时延低约 1.7–3.6 倍。
  • 评测基于 SemiAnalysis InferenceX 等公开基准,并以「单位功耗下的有用推理工作」为比较口径;芯片标称 700W,测得持续功耗≤550W。
  • 公司计划年底前开始内部部署,并称 Gen2/Gen3 已在推进;同时明确训练与推理仍将广泛采购英伟达等外部加速器。

02发生了什么

2026 年 8 月 25 日,OpenAI 官方发文展示 Jalapeño(与博通共同推进的首款定制推理芯片)首批结果。文章强调其针对 agentic、多步交互负载,在 prefill/decode 不同瓶颈阶段减少数据搬运与通信等待。OpenAI 还称用自身模型加速芯片设计与内核优化,部分注意力/MoE 块上 AI 生成实现比专家手写快 1.5–1.8 倍(限局部模块)。部署节奏:先完成生产合格与软件成熟,再扩规模;制造此前报道指向台积电。

03共识 / 分歧

  • 共识:超大规模实验室自研推理 ASIC 已从规划进入「有公开数字」的阶段;全栈协同(模型—编译—芯片—网络)是其宣称优势。
  • 分歧或未验证:对照系统具体配置、是否代表英伟达最新商用系统、以及客户侧可复现性仍存争议;「年内部署」是自用节奏,对外供应时间表未给。自研成功是否削弱外购 GPU,OpenAI 官方口径是否定「取代」,但市场对长期混合比例判断不一。

04依据与来源

  • OpenAI 官网:Jalapeño’s first results show industry-leading speed and efficiency in AI inference(2026-08-25)
  • 背景交叉:Reuters 等关于 Jalapeño 与 Broadcom/TSMC 合作的既有报道

05影响标注

利好

  • 板块/标的:AVGO · 原因:作为定制推理芯片关键合作方,公开基准若获认可有助于巩固 XPU/ASIC 服务份额叙事。
  • 板块/标的:TSM · 原因:先进制程与先进封装仍是此类 ASIC 量产瓶颈环节,自研放量通常转化为代工需求。

利空

  • 板块/标的:NVDA · 原因:若 OpenAI 推理侧加速转向自研 ASIC,可能降低部分推理 GPU 密度(官方称仍将广泛部署英伟达,实际比例未知)。

中性 / 视情况

  • 短期内以自用部署为主,对行业供给格局的影响取决于良率、软件栈与多代路线是否按期。