OpenAI 公布首款定制推理芯片 Jalapeño 实测数据:每瓦性能达英伟达对比系统 1.5 至 1.9 倍
2026年8月26日,OpenAI正式公布了其首款定制推理芯片Jalapeño的首批实测性能数据。在基于开源模型GPT-OSS 120B的InferenceX基准测试中,Jalapeño的每千瓦峰值吞吐量和Token延迟均优于英伟达GB200/GB300等商用AI系统。
测试覆盖GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三个模型。结果显示,Jalapeño每瓦AI工作量是对比系统的1.5至1.9倍,端到端延迟降低1.7至3.6倍;在高交互性工作负载下,性能提升2.1至4.1倍。以DeepSeek R1为例,Jalapeño单用户生成速度约700 tok/s,而对比系统为169 tok/s。测试统一设置为8K输入、1K输出,未开启推测解码。
硬件规格方面,Jalapeño采用台积电N3P工艺,TDP为700W,实测持续功耗不超过550W。OpenAI表示,该芯片计划于2026年底开始部署到自有算力基础设施中,下一阶段目标是100MW规模。
据SemiAnalysis验证,Jalapeño在GSM8k精度上与英伟达芯片持平,并被认为是一款通用推理引擎,而非OpenAI模型的专属芯片。此外,OpenAI透露AI深度参与了芯片设计,包括探索实现方案、缩短验证循环、优化算术电路等,部分AI生成的内核实现比人类专家手写版本快1.5至1.8倍。
- 2026-08-27 09:17 | 界面新闻:OpenAI发布首款自研推理芯片,科创芯片设计ETF天弘(589070)昨日净流入超2200万元,连续8日净流入超1.2亿元阅读原文
截至2026年8月26日收盘,科创芯片设计ETF天弘(589070)跟踪的上证科创板芯片设计主题指数(950162)上涨0.64%,成分股芯原股份上涨9.73%,力芯微上涨5.33%,盛科通信上涨3.73%,峰岹科技上涨3.58%,芯朋微上涨3.56%。截至8月26日,科创芯片设计ETF天弘(589070)最新资金净流入2247万元,近8天获得连续资金净流入,合计“吸金” 1.26亿元。【产品亮点】科创芯片设计ETF天弘(589070)紧密跟踪上证科创板芯片设计主题指数,上证科创板芯片设计主题指数选取科创板内业务涉及芯片设计领域的上市公司证券作为指数样本,以反映科创板芯片设计领域上市公司证券的...
- 2026-08-27 08:42 | 36氪:AI 开始给自己造芯了,从零到生产 OpenAI 只用了九个月阅读原文
「造芯」这件事,已成了一种潮流。 OpenAI 公布了和博通联合自研的首款 AI 推理芯片 Jalapeño(墨西哥辣椒)首轮公开测试成绩。 在 SemiAnalysis 发布的公开基准测试 InferenceX 上,Jalapeño 运行了 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型,结果显示,Jalapeño 每瓦完成的 AI 工作比英伟达 GB200、GB300 多 1.5—1.9 倍,端到端延迟缩短至对照系统的约 30%—60%。 运行 DeepSeek R1 时,一次 8K 输入、1K 输出的推理从 5.99 ...
- 2026-08-26 20:12 | 爱范儿:AI 开始给自己造芯了,OpenAI 只用了九个月阅读原文
「造芯」这件事,已成了一种潮流。 就在昨晚,OpenAI 公布了和博通联合自研的首款 AI 推理芯片 Jalapeño(墨西哥辣椒)首轮公开测试成绩。 在 SemiAnalysis 发布的公开基准测试 InferenceX 上,Jalapeño 运行了 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型,结果显示,Jalapeño 每瓦完成的 AI 工作比英伟达 GB200、GB300 多 1.5—1.9 倍,端到端延迟缩短至对照系统的约 30%—60%。 运行 DeepSeek R1 时,一次 8K 输入、1K 输出的推理从 5.99 秒降到...
- 2026-08-26 17:47 | 爱范儿:OpenAI 自研「辣椒芯片」首测超英伟达,会让 ChatGPT 更便宜吗?阅读原文
做芯片很难,第一代产品就做到有竞争力更难。OpenAI 这次交出的答案,至少在大模型推理这件事上,已经足够夸张。 今天,OpenAI 正式公布了其首款定制推理芯片 Jalapeño(墨西哥辣椒)的首批实测性能数据。 在基于自己开源模型 GPT-OSS 120B 的公开基准测试 InferenceX 上,Jalapeño 的每千瓦峰值吞吐量和 Token 延迟都比现有的硬件系统表现要好。 要知道,对大多数芯片来说,吞吐和延迟往往是一道只能二选一的难题。而除了针对 OpenAI 的大模型优化明显,芯片在 670B 的 DeepSeek R1 和 1T 的 Kimi K2.5 上表现也更出色,对手...