OpenAI公布Jalapeño芯片基准测试结果,两项指标优于英伟达Blackwell
在8月25日举行的Hot Chips大会上,OpenAI公布了自研芯片Jalapeño的首批基准测试结果。测试采用SemiAnalysis的InferenceX基准,结果显示Jalapeño在每用户令牌数和每千瓦吞吐量上均优于英伟达Blackwell系统,后者是目前可用的最先进推理处理器。
OpenAI硬件负责人Richard Ho在发布会上表示,这些结果显示出相较于现有技术水平非常显著的性能提升。Jalapeño每单位功率可承载更多AI工作负载,同时响应更快,既能高效服务大量客户,也能保持低延迟。
Ho透露,Jalapeño计划于2026年底以非常小的规模开始部署,2027年实现更大规模部署。该芯片于2025年10月首次公布,由OpenAI与博通紧密合作开发,OpenAI自有的模型也参与了开发过程。OpenAI计划将Jalapeño打造为多代际平台,使AI产品、模型、芯片和内存能够协同演进。
得益于全栈式设计,OpenAI能够针对推理流程中容易产生摩擦的特定阶段进行优化。Jalapeño特别针对预填充(prefill)和通信阶段的延迟进行了优化,OpenAI称这些阶段通常是推理过程中的瓶颈。公司表示,Jalapeño的设计目标是最大限度减少数据移动和通信延迟,模型状态(包括生成响应时使用的KV缓存)可被显式放置并保持本地,系统则针对每个推理阶段激活相应的计算、内存和网络资源组合。
- 2026-08-27 08:46 | 华尔街见闻:OpenAI 9个月自研“超越Blackwell芯片”,英伟达还有护城河吗?阅读原文
OpenAI联合博通推出的自研推理芯片Jalapeño首次公布实测数据,性能指标显著超越现有英伟达级别系统,引发市场对AI芯片格局重构的广泛讨论。 据高盛交易部门负责人Rich Privorotsky的最新分析,Jalapeño并非所谓的"英伟达终结者",但其问世标志着AI硬件市场正从高度集中走向多元分化。这一判断直接关系到英伟达的长期估值逻辑——不是今年的出货量,而是未来数年的利润结构。 对市场而言,此次事件的核心影响有两个维度:其一,英伟达在训练芯片和CUDA生态上的护城河短期内不受威胁;其二,推理端这一高频、高量的日常工作负载,正在成为定制芯片的主战场,英伟达的"年金式"收入来源面临渐进...
- 2026-08-26 17:46 | 36氪:OpenAI 芯片实测跑分揭晓,「为模型造芯片」时代来了阅读原文
9 个月之后,OpenAI 的首款芯片成绩单终于揭晓了。 8 月 25 日,在 Hot Chips 大会上,OpenAI 硬件负责人 Richard Ho 站上讲台,公布了 Jalapeño 芯片的第一份公开跑分。 在 SemiAnalysis 的 InferenceX 基准测试中,这颗 OpenAI 与博通联合打造的推理芯片,在「每用户 token 数」和「每千瓦吞吐量」两项关键指标上,双双超过了当下市面上最先进的推理处理器英伟达 Blackwell 系统。 具体而言,OpenAI 用 SemiAnalysis 的公开基准工具 InferenceX,在 GPT-OSS 12...
- 2026-08-26 17:08 | 36氪:用 Astra+Codex 干掉 CUDA,奥特曼9个月AI造芯反杀英伟达 GB300阅读原文
黄仁勋大概没有料到,刺向英伟达最狠的一刀,正是用自家 GPU 造出来的。而一年前,还在为 DeepSeek-R1 连夜补算子、做适配的国产 AI 芯片团队恐怕也很难想到,一年后软件栈里最棘手的硬骨头,模型竟能自己一把闭环。 昨日凌晨(北京时间),OpenAI 首次公布自研推理芯片 Jalapeño 的实测结果:针对 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 等公开大模型,Jalapeño 同时在吞吐量、延迟等多个指标轻松挑落英伟达当代最强 GB300。 OpenAI 被传要自研芯片已经三年多,但直到两个月前,OpenAI 才联...
- 2026-08-26 12:47 | 澎湃新闻:OpenAI推出首款芯片:为智能体设计,速度更快功耗更低阅读原文
“我们造了一颗芯片,它速度很快。”8月26日,OpenAI首席执行官山姆·奥特曼在社交媒体上官宣。当天,OpenAI公布首颗定制推理芯片Jalapeño的技术细节,Jalapeño意为“墨西哥辣椒”,在峰值吞吐量方面,这枚芯片的每瓦峰值性能是参照系统的1.5至1.9倍,凭借单一架构同时实现高吞吐量和低延迟,单位功耗下可处理更多AI任务,响应速度更快。据彭博社报道,OpenAI芯片部门负责人Richard Ho在接受采访时表示,Jalapeño的参照对象是英伟达的GB300芯片。混合Token吞吐量峰值。在最大公开模型Kimi K2.5 1T上,Jalapeño每瓦峰值性能约为参照系统的1.5倍...
- 2026-08-26 07:25 | IT之家:OpenAI 首款自研芯片 Jalapeño 性能首秀:DeepSeek R1 每瓦 AI 吞吐量是 GB300 的 1.7 倍阅读原文
感谢IT之家网友 愚公骑马 的线索投递! IT之家 8 月 26 日消息,OpenAI 昨日(8 月 25 日)发布博文,展示其首款自研 Jalapeño 芯片,并表示无论是单用户 token 处理量,还是每千瓦吞吐量,都超过了目前市面上的顶尖推理处理器。在官方博文中,OpenAI 使用半导体研究公司 SemiAnalysis 开发的公共基准测试工具 InferenceX,通过 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型测试。测试显示对比市面上领先的 AI 系统(GB200 和 GB300),每瓦能够完成的 AI ...
- 2026-08-25 22:22 | TechCrunch:OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show阅读原文
At the Hot Chips conference on Tuesday, OpenAI shared a more detailed look at Jalapeño, including the first batch of benchmark results for the new system. Tested on SemiAnalysis’ InferenceX benchmark, Jalapeño registered both more tokens per user and more throughput per kilowatt than the currently a...
- 2026-08-25 17:30 | 36氪:OpenAI首颗「辣椒」芯片压倒英伟达,GPT-6干崩CUDA阅读原文
你敢信,OpenAI第一次做芯片,竟然把英伟达全系干趴下了?! 就在刚刚,OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」,交出了首批实测成绩单—— AI推理性能,全面反超英伟达GB200和GB300。 实测速度直接起飞! Jalapeño一秒能狂吐1459个Token,英伟达GB200只有535个,连一半都不到。 「辣椒」跑完一个任务只要1.65秒,GB300却得花将近6秒,整整3.6倍的差距。 最狠的是,哪怕把GB300逼到它自己最快的解码速度,Jalapeño的吞吐也依然是它的104.3倍。 而Jalapeño的标称功耗只有700W,GB30...
- 2026-08-25 16:50 | 36氪:OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达阅读原文
一觉醒来,关于 OpenAI 的消息真是满天飞。 先是 X 用户 Leo@synthwavedd 独家声称:OpenAI 已完成一次新的预训练,代号「Bel」,参数规模据称超过 10 万亿,或是 Doug 的继任者,可能成为 Astra /GPT-6 的基础模型…… 一圈搜索下来发现,并没有准确的消息。但确凿无疑的是,OpenAI 的首款自研推理芯片出成绩了。 就在刚刚,OpenAI 公布了首款自研推理芯片 Jalapeño 的最新测试结果:取得了重大突破,这款芯片专为大语言模型推理设计,通过全新的架构设计,它能够同时提升吞吐量,并降低延迟,在保持高能效的同时,实现两者兼得。...