OpenAI发布Jalapeño推理芯片,声称性能超越Nvidia
TECH

OpenAI发布Jalapeño推理芯片,声称性能超越Nvidia

43+
Signals

战略概览

  • 01.
    OpenAI在斯坦福大学举办的Hot Chips大会上首次展示了其定制推理芯片Jalapeño的实时基准测试结果,声称其在每瓦吞吐量和响应延迟方面优于Nvidia的GB300。
  • 02.
    Jalapeño由OpenAI与博通(Broadcom,负责芯片与网络)和Celestica(负责系统集成)联合开发,源于2025年10月双方达成的共同开发10吉瓦定制AI加速器的协议。
  • 03.
    在SemiAnalysis公开的InferenceX基准测试套件中,Jalapeño的每千瓦吞吐量比Nvidia的GB200和GB300机架系统高出1.5倍至1.9倍,端到端延迟则低1.7倍至3.6倍。
  • 04.
    OpenAI计划于2026年底在自家数据中心小批量部署Jalapeño,2027年将进行更大规模的推广。

深度分析

基准图表背后的细节

这些 headline 数据来自SemiAnalysis的公开InferenceX套件,但细节至关重要。该机构自身指出:“所有数据均由OpenAI提供。我们亲自在实验室验证了InferenceX的运行,但并未运行完整的InferenceX基准测试套件”[1]。此次比较还排除了Nvidia最新推出的Vera Rubin系统,这些系统最近才开始发货[2]——这意味着Jalapeño是与即将退出市场的GB200/GB300代产品进行对比,而非Nvidia当前的最新产品。测试未包含多轮对话或多长上下文(AgentX)基准,仅运行了单轮8k/1k测试[1]。在线技术讨论还提出了另一个尚未验证的细节:据报道,Jalapeño的运行跳过了推测性解码(speculative decoding),而这一技术在Rubin级芯片的比较中常被使用,一些人认为这可能夸大了Jalapeño的相对优势——这一说法来自社区讨论,并未在原始报告中确认,因此应视为开放问题,而非既定事实。

押注全栈控制

OpenAI硬件主管Richard Ho简洁地阐述了该项目的目标:“Jalapeño能在单位功耗下处理更多AI任务,同时更快地返回响应”[3]。这一主张背后的设计是深思熟虑的——OpenAI表示,Jalapeño被设计为“最小化数据移动和通信延迟”[4],通过大容量SRAM缓存与每芯片216 GB、带宽达15.4 TB/s的HBM4内存配合,将模型状态和KV缓存保持在计算单元附近[5]。该架构旨在解决在大规模推理中通常成为瓶颈的预填充和通信阶段——这一层优化只有在同时控制芯片、网络和模型的情况下才能实现,而非简单采购现成的GPU系统。该项目的开发速度也异常迅速:从2024年底的架构构想,到2025年完成RTL冻结和流片,再到2026年初在芯片上运行Codex和ChatGPT[5],OpenAI利用自身AI模型与XLS硬件描述语言加速开发[5],实现了约九个月的RTL到流片周期,这在定制芯片领域也属极快速度[6]——这一速度不仅在OpenAI的宣传材料中引人注目,也受到在线评论的特别关注,被普遍视为此次发布中最令人震惊的细节。在彭博科技的采访中,Ho更直白地指出:在同一芯片上同时实现高吞吐量和低延迟是行业首次,这种突破只有在模型、软件和芯片全栈控制的情况下才能实现,而非依赖现成的Nvidia部件组装系统。他还表示,OpenAI特意选择SemiAnalysis的InferenceX套件,是因为它是开源且中立的,而非由OpenAI自身控制的基准。

Nvidia护城河依然坚固之处

Jalapeño是一款仅用于推理的芯片——它不能用于训练模型,而在训练工作负载方面,Nvidia的硬件仍无可撼动[2]。这一区别限制了OpenAI仅凭一次发布所能宣称的独立程度。即使在激进的部署计划下——2026年底小批量部署,2027年更大规模推广[7]——OpenAI的训练堆栈及其背后数十亿美元的GPU采购承诺,仍牢牢依赖Nvidia。Jalapeño所主张的是大规模低成本服务模型的经济性,而非构建模型的能力。

Nvidia的利润率问题与质疑声音

CNBC将Jalapeño视为对Nvidia利润率的新威胁,认为随着模型厂商和超大规模企业定制芯片在快速增长的推理市场中占据份额,Nvidia面临压力[8]。但并非所有人都认同这一观点:分析师Daniel Newman肯定了博通在Jalapeño工程上的贡献,但称“Nvidia杀手”之类的说法是令人厌倦的炒作[9]。在线反应也呈现类似分歧——一些人持怀疑态度,认为这只是厂商主导的演示,只有在独立复现后才值得信任;另一些人则指出SemiAnalysis在实验室的验证是认真对待这些数据的理由。分歧不在于原始数据本身,而在于一个自报的、第一代芯片的发布,应如何与Nvidia多年成熟的量产记录相权衡。公众叙事也随时间显著变化:当博通CEO陈福阳(Hock Tan)在2026年6月首次向Sam Altman和Greg Brockman展示Jalapeño时,他告诉路透社其性能“似乎与Nvidia最新的Blackwell芯片和Google的TPU相当”——这一说法远比两个月后Hot Chips大会上OpenAI公布的性能超越数据要保守得多。从最初谨慎的表述到8月基于基准的激进主张之间的差距,本身也是故事的一部分:Jalapeño的叙事在发布与验证之间显著升级。

历史背景

Jalapeño的架构构想阶段开始。
OpenAI与博通达成协议,共同开发10吉瓦定制AI加速器,这成为Jalapeño项目的起源。
2025年完成RTL冻结,随后于2025年底流片(送至台积电制造);从设计到流片耗时约九个月。
OpenAI与博通首次联合发布Jalapeño;博通CEO陈福阳向Sam Altman和Greg Brockman交付了工作样品;早期样品据称相比典型AI GPU可节省约50%成本。
OpenAI在斯坦福大学举办的Hot Chips大会上首次展示Jalapeño的实时基准测试结果,声称其在性能和能效方面优于Nvidia的GB200和GB300系统。

关键关系图

关键玩家
主题

OpenAI发布Jalapeño推理芯片,声称性能超越Nvidia

OP

OpenAI

Designed Jalapeño around its own LLM roadmap, presented benchmark results at Hot Chips, and plans to deploy the chip in its own data centers starting late 2026.

BR

Broadcom

Co-developed the chip's silicon and networking, including the Tomahawk6 switches used in the system fabric, as part of an October 2025 deal to co-develop 10GW of custom AI accelerators with OpenAI.

CE

Celestica

Handled systems integration for Jalapeño racks.

NV

Nvidia

Incumbent GPU maker whose GB200, GB300, and Blackwell-class systems form the comparison baseline; faces potential margin pressure as custom silicon gains ground in inference.

SE

SemiAnalysis

Independent analyst firm whose public InferenceX benchmark suite was used for the tests; verified the runs in person in the lab but did not run the full benchmark suite itself.

TS

TSMC

Manufactures the Jalapeño chip.

事实来源

9 条引用
  1. [1] OpenAI Jalapeno: Better Than Nvidia
  2. [2] OpenAI Jalapeno Chip Nvidia Benchmark Results
  3. [3] OpenAI's Jalapeno Chip Is Built for Fast Inference at Scale, Benchmarks Show
  4. [4] OpenAI's Upcoming Jalapeno Chip Looks Like It'll Be an Inference Beast
  5. [5] OpenAI Jalapeno ASIC at Hot Chips 2026
  6. [6] OpenAI Claims AI Chip Breakthrough With Broadcom Collaboration: Jalapeno 'Beats' Nvidia's GB300 in Tests
  7. [7] OpenAI Says Its Jalapeno Chip Beats Nvidia's GB300 in First Published Benchmarks
  8. [8] OpenAI's Jalapeno AI Chip Poses a Fresh Threat to Nvidia
  9. [9] Daniel Newman Says Broadcom Deserves Credit for OpenAI's Jalapeno Chip But Calls 'Nvidia Killer' Hype Exhausting

来源文章

Top 5

THE SIGNAL.

Analysts

表示Jalapeño在几乎所有测试场景中均优于Blackwell,且未针对性能曲线上的单一节点进行调优,在低延迟和高吞吐两端均表现出色,但指出其数据来自OpenAI,且未运行多轮、长上下文基准测试。

SemiAnalysis
独立半导体分析机构

将Jalapeño的价值主张定义为在单位功耗下完成更多AI任务,同时更快响应用户。

Richard Ho
OpenAI硬件主管

认为博通应获得Jalapeño工程成就的认可,并称将该芯片称为‘Nvidia杀手’是令人厌倦的炒作。

Daniel Newman
行业分析师
The Crowd

Since announcing Jalapeño, our first custom inference chip, we've been testing it and the system around it. The results show a major advance: more intelligence from every watt and faster responses, delivering both higher throughput and lower latency in one architecture without...

@@OpenAI13143

OpenAI says its new Broadcom-built Jalapeno AI chip outperformed $NVDA GB300 in both throughput per watt and response latency in its testing. The chip is designed specifically for inference, not model training, and runs at around 700 watts. OpenAI plans to begin deploying it for...

@@wallstengine415

OPENAI TOOK ITS FIRST AI CHIP FROM DESIGN TO TAPEOUT IN NINE MONTHS. Now it says the chip beats systems built on NVIDIA's GB200 and GB300 on the curve agents care about. Today OpenAI published the first measured results from Jalapeño, its custom inference chip. Across GPT-OSS...

@@lagerskoy21

OpenAI Just Dropped Benchmarks for Their Own Chip, Jalapeño, and It's Beating Nvidia's GB300

@AskGpts250
Broadcast
OpenAI Says New Jalapeno Chips Outperformed Nvidia in Testing

OpenAI Says New Jalapeno Chips Outperformed Nvidia in Testing

OpenAI's Jalapeño Chip Could Change LLMS Forever

OpenAI's Jalapeño Chip Could Change LLMS Forever

OpenAI's Jalapeño: The Chip That Ends the GPU Hype?

OpenAI's Jalapeño: The Chip That Ends the GPU Hype?

OpenAI发布Jalapeño推理芯片,声称性能超越Nvidia — AI 新闻 | Agentic Brew