AMD 和 Cerebras 正将 AMD 的 Helios 机架级 AI 系统与 Cerebras 的晶圆级芯片结合,打造一个解耦的推理平台,将这一组合定位为对英伟达在 AI 数据中心硬件领域主导地位的联合挑战。
TECH

AMD 和 Cerebras 正将 AMD 的 Helios 机架级 AI 系统与 Cerebras 的晶圆级芯片结合,打造一个解耦的推理平台,将这一组合定位为对英伟达在 AI 数据中心硬件领域主导地位的联合挑战。

36+
Signals

战略概览

  • 01.
    AMD 和 Cerebras 宣布建立技术合作,将 AMD Helios 机架级系统与 Cerebras 晶圆级引擎(Wafer-Scale Engine)整合为单一的解耦 AI 推理工作流,旨在实现超低延迟、高吞吐量的模型服务。
  • 02.
    AMD 在 2026 年 7 月 20 日至 23 日举行的 Advancing AI 2026 活动上宣布 Helios 进入全面量产阶段;每台机架配备 72 块 Instinct MI455X GPU、31TB HBM4 内存,以及高达 1.4PB/s 的聚合带宽,GPU 数量与英伟达的 72-GPU NVL72 机架相当。
  • 03.
    微软宣布将在 Azure 上大规模部署 Helios 机架,成为首家公开承诺大规模采用 Helios 的超大规模云厂商,同时推出新的 HDv2 和 HXv2 虚拟机系列。
  • 04.
    AMD 单独宣布将向 Anthropic 投资高达 50 亿美元,后者承诺在其 Helios 机架中部署最多 2 吉瓦的 AMD Instinct MI450 系列 GPU。
  • 05.
    AMD 在 Advancing AI 2026 活动上披露,Helios 的总部署管线约为 20 吉瓦,涵盖微软、Anthropic 以及包括 OpenAI、Meta 和 Oracle 在内的其他已披露客户。
  • 06.
    据称,AMD 与 Cerebras 的联合解决方案在每瓦每秒生成的 token 数量上,相比仅使用 Cerebras 的配置可提升高达 5 倍,但这一数据为建模结果(非实测),且未披露第三方验证。

深度分析

为何 AMD 和 Cerebras 将推理流程一分为二

AMD 的 Helios 机架级平台与 Cerebras 的晶圆级引擎(WSE)并非被简单地拼接成单一的巨型芯片——它们将推理流程拆分为两个专业化的阶段。Helios 负责预填充(prefill):即高吞吐量、大上下文窗口的提示处理任务,72 块 Instinct MI455X GPU 和 31TB HBM4 内存在此类任务中表现出色。Cerebras WSE 则接管解码(decode):即对内存带宽要求极高的 token 生成过程,这决定了聊天机器人或智能体对用户而言的响应速度有多快 [1]。这种分工反映了生产级推理团队用实践得出的教训——单一加速器架构很少能同时优化这两个阶段,因此将预填充与解码任务在专用硅芯片上解耦,如今成为这两家公司实现大规模超低延迟服务的解决方案 [1]

“5 倍”宣称背后的细节

AMD 和 Cerebras 宣称联合系统可实现“每瓦每秒 token 数提升高达 5 倍”,但细节比标题更重要。这一数据是建模得出,而非实测:AMD 性能实验室与 Cerebras 基于单一模拟模型——Kimi 2.6 1T——在 2026 年 7 月测试得出,且未披露任何第三方基准验证 [2]。同样重要的是,其对比基准并非英伟达,甚至不是纯 AMD 机架——而是仅使用 Cerebras WSE 的配置,这意味着该数据仅说明 Helios 配合如何优于 Cerebras 单独运行,而非该联合系统与它所宣称挑战的市场领导者相比表现如何 [2]。真正的生产级数据要等到 2026 年下半年系统通过 Cerebras Cloud 上线后才会出现 [2]

对英伟达收购 Groq 的直接回应——嵌入 AMD 更宏大一周布局中

此次合作的时机与一个具体事件相呼应:行业媒体普遍认为,英伟达收购专为推理优化的 LPU 芯片制造商 Groq,是促使 AMD 与 Cerebras 联手打造竞争性低延迟推理堆栈的导火索,Cerebras 首席执行官 Andrew Feldman 预测,联合产品将击败基于 Groq 的英伟达方案 [3]。这只是 AMD 更宏大一周布局中的一环——该公司还披露了约 20 吉瓦的 Helios 部署承诺管线,涵盖微软 Azure、Anthropic 以及包括 OpenAI、Meta 和 Oracle 在内的更广泛客户群 [4],并单独宣布将向 Anthropic 投资高达 50 亿美元,作为该 AI 实验室承诺部署最多 2 吉瓦 AMD 加速器的交易一部分 [5]。在如此规模背景下,Cerebras 的合作显得相对局限:该方案仅通过 Cerebras Cloud 提供,不作为本地部署产品,且要到 2026 年下半年才开始交付 [1]

硬件对等无法抹平英伟达的软件护城河

即使是看好 AMD 进展的分析师也指出,芯片只是半场战斗。Counterpoint Research 的 Neil Shah 表示,Helios 在原始 GPU 和 CPU 性能上与英伟达“相当”,但他认为英伟达的 CUDA 软件生态仍是 AMD 尚未攻克的更大护城河 [6]。Futurum Group 的 Daniel Newman 认为 AMD 有可信路径占据 20%–25% 的数据中心 GPU 市场份额——相比目前约 4.5% 有显著提升——但这一迁移取决于开发者是否真正将工作负载从 CUDA 迁移出来,而不仅仅是 AMD 在纸面规格上与英伟达对齐 [6]。市场似乎实时反映了这种怀疑:合作消息公布当天,Cerebras 股价上涨约 4%–5%,而 AMD 股价则下跌约 2%–3%,表明投资者仍在将引人注目的硬件发布与软件及工作负载迁移的实际可行性区分开来 [7]

工程师的反应不如新闻稿那般热情

官方在 X 平台的宣传充满庆祝氛围:Cerebras 自家账号称该组合是“智能体 AI 一直在等待的解决方案”,Andrew Feldman 将其描述为“历史性合作”,整合了双方堆栈的最佳优势。但在 Reddit 上,技术社区则谨慎得多。在 r/CerebrasSystems 子版块中,评论者质疑两种截然不同的硬件与软件堆栈——AMD 芯片加 Cerebras 芯片——能否在 AMD 和 Cerebras 设定的紧凑时间表内无缝整合,将其与英伟达收购 Groq、Cerebras 自身与 AWS Trainium 的合作、以及英特尔与 SambaNova 的交易等异构硬件尝试相提并论,这些先例并不总是能顺利集成。该讨论串中的一位技术批评者提出了晶圆级芯片的良率和热应力问题,另一位评论者则反驳称 Cerebras 已宣称解决了晶圆缺陷容忍问题——这一争议在公司宣传之外仍未解决。在 r/hardware 子版块中,更大的讨论焦点甚至不在 Cerebras:而是 ROCm 是否足够成熟,能否让 AMD 硬件与英伟达的对等性在生产环境中真正可用;另有一条讨论线质疑整个行业的数据中心推理建设——包括 Helios——是否时机正确,有高票观点认为,随着服务器 GPU 需求增长放缓,英伟达自身可能正悄然转向设备端推理。值得注意的是,r/AMD_Stock 中的几位评论者认为该交易是互补而非竞争关系,指出 AMD 自 2026 年 2 月的 Series H 轮融资起就已是 Cerebras 的投资者——这一细节削弱了“联合挑战英伟达”的叙事,表明部分社区成员认为这更多是投资组合管理,而非技术突破。

历史背景

由前 SeaMicro 负责人 Andrew Feldman 创立,致力于采用晶圆级而非芯粒(chiplet)方法进行 AI 芯片设计。
发布 Instinct MI300X,这是 AMD 首款赢得显著超大规模采用、并确立其作为 AI 训练与推理可信第二供应商地位的 GPU。
通过 IPO 上市,首日募资 55.5 亿美元,市值在首个交易日达到 660 亿至 950 亿美元之间,历经十余年及两次此前的 IPO 尝试。
AMD 在 Advancing AI 2026 活动上宣布 Helios 进入全面量产,微软宣布成为 Azure 上最新的 Helios 采购方,与早期客户 Meta、OpenAI 和 Oracle 并列。
AMD 宣布将向 Anthropic 投资高达 50 亿美元,作为后者承诺部署最多 2 吉瓦 AMD 加速器的交易的一部分。
AMD 与 Cerebras 在 Advancing AI 2026 活动上联合宣布其 Helios 加晶圆级引擎的解耦推理合作;Cerebras 股价上涨约 4%–5%,而 AMD 股价下跌约 2%–3%。

关键关系图

关键玩家
主题

AMD 和 Cerebras 正将 AMD 的 Helios 机架级 AI 系统与 Cerebras 的晶圆级芯片结合,打造一个解耦的推理平台,将这一组合定位为对英伟达在 AI 数据中心硬件领域主导地位的联合挑战。

事实来源

7 条引用
  1. [1] AMD and Cerebras Announce Industry-Leading Ultra-Low-Latency and High-Throughput AI Inference Solution
  2. [2] AMD-Cerebras Disaggregated Inference: The 5x Claim, Explained
  3. [3] AMD and Cerebras Join Forces Against Nvidia's Groq LPUs
  4. [4] AAI 2026: AMD Delivers Full-Stack Compute for the Agentic AI Era
  5. [5] AMD to Invest Up to $5 Billion in Anthropic as Part of AI Chip Deal
  6. [6] AMD or Cerebras: One AI Stock Is a Buy, the Other Is Overvalued, Says Top Investor
  7. [7] Cerebras Stock Gains on AMD Partnership

来源文章

Top 5

THE SIGNAL.

Analysts

将 AI 推理视为 AI 领域最大的基础设施机遇之一,并认为其多样性需要比单一集成供应商堆栈更灵活的方法。

Dr. Lisa Su
AMD 董事长兼首席执行官

将 Cerebras 定位为提供全球最快的超低延迟推理,并表示 AMD-Cerebras 联合产品将从 2026 年第四季度起从 Cerebras 自有数据中心发货,声称其将击败英伟达基于 Groq 的产品。

Andrew Feldman
Cerebras Systems 首席执行官兼联合创始人

认为 AMD 的 Helios 芯片在硬件层面与英伟达 GPU 和 CPU 具有竞争力(“相当”),但英伟达通过 CUDA 仍拥有更大的软件生态系统优势。

Neil Shah
Counterpoint Research 分析师

认为 AMD 有可信路径占据 20%–25% 的数据中心 GPU 市场份额,相比目前约 4.5% 的份额,这将带来数千亿美元的收入。

Daniel Newman
Futurum Group 分析师兼首席执行官
The Crowd

Today, @AMD and Cerebras introduced a powerful disaggregated inference solution, pairing the right engine to each phase of the inference pipeline. This is what agentic AI has been waiting for: the fastest production inference at massive scale.

@@cerebras1679

Today, @AMD and @cerebras announce a historic partnership. A new disaggregated inference architecture that combines the best of both worlds: AMD Helios for world-class prefill performance and the Cerebras Wafer-Scale Engine for the industry's fastest decode. For years, AI

@@andrewdfeldman499

$AMD unveils Helios, its MI450-powered AI system which CEO Lisa Su calls "the most powerful rack-scale AI infrastructure." Helios is already in full production with shipments beginning at the end of Q3 and ramping through Q4.

@@StockSavvyShay292

AMD and Cerebras Announce Industry-Leading Ultra-Low-Latency and High Throughput AI Inference Solution

@u/RadRunner3394
Broadcast
Helios Is AMD's First AI System To Rival Nvidia Vera Rubin — We Got An Exclusive, First Look

Helios Is AMD's First AI System To Rival Nvidia Vera Rubin — We Got An Exclusive, First Look

Cerebras: What You Need To Know About The Nvidia Competitor After Blockbuster IPO

Cerebras: What You Need To Know About The Nvidia Competitor After Blockbuster IPO

FULL REMARKS: AMD CEO Lisa Su Unveils MI455X AI Chip and Helios Rack at CES 2026 | AI1B

FULL REMARKS: AMD CEO Lisa Su Unveils MI455X AI Chip and Helios Rack at CES 2026 | AI1B

AMD 和 Cerebras 正将 AMD 的 Helios 机架级 AI 系统与 Cerebras 的晶圆级芯片结合,打造一个解耦的推理平台,将这一组合定位为对英伟达在 AI 数据中心硬件领域主导地位的联合挑战。 — AI 新闻 | Agentic Brew