NVIDIA Vera Rubin的智能体AI基础设施发布
TECH

NVIDIA Vera Rubin的智能体AI基础设施发布

40+
Signals

战略概览

  • 01.
    NVIDIA的Vera Rubin平台正全面投入生产,以支持智能体AI工厂,NVIDIA称其在大规模部署下,智能体吞吐量相较上一代Grace Blackwell平台提升了10倍。
  • 02.
    Groq 3 LPX——一款基于Groq收购技术打造的专用低延迟推理加速器——已进入全面生产阶段,并与Vera Rubin平台配对使用,Nebius成为首家在其Token Factory推理服务中部署该组合的云服务商。
  • 03.
    SpaceXAI正在部署独立的NVIDIA Vera CPU以支持Grok的智能体工作负载,并计划与NVIDIA合作,将经过空间优化的Vera Rubin NVL72机架搭载于第一代Starmind卫星,发射至轨道。
  • 04.
    NVIDIA于2025年12月以约200亿美元现金收购Groq的关键推理芯片资产,交易结构为资产购买与人才收购(acquihire),而非全面企业并购,创下NVIDIA史上最大交易纪录。

深度分析

一个无人能完全验证的10倍数字

NVIDIA对Vera Rubin的核心宣传集中在一个倍数上:在大规模部署下,智能体吞吐量相较上一代Grace Blackwell平台提升10倍[1],而当Groq 3 LPX与Vera Rubin NVL72结合后,预计在运行长上下文、低延迟工作负载的千亿参数以上模型时,每兆瓦的推理吞吐量将提升35倍[2]。NVIDIA将Vera Rubin定位为应对下一波AI建设周期中每token能耗与延迟这一核心瓶颈的解决方案,该平台有望打开约2000亿美元的可寻址市场[3]

然而问题在于,这一数字并非真正意义上的同构芯片对比,网络舆论也由此分裂为两派。Reddit上r/nvidia板块关于该公告的热门评论将NVIDIA的数据斥为“宣传噱头”,认为这一显著提升并未反映底层芯片的普遍飞跃,而是部分归功于“一个现已集成在机架上的专用LPU,由Groq与NVIDIA合作开发”,该LPU是外挂于机架而非直接集成在Rubin GPU芯片内部。这种解读与实际对比方式一致:10倍数据是将包含Rubin GPU和以约200亿美元收购的专用推理芯片的异构机架[4],与上一代纯GPU系统进行对比,这与直接的制程节点比较是不同的衡量方式。

但质疑声并非全貌。独立云服务商CoreWeave已在生产环境中运行Vera Rubin NVL72,并引用了其自身实测结果,而非预测数据:在DeepSeek-R1模型上,每兆瓦每秒生成的token数相较上一代Blackwell提升了约10倍。这与NVIDIA自身的营销声明性质截然不同,是真实部署中的实际数据,直接挑战了Reddit社区“纯属宣传”的结论。最终,真相更接近厂商宣传还是社区质疑,可能要等到除NVIDIA首发合作伙伴外的更多运营商公布实测数据后才能揭晓。

为何CPU而非GPU才是智能体的真正主角

此次发布中最反直觉的细节是,SpaceXAI为Grok部署的重头戏并非Rubin GPU,而是独立的Vera CPU[5]。Vera芯片搭载88个定制Olympus核心(兼容Armv9.2)、176个线程、164MB统一L3缓存,以及最高达1.2 TB/s的LPDDR5X内存带宽,NVIDIA称其IPC性能较前代Grace芯片提升高达50%[6]。SpaceXAI总裁Mike Nicolls直接解释了其逻辑:“Vera为我们提供了CPU性能和内存带宽,以运行大规模的编排、代码和数据处理,同时让GPU专注于其最擅长的任务。”[5]NVIDIA副总裁Ian Buck也从厂商角度表达了相同观点:“Vera赋予AI智能体实时行动的能力,执行代码、处理数据并协调复杂任务。”[5]

这一表述至关重要,因为它揭示了NVIDIA当前对智能体AI瓶颈的认知。黄仁勋将单个智能体提示描述为触发“涉及推理、检索、工具调用和响应生成的千步旅程”[1],而这一千步中的绝大多数属于控制流和编排任务,这类高延迟敏感、分支密集的计算正是GPU不擅长而CPU专为优化的领域。通过将Vera CPU与Rubin GPU解耦,并作为独立的编排层销售,NVIDIA实际上在表明:扩展智能体AI需要购买更多CPU容量,而不仅仅是更多GPU容量,这标志着与自生成式AI热潮以来一直主导AI基础设施的“GPU中心主义”支出叙事的重大背离。

NVIDIA自身的技术资料也在硬件层面明确划分了这种分工。Groq 3 LPX在16个托盘上集成256个Groq LPU,提供约每秒40拍字节的SRAM带宽,专为超低延迟设计;而Vera Rubin NVL72则针对原始吞吐量优化。NVIDIA将两者定位为“NVL72以最高吞吐量生成token,Groq LPX以最低延迟生成token”,两套引擎应并行运行而非竞争同一工作负载。在Hot Chips 2026大会上,NVIDIA将Vera CPU、Rubin GPU、Groq 3 LPX、Spectrum-X Multiplane网络和BlueField-4 scale-in架构共同呈现为一个集成的AI堆栈,而非独立芯片组合,进一步强调其真正销售的是编排与网络能力,而非单一芯片。微软已部署首个运行中的Vera Rubin NVL72系统,NVIDIA引用其“全自动制造、计算托盘约一分钟内组装完成”的案例,证明该平台已实现大规模出货,而非停留在试点阶段。

一项200亿美元为规避反垄断审查而设计的交易

严格来说,NVIDIA对Groq的收购并非企业并购。“NVIDIA并非收购Groq公司,而是以资产购买形式进行”[4],以约200亿美元现金收购该初创企业的关键推理芯片资产,创下NVIDIA史上最大交易,超过2019年约70亿美元收购Mellanox的纪录[4]。黄仁勋已确认,其意图是将Groq的低延迟处理器直接整合进NVIDIA的AI工厂架构:“我们计划将Groq的低延迟处理器集成到NVIDIA AI工厂架构中。”[7]最终成果即Groq 3 LPX,现已成为与Vera Rubin NVL72并行运行的双引擎推理架构中的低延迟部分。

这种资产购买加人才收购的结构,在剥离Groq法律实体的同时由NVIDIA吸收其技术,正是华盛顿方面关注的焦点。美国参议员伊丽莎白·沃伦(Elizabeth Warren)和理查德·布卢门撒尔(Richard Blumenthal)公开质疑该交易是否旨在规避反垄断审查,指出NVIDIA在GPU市场占据约90%份额:“通过进一步巩固NVIDIA对AI芯片行业的控制,Groq交易限制了消费者选择和创新,最终将推高价格,并威胁国内企业与中国竞争的能力。”[8]这种紧张关系是结构性的,而非偶然:正是这种让NVIDIA能在数月内快速整合Groq技术并投入量产的收购机制,也正是监管机构视为规避全面企业并购所触发的合并审查的手段。

从数据中心到轨道,一个无人正式确认的时间表

除地面云服务外,NVIDIA与SpaceXAI还承诺了一项更不寻常的计划:将经过空间优化的Vera Rubin NVL72——通常为72个Rubin GPU、36个Vera CPU、全液冷机架[5]——搭载于SpaceX第一代Starmind卫星,发射至轨道。据援引埃隆·马斯克言论的媒体报道,首个改装单元预计于2027年第四季度进入轨道,更大规模的部署计划于2028年进行[9]。但这一时间表并未出现在NVIDIA与SpaceXAI的官方公告材料中,后者未提供轨道部署的正式发射日期、时间线或容量数据[5],这意味着目前与该计划关联的最具体日期仅来自公开言论,而非企业承诺。

这一差距至关重要,因为工程挑战巨大:一个设计用于配备设施水冷系统的恒温数据中心的机架,必须重新设计以应对辐射暴露、通过散热器而非液冷系统进行热排放,以及发射过程中的振动耐受性[9]。该计划还面临现实的地面执行风险:据报道,NVIDIA下一代服务器机架系统因专用连接器电路板问题遭遇制造延迟,尽管黄仁勋坚称Vera Rubin的生产规模仍按“巨大”计划推进[10]。在此背景下,印度AM Intelligence订购9000套Vera Rubin系统并于明年交付[11],表明地面部署真实且规模庞大,无论轨道计划结果如何,但也凸显了NVIDIA在轨道变体尚未确认发射日期前,已承诺的制造产能之巨。

历史背景

NVIDIA同意以约200亿美元现金收购Groq的关键资产,创下其史上最大交易,交易结构为许可与人才收购协议,而非全面企业并购。
NVIDIA在台北GTC大会上宣布Vera Rubin平台全面投入生产,黄仁勋宣布“有用AI已到来”。
有报道称NVIDIA下一代AI服务器机架系统因专用电路板问题遭遇制造延迟,尽管黄仁勋坚称Vera Rubin的生产规模仍按“巨大”计划推进。
NVIDIA宣布Groq 3 LPX进入全面生产,Nebius作为首家云服务商在其Token Factory中采用,SpaceXAI采用Vera CPU支持Grok,并公布Starmind轨道卫星计划。
印度AI基础设施公司AM Intelligence订购9000套NVIDIA Vera Rubin系统,计划于明年在印度南部上线。

关键关系图

关键玩家
主题

NVIDIA Vera Rubin的智能体AI基础设施发布

NV

NVIDIA

Platform owner driving Vera Rubin (Vera CPU plus Rubin GPU) into full production, and acquirer of Groq's inference-chip assets for roughly $20 billion, integrating Groq 3 LPX into the Vera Rubin stack for agentic inference.

NE

Nebius

First AI cloud provider to adopt NVIDIA Groq 3 LPX in its production Token Factory inference platform alongside Vera Rubin NVL72.

SP

SpaceXAI

Deploying standalone NVIDIA Vera CPUs to power Grok's agentic workloads and partnering with NVIDIA to send a space-optimized Vera Rubin NVL72 into orbit aboard the Starmind satellite.

GR

Groq

AI inference-chip startup whose key inference-chip assets were absorbed into NVIDIA via a roughly $20 billion licensing-and-acquihire deal; its LPU technology forms the basis of Groq 3 LPX.

US

US Senators Elizabeth Warren and Richard Blumenthal

Publicly questioned whether NVIDIA's Groq deal structure was designed to evade antitrust review, citing NVIDIA's roughly 90% GPU market share, applying regulatory pressure that could shape how future NVIDIA acquisitions are structured.

事实来源

11 条引用
  1. [1] NVIDIA Vera Rubin Full Production Agentic AI Factory
  2. [2] NVIDIA Groq 3 LPX Boosts Nebius Token Factory
  3. [3] Jensen Huang Declares the Age of Agents at GTC Taipei
  4. [4] Nvidia Buying AI Chip Startup Groq's Assets for About $20 Billion
  5. [5] SpaceXAI Adopts NVIDIA Vera CPUs for Grok With a Vera Rubin NVL72 Bound for Orbit in Starmind
  6. [6] NVIDIA Details Vera CPU With 88 Olympus Cores, 176 Threads and 1.2 TB/s LPDDR5X Memory
  7. [7] NVIDIA's $20 Billion Groq Acquisition Just Paid Off
  8. [8] Warren, Blumenthal Question Whether NVIDIA's $20 Billion Groq Deal Is Attempt to Avoid Antitrust Laws
  9. [9] SpaceXAI Sends NVIDIA's Vera Rubin Into Space
  10. [10] Nvidia's Huang Declares Vera Rubin on Track Despite Delay Talk
  11. [11] India AI Data Center Firm Orders 9,000 NVIDIA Vera Rubin Systems

来源文章

Top 5

THE SIGNAL.

Analysts

宣称智能体AI代表了一种全新的工作负载类别,Vera Rubin的量产标志着“有用AI”的到来;另单独确认收购Groq的逻辑在于将低延迟推理直接整合进NVIDIA的AI工厂架构。

Jensen Huang
CEO,NVIDIA

解释称NVIDIA的Vera CPU将Grok的GPU从编排、代码执行和数据处理中解放出来,使GPU能专注于模型计算。

Mike Nicolls
总裁,SpaceXAI

将Vera CPU定位为专为让AI智能体实时行动而设计,负责代码执行、数据处理和任务协调。

Ian Buck
副总裁/总经理,NVIDIA

认为Groq交易的资产购买加人才收购结构旨在规避反垄断审查,警告此举将巩固NVIDIA的市场主导地位,可能推高价格并削弱美国与中国竞争的能力。

Elizabeth Warren and Richard Blumenthal
美国参议员
The Crowd

10x more tokens per megawatt. CoreWeave has the first measured performance of NVIDIA Vera Rubin NVL72, showing 10x improvement in tokens per second per megawatt on DeepSeek-R1 compared to Blackwell.

@@nvidia4282

NVIDIA Vera Rubin NVL72 production racks are here. The compute tray is engineered for fast compute, assembly, and serviceability. Manufacturing is 100% automated, and every tray goes together in one minute. Congratulations to @Microsoft on the first operational Vera Rubin NVL72

@@nvidia2552

From the show floor to the AI factory: Hot Chips 2026 was all about extreme co-design to accelerate agentic workloads — the most complex workload in history. Vera CPU, Vera Rubin, Groq 3 LPX, Spectrum-X Multiplane, BlueField-4 Scale-In networking. One full AI stack platform

@@nvidia440

OpenAI's new chip is better than Vera rubin on benchmark

@u/Wonderful_Buffalo_32179
Broadcast
Deconstructing Nvidia's Vera Rubin — The Successor To Blackwell That's 10x More Efficient

Deconstructing Nvidia's Vera Rubin — The Successor To Blackwell That's 10x More Efficient

NVIDIA Vera Rubin Platform Ramping into Full Production | Built for the Era of Agents

NVIDIA Vera Rubin Platform Ramping into Full Production | Built for the Era of Agents

NVIDIA Vera Rubin NVL72 on CoreWeave Cloud: Built for Agentic AI

NVIDIA Vera Rubin NVL72 on CoreWeave Cloud: Built for Agentic AI

NVIDIA Vera Rubin的智能体AI基础设施发布 — AI 新闻 | Agentic Brew