英伟达AI工厂基础设施建设
TECH

英伟达AI工厂基础设施建设

34+
Signals

战略概览

  • 01.
    2026年8月10日,英伟达与六家主要资产管理公司——阿波罗(Apollo)、贝莱德(BlackRock)、黑石集团(Blackstone)、布鲁克菲尔德(Brookfield)、高盛(Goldman Sachs)和KKR——达成合作,动员超过5000亿美元的第三方资金,使客户能够购买原本无力承担的英伟达AI算力。
  • 02.
    2026年8月25日,思科(Cisco)与英伟达扩展其Secure AI Factory至机架级架构,并与超微(Supermicro)合作推出支持液冷和风冷的系统,每机架可支持超过200千瓦的功率,集成系统预计从2026年10月起上市。
  • 03.
    NVLink Fusion向第三方定制XPU芯片开放了英伟达的互连和机架级架构,而新的BlueField-4 DPU则引入“Scale-In”作为代理型AI工厂的第五大网络支柱,运行速度高达800 Gb/s。
  • 04.
    英伟达将向黑石支持的电力开发商Lancium投资高达30亿美元,以帮助在其15吉瓦以上的站点管线中部署吉瓦级、具备供电能力的AI工厂。

深度分析

构建标准化的AI工厂堆栈

英伟达的机架级战略发布于2026年8月25日的两项公告:思科正将其与英伟达合作的Secure AI Factory架构扩展至机架级系统,并引入超微(Supermicro)提供计算层[1]。该联合架构被描述为首个符合NVIDIA云合作伙伴标准的参考设计,基于合作伙伴开发的网络,涵盖思科Silicon One和英伟达Spectrum-X交换芯片,采用机架到网络的液冷技术,每机架散热能力超过200千瓦,集成的超微系统计划于2026年10月上市[1][2]。思科的Will Eatherton清晰地划分了技术分工:思科在英伟达Spectrum芯片基础上运行NX-OS或SONiC软件,用于GPU横向扩展网络;而英伟达的Marc Hamilton则将此交易定位为超越单个机架,迈向完整的AI工厂级参考架构,合作伙伴将整体采用而非零散组装[1]。这一框架与黄仁勋近期在与思科CEO查克·罗宾斯(Chuck Robbins)的炉边谈话中的表述一致:他将AI工厂描述为五个叠加的层级——能源、芯片、基础设施、模型和应用,并主张企业应构建本地或混合架构,而非租用纯云资源,因为企业最宝贵的知识产权并非模型生成的答案,而是用于提示模型的专有问题和上下文。

机架之下是英伟达最新的网络层:BlueField-4 DPU引入了英伟达称之为“Scale-In”的概念,成为AI工厂网络的第五大支柱。这款基于64核Grace架构的DPU运行速度高达800 Gb/s,独立于主机CPU执行安全、存储和租户隔离处理,英伟达称其存储吞吐量比现成以太网高出最多1.45倍[3]。英伟达还指出,其内部AI工厂的运营表明此类容量无法一夜建成——公司表示其内部AI工厂每月服务数万亿个token且可用性极高,而新建产能需要数月的采购和电力规划,这正是为何即使物理建设周期较长,预验证的现成参考设计依然重要。总体而言,机架级参考架构和DPU级网络层在两个不同层面发挥相同作用:将过去由各厂商定制的数据中心建设转变为任何企业、新云(neocloud)或主权云均可直接订购的标准化、已验证设计。

NVLink Fusion:开放护城河以捕获定制芯片市场

在其大部分历史中,英伟达销售的是完整的GPU系统。NVLink Fusion改变了这一模式:它允许第三方定制XPU芯片——而不仅是英伟达自己的芯片——直接接入英伟达的NVLink纵向扩展网络和机架级架构,可通过定制CPU的直接NVLink-C2C连接,或通过UCIe桥接芯粒连接定制ASIC和XPUs[4]。英伟达的卖点在于速度与效率:NVLink Fusion声称延迟比现成以太网低3倍,数据包速率高10倍;NVLink-C2C的能效比PCIe最高可达6倍;第六代NVLink已支持72-XPU域,并规划在单一一致架构中支持1,152个加速器[4]。Marvell正在构建首批参考设计,将其XPU与英伟达的Vera CPU和ConnectX网卡配对,目标于2026年第三季度推出,英特尔、联发科、GUC、亚马逊Annapurna Labs和QCT也被列为生态合作伙伴[4][5]。其战略逻辑在于:超大规模企业即便设计自己的AI芯片,仍需这些芯片与英伟达主导的软件和网络堆栈互操作;通过开放互连而非彻底封锁定制芯片,英伟达得以捕获原本会完全流失给独立XPU堆栈的基础设施支出份额。

5000亿美元:以房地产式融资推动算力采购——以及看空观点

2026年8月10日,英伟达宣布将与六家最大资产管理公司——阿波罗(Apollo)、贝莱德(BlackRock)、黑石集团(Blackstone)、布鲁克菲尔德(Brookfield)、高盛(Goldman Sachs)和KKR——合作建立独立融资平台,旨在为客户提供超过5000亿美元的第三方资本,用于购买英伟达AI算力[6]。黄仁勋将英伟达GPU本身定位为抵押品,称算力“被广泛采用、适用于各类模型和工作负载、具有可替代性和跨客户及运营商的可转移性”——这正是可融资实物资产所使用的语言[6]。阿波罗的Jim Zelter进一步表示,算力是“一种稀缺的、关键任务型资产类别,具备吸引人的投资特性”[6]。但重要的是,这六个平台均未最终敲定——每个平台仍需等待后续谈判达成最终协议[6]

市场的反应削弱了庆祝氛围:公告当日,英伟达股价下跌2.9%,市值蒸发近600亿美元,媒体报道将其与抵押贷款证券化相提并论,并质疑英伟达在部分合同中承诺承担高达25%残值担保,是否实质上是在为自身需求提供融资[7]。次日的分析进一步聚焦硬件贬值风险:如果GPU的使用寿命更接近某些怀疑者主张的几年范围,而非黄仁勋声称的十年以上,那么支撑5000亿美元贷款的抵押品在偿还时可能远低于预期价值,一些分析师因此计入了11%至17%的风险调整后收益率以补偿违约风险[8]。散户投资者在此问题上也存在分歧:多头指出英伟达自身的低负债权益比,认为其是用已赚取的现金而非借款为他人融资;而怀疑者则反驳称真正的债务风险在于英伟达的客户,且需求可能因英伟达自身提供融资而显得虚高。

电力用地争夺战:Lancium与吉瓦级站点控制

没有电力,芯片和网络毫无意义,英伟达最近的举措正是针对这一瓶颈:向黑石支持的电力用地和数据中心站点开发商Lancium进行高达30亿美元的战略投资,以支持英伟达全栈AI平台和DSX参考设计在其开发管线中的部署[9][10]。Lancium目前拥有约4吉瓦的租赁容量,以及超过15吉瓦的带电土地处于不同开发阶段[11]。英伟达的DSX MaxLPS参考设计可在相同功耗预算下容纳多达40%的GPU,这一杠杆效应至关重要,因为如今电网接入——而非芯片供应——正日益成为新增AI工厂产能的主要制约因素[12]。Lancium首席执行官Michael McNamara简洁地描述了这笔交易:与英伟达合作“确保每个园区都将部署行业最先进的技术”[10]。这项投资符合整个公告群中可见的模式:英伟达不再只是向他人的数据中心供应芯片,而是共同投资于决定这些数据中心能否建成的土地、电力合同和融资结构。

历史背景

黄仁勋将AI工厂描述为“token工厂”,将智能生成作为基本产出单位,将AI工厂愿景从芯片扩展至完整的基础设施和软件堆栈。
宣布与六家资产管理公司建立5000亿美元AI计算基础设施融资合作。
思科宣布与英伟达和超微合作,将其Secure AI Factory扩展至机架级架构。

关键关系图

关键玩家
主题

英伟达AI工厂基础设施建设

NV

Nvidia

Orchestrates the full-stack AI factory ecosystem - chips, networking (NVLink Fusion, BlueField-4), rack-scale reference architectures, financing access, and power-site partnerships - positioning itself as the standardized backbone for enterprise and hyperscaler AI buildout.

CI

Cisco

Expands its Secure AI Factory architecture with Nvidia, contributing Silicon One switch silicon and liquid-cooled rack-to-fabric networking systems; brought in Supermicro for the compute layer.

SU

Supermicro

Supplies liquid- and air-cooled rack-scale server systems validated and sold within Cisco's Secure AI Factory portfolio, enabling deployment of Nvidia Vera Rubin NVL72 and HGX Rubin NVL8 platforms.

AP

Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, KKR

Six asset managers each independently underwriting financing platforms to mobilize over $500 billion so customers can purchase Nvidia AI compute they could not finance alone.

LA

Lancium

Blackstone-backed power and data-center land developer with 4 GW leased and 15+ GW in development; will deploy Nvidia's DSX reference designs across its sites after receiving Nvidia's strategic investment.

MA

Marvell (and NVLink Fusion silicon partners: Intel, MediaTek, GUC, Amazon/Annapurna Labs, QCT)

Joining the NVLink Fusion ecosystem to build semi-custom XPU/CPU silicon that plugs into Nvidia's rack-scale interconnect; Marvell/Nvidia reference designs pairing Marvell XPUs with Nvidia's Vera CPU are targeted for Q3 2026.

事实来源

12 条引用
  1. [1] Nvidia and Cisco push the enterprise AI factory into the rack-scale era
  2. [2] Cisco Expands Secure AI Factory With Nvidia for the Rack-Scale Era
  3. [3] NVIDIA BlueField-4 Powers New Scale-In Network Infrastructure for Agentic AI Factories
  4. [4] How XPUs Meet a World-Class AI Factory
  5. [5] Marvell and NVIDIA Provide Custom Solutions for Advanced AI Infrastructure
  6. [6] NVIDIA Partners With Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs and KKR to Establish AI Compute Infrastructure Financing Platforms to Mobilize Over $500 Billion of Third-Party Capital
  7. [7] Nvidia Shares Fall Nearly 3% as $500 Billion Financing Deal Raises Circular-Financing Concerns
  8. [8] Nvidia's AI Funding Plan Faces Scrutiny Over Depreciation, China Risk
  9. [9] Nvidia to Invest Up to $3 Billion in Blackstone-Backed Power Developer Lancium
  10. [10] Lancium Announces Partnership With NVIDIA to Advance Gigawatt-Scale AI Factory Development Across Its 15 GW Portfolio
  11. [11] Lancium Adds Nvidia as Investor and Partner, Targeting Gigawatt AI Factories Across a 15GW Pipeline
  12. [12] Lancium, Nvidia Partner on Gigawatt-Scale AI Data Centers

来源文章

Top 5

THE SIGNAL.

Analysts

将英伟达算力定位为一种被广泛采用、可替代的资产类别,适合作为大规模第三方融资平台的基础。

Jensen Huang
英伟达首席执行官

将计算基础设施视为一种新型稀缺、可投资的资产类别,类似于实物资产。

Jim Zelter
阿波罗总裁

主张AI扩展必须与数据控制及成本/投资回报管理相结合,认为Secure AI Factory的机架级扩展正是应对这一需求。

Jeetu Patel
思科总裁兼首席产品官

将与思科的合作定位为超越单个机架,迈向合作伙伴整体采用的完整AI工厂级参考架构。

Marc Hamilton
英伟达解决方案架构副总裁

将与英伟达的合作视为确保Lancium电力园区获得最先进部署技术的保障。

Michael McNamara
Lancium首席执行官
The Crowd

From the show floor to the AI factory: Hot Chips 2026 was all about extreme co-design to accelerate agentic workloads — the most complex workload in history. Vera CPU, Vera Rubin, Groq 3 LPX, Spectrum-X Multiplane, BlueField-4 Scale-In networking. One full AI stack platform

@@nvidia159

Great partnership! @Supermicro and @Cisco are joining forces to support the next generation of AI DC. Together, we are bringing total, full-stack, rack to fabric liquid-cooled DCBBS solutions to power the Cisco Secure AI Factory with @NVIDIA

@@charlesliang57

Lancium and Nvidia just announced a partnership that puts a number behind the AI infrastructure buildout in Texas: 4 GW under lease, and more than 15 GW of powered land in development. What's in the deal: ➡️ Lancium will deploy Nvidia's DSX reference designs across its campuses

@@MrDataCenters1

Everyone's calling Nvidia's financing deals circular and I think they're mostly wrong

@u/Quechivoeth81
Broadcast
The AI Factory: Infrastructure for Intelligence | Jensen Huang, CEO, NVIDIA

The AI Factory: Infrastructure for Intelligence | Jensen Huang, CEO, NVIDIA

Inside the NVIDIA AI Factory by PNY: Powering scalable AI without compromise

Inside the NVIDIA AI Factory by PNY: Powering scalable AI without compromise

How NVIDIA Runs Its Own AI Factory | AI Factory Insider Ep. 2

How NVIDIA Runs Its Own AI Factory | AI Factory Insider Ep. 2