2026年9月3日AI服务中断事件
TECH

2026年9月3日AI服务中断事件

35+
Signals

战略概览

  • 01.
    2026年9月3日上午,ChatGPT、Claude和Grok几乎在同一时间段内发生服务中断,谷歌的Gemini在同一时间也出现了用户报告错误激增的情况。
  • 02.
    OpenAI将ChatGPT和Codex的中断归因于大约上午7:43(太平洋时间)开始的路由错误,并表示约34分钟后已部署修复方案。
  • 03.
    Anthropic的状态页面记录了一起持续约三小时的“多个模型错误率升高”事件,时间为世界标准时间13:26至16:23,影响了claude.ai、Claude Code、Claude Cowork及API上的Claude Mythos 5.1、Fable 5.1、Opus 5、Opus 4.8和Opus 4.6。
  • 04.
    SpaceXAI确认其位于孟菲斯Colossus设施的计算中心发生故障,导致Grok服务中断约三个半小时,起始时间约为上午6:30(太平洋时间),并向Grok用户以及在该站点租赁算力的未具名“受影响的计算合作伙伴”致歉。
  • 05.
    Cloudflare表示在事件期间未发生服务中断,且未确认存在广泛的AWS或Azure中断以解释这四个平台的问题,尽管Azure当天上午确实在其美国东部区域报告了一起无关的网络问题。
  • 06.
    截至当天下午12:38(太平洋时间),所有三项服务均已确认完全恢复,仅OpenAI就收到了数万份来自Downdetector的故障报告。
  • 07.
    彭博社指出,此次中断同时影响了OpenAI、Anthropic和SpaceXAI,使三家领先的美国AI模型制造商的客户同时受到波及。

深度分析

未被点名的数据中心

尽管高管们将9月3日的事件描述为彼此独立,但Anthropic与xAI/SpaceXAI实际上可追溯至同一物理地址。2026年6月,SpaceX将其位于孟菲斯的Colossus 1数据中心的全部容量——超过22万块英伟达GPU和超过300兆瓦的电力——以每月约12.5亿美元(截至2029年5月总计接近450亿美元)的价格租给了Anthropic [1]。这一安排是在SpaceX自身团队因运行Grok而遭遇延迟和网络问题后做出的,因此Colossus 1在继续为xAI提供服务的同时,也成为了Claude对外计算的物理基础。9月3日,SpaceXAI确认该孟菲斯站点的计算中心发生故障,导致Grok服务中断约三个半小时,并在其公开道歉中特别向“受影响的计算合作伙伴”致歉,而不仅仅是Grok用户 [2]。与此同时,Anthropic仅将其事件记录为持续约三小时的“多个模型错误率升高”事件,影响范围涵盖claude.ai、Claude Code、Claude Cowork和API,原因仅被归结为未具名的“基础设施问题” [3]。综合来看,当天上午瘫痪的四个平台中有两个实际上从未真正运行在独立的基础设施之上。

三份事后分析,却无共同叙事

每家公开发言的公司都描述了各自独立的故障。OpenAI将问题归咎于大约上午7:43(太平洋时间)开始的路由错误,并在约34分钟内部署了修复方案 [4]。Anthropic指向内部基础设施问题。xAI则指向孟菲斯的硬件故障。没有任何媒体找到将三者联系在一起的单一确认原因,而通常的嫌疑方也很快被排除:Cloudflare表示完全未发生中断,尽管微软Azure当天上午确实在其美国东部区域报告了另一起网络问题,但并未发现其与AI中断有直接关联 [5][6]。这种整洁的企业事后分析与混乱的物理现实之间的差距,正是吸引外部调查者介入的原因。当SpaceXAI“受影响的计算合作伙伴”的致歉措辞以及Anthropic与xAI在5月的计算合作消息开始传播时,Reddit上一个AI社区的用户得出了比任何官方声明都更进一步的推论,明确指出Grok与Claude共享同一Colossus基础设施。与此同时,一些X平台用户提出了级联理论:一旦Grok和Claude崩溃,用户转向尚在运行的服务,可能导致流量激增冲击OpenAI系统,恰逢其路由层发生故障——值得注意的是,OpenAI的路由错误始于上午7:43(太平洋时间),比Grok在约6:30(太平洋时间)开始的中断晚了一个多小时。尽管这些理论均未得到任何公司证实,但它们都指向同一个根本问题:三起“互不相关”的事件在时间上高度巧合。

AI成为基础设施,除非它并非如此

Forrester副总裁兼首席分析师Charlie Dai认为,事件发生的时间点本身才是真正的重点:企业已悄然将AI从生产力附加功能转变为运营基础设施,却未相应调整其故障应对规划。‘近乎同时发生的中断凸显出,AI正日益成为运营基础设施,而非生产力附加功能。企业应将AI可用性视为韧性问题,实施多模型策略、备用工作流程和业务连续性计划,而不是假设前沿AI服务将始终可用,’Dai表示 [7]。他对模糊根本原因所造成的诊断难题进一步指出:‘当多个主要供应商在没有明确共同原因的情况下经历重叠故障时,企业无法准确评估系统性风险、依赖集中度或复发可能性。这强化了供应商透明度、依赖映射以及风险评估的重要性,这些评估必须超越单一AI供应商,延伸至底层基础设施生态系统’ [7]。其他分析师则以更直白的方式描述了同样的风险——将AI视为大多数公司尚未绘制出的潜在单点故障 [8],而连续性专家则警告称,随着工作流程越来越依赖AI,用于回退至人工操作所需的人类技能已悄然退化 [9]

并非偶然,而是趋势

9月3日的事件符合数月来逐渐形成的模式,而非一次性意外。仅在此次中断发生前的三周内,Anthropic的状态页面就记录了21起独立的Claude事件,加上3月、6月和7月更早的中断——其中一起6月的事件甚至导致Claude停机长达七小时零九分钟 [10]。从更宏观的视角看,全行业记录的高信号AI平台中断天数在2025年第一季度的6天上升至2026年第一季度的51天,增幅约750% [11]。结合这一趋势,ChatGPT、Claude和Grok在数小时内接连出现故障的现象,看起来不再像是一次偶然巧合,而更像是一个持续上升的不稳定性基线的可见顶峰——目前主导企业AI工作流程的四家公司仍在以超越其可靠性工程能力的速度构建未经验证的基础设施。

历史背景

SpaceX将其位于孟菲斯的Colossus 1数据中心的全部容量——超过22万块英伟达GPU和超过300兆瓦电力——以每月约12.5亿美元(截至2029年5月总计约450亿美元)的价格租给了Anthropic,此前SpaceX自身团队在为Grok运行该站点时曾遭遇延迟和网络问题。同一设施后来被牵涉进9月3日的中断事件中。
此前一次事件导致Claude停机7小时9分钟,是2026年夏季Claude频繁中断模式的一部分。
在9月3日中断发生前的三周内,共记录了21起独立的Claude事件,此前2026年3月、6月和7月也发生过中断。
从2025年第一季度到2026年第一季度,记录的AI平台中断天数上升了约750%,从6天增至51天,反映出在9月3日事件之前AI服务不稳定性已普遍上升。

关键关系图

关键玩家
主题

2026年9月3日AI服务中断事件

OP

OpenAI

ChatGPT 和 Codex 的运营方;由于路由错误,自太平洋时间上午7:43左右开始出现故障,根据Downdetector报告量成为当日最大规模的中断事件,约34分钟后部署修复措施。

AN

Anthropic

Claude 的运营方;报告称其基础设施出现约三小时的问题,影响了 claude.ai、Claude Code、Claude Cowork 及多个模型版本的API;据报以每月12.5亿美元的价格,从SpaceX位于孟菲斯的Colossus 1设施租赁了大部分外部算力——该设施也是Grok中断事件中涉及的同一站点。

XA

xAI / SpaceXAI (Grok)

Grok的运营方,在SpaceX位于孟菲斯的Colossus设施发生计算中心故障后,服务中断约三个半小时;SpaceXAI公开向Grok用户及依赖该站点的未具名‘计算合作伙伴’致歉。

GO

Google / Gemini

在同一时间段内用户报告的错误激增,但未确认发生全面中断;相关报道指出,Gemini是相较其他三家基本保持稳定的平台。

CL

Cloudflare, AWS, 和 Microsoft Azure

底层云/CDN基础设施提供商;Cloudflare否认出现任何中断,尽管Azure在同一时段报告了美国东部地区的独立网络问题,但未确认存在导致广泛云服务中断的共同原因。

企业

企业AI用户

将客户服务、编程和知识管理工作流建立在AI聊天机器人和AI助手之上的企业,在多家供应商同时中断时,暴露出几乎没有任何备用方案的弱点。

事实来源

11 条引用
  1. [1] SpaceX Rented Out Computing After Own Teams Had Trouble Using It
  2. [2] SpaceXAI Apologizes for Outage That Affected Grok and Other Compute Partners
  3. [3] Claude Status
  4. [4] ChatGPT, Claude, and Grok All Had Outages at the Same Time
  5. [5] Overlapping AI Outages Expose an Enterprise Resilience Gap
  6. [6] Gemini Survived When ChatGPT, Claude, Grok Collapsed - Azure Fault?
  7. [7] Yesterday's Triple AI Outage Should Be a Wake-Up Call for Enterprises
  8. [8] AI Is Becoming a Single Point of Failure and Most Companies Don't See It
  9. [9] What Happens When the AI Goes Down and the Experts Are Gone
  10. [10] ChatGPT, Claude, Gemini Down: Outage 2026
  11. [11] Enterprise AI Reliability Crisis: Downdetector Shows Disruptions Spike 700% in 2026

来源文章

Top 5

THE SIGNAL.

Analysts

认为同时发生的中断表明AI已成为运营基础设施而非可有可无的附加功能,企业需要多模型策略、备用工作流程和业务连续性计划,而不是假设前沿AI服务将始终可用:‘近乎同时发生的中断凸显出,AI正日益成为运营基础设施,而非生产力附加功能。企业应将AI可用性视为韧性问题,实施多模型策略、fallback workflows,和业务连续性计划,而不是假设前沿AI服务将始终可用。’

Charlie Dai
副总裁、首席分析师,Forrester

警告称,在缺乏明确共同原因的情况下发生重叠故障,企业无法准确评估系统性风险或依赖集中度,并呼吁风险评估应超越单一AI供应商,延伸至底层基础设施生态系统:‘当多个主要供应商在没有明确共同原因的情况下经历重叠故障时,企业无法准确评估系统性风险、依赖集中度或复发可能性。这强化了供应商透明度、依赖映射以及风险评估的重要性,这些评估必须超越单一AI供应商,延伸至底层基础设施生态系统。’

Charlie Dai
副总裁、首席分析师,Forrester
The Crowd

ChatGPT Claude Grok are currently down, according to users.

@@PopBase23844

Several major AI services are having problems at the same time today. ChatGPT, Grok, Gemini, and Claude are all seeing outages or errors, with users reporting issues accessing the services.

@@Pirat_Nation1602

The AI outage started with SpaceX's Memphis compute cluster. That took down Grok and Claude, which pushed a huge wave of users onto OpenAI until it eventually went down too. Generally, when one major AI provider goes offline, everyone immediately floods the ones still standing.

@@mark_k152

ChatGPT, Claude, and Grok all went down within hours of each other yesterday; here's what actually happened

@u/Thirumalaivasan_GJ24
Broadcast
챗GPT·클로드·그록 한꺼번에 '먹통'…이례적 동시 장애 / 연합뉴스TV (YonhapnewsTV)

챗GPT·클로드·그록 한꺼번에 '먹통'…이례적 동시 장애 / 연합뉴스TV (YonhapnewsTV)

ChatGPT Down? Claude, Gemini & Grok Users Report Major AI Platform Outage | NewsX

ChatGPT Down? Claude, Gemini & Grok Users Report Major AI Platform Outage | NewsX

La caída simultánea de ChatGPT, Claude y Grok deja sin servicio a millones de usuarios

La caída simultánea de ChatGPT, Claude y Grok deja sin servicio a millones de usuarios