ChatGPT、Claude 和 Grok 同时中断事件
TECH

ChatGPT、Claude 和 Grok 同时中断事件

30+
Signals

战略概览

  • 01.
    2026年9月3日,ChatGPT、Claude 和 Grok 在大约90至93分钟内相继中断,Gemini 报告了较轻微的问题,全球数百万用户受到影响。
  • 02.
    OpenAI 将 ChatGPT 和 Codex 的中断归因于大约上午7:43(太平洋时间)开始的路由错误,并于上午8:17左右修复。
  • 03.
    Anthropic 表示,基础设施问题导致 Claude.ai、Claude Code、Claude Cowork 和 Claude API 出现约三小时的部分中断,影响了包括 Opus 4.8 和 Opus 5 在内的模型。
  • 04.
    xAI 的母公司 SpaceXAI 表示,其位于孟菲斯的计算中心发生中断,导致 Grok 服务中断,持续时间约为3.5小时,是三者中最长的,同时向受影响的第三方计算合作伙伴致歉。

深度分析

竞争对手共享的房东

OpenAI、Anthropic 和 xAI 各自对9月3日的中断给出了不同的官方解释:ChatGPT 和 Codex 是路由错误,Claude 是未指明的基础设施问题,而 Grok 则是 xAI 自有的孟菲斯计算中心发生硬件故障[1]。但表面上看三家无关公司同一天早晨出问题,却忽略了一个在后续报道中浮现的结构性细节:Anthropic 和 xAI 在同一孟菲斯站点存在计算合作,这意味着 Claude 的前沿算力与 Grok 的主数据中心并不像品牌名称所暗示的那样独立。这一关联有助于解释为何一家公司的设施硬件问题会波及另一家公司的状态页面,以及为何组织架构图上看似稳健的冗余机制仍可能追溯到同一栋物理建筑。前沿规模的模型还运行在通过线路连接、共同构成单个巨型计算单元并共享内存的 GPU 机架集群上,因此当故障发生时,并没有闲置的备用算力可供切换,除非将基础设施成本直接翻倍。

三种解释,无确认的共同原因

OpenAI 表示,ChatGPT 和 Codex 的中断源于大约上午7:43(太平洋时间)开始的路由错误[1],而 xAI 的母公司 SpaceXAI 则为其孟菲斯计算中心的中断致歉,该事件也影响了外部计算合作伙伴[2],使 Grok 的中断成为三者中最长的,持续约三个半小时[1]。与此同时,Anthropic 仅将 Claude 持续约三小时的中断归因于一般性基础设施问题,影响范围涵盖 Claude.ai、Claude Code、Claude Cowork 及其 API[1]。多家媒体推测微软 Azure 的美国东部区域可能是共同因素,因为 ChatGPT、Claude 和 Grok 均通过 Azure 路由大量计算或网络流量,而 Google 的 Gemini 运行在自有云栈上,受影响较小[3][4]。该理论从未得到官方证实,Cloudflare 明确否认其网络在事件期间发生中断[1]。一名 OpenAI 工程师进一步表示,ChatGPT 的故障是与 xAI 孟菲斯事件无关的独立路由错误[5],最终留下三种不同的公司解释,而非一个确认的共同根本原因[6]

大多数企业没有的备用方案

由于 ChatGPT、Claude 和 Grok 均在约90分钟内相继失效,将一家 AI 供应商作为另一家的实时备用方案所提供的实际保护远低于大多数企业韧性计划的预期[7]。分析人士将此事件视为证据,表明组织尚未为 AI 中断制定业务连续性计划,且正面临一类新的运营风险——当前自动化工作流已深度依赖少数几家供应商[8][9]。即使运行在微软云上的微软自家 Copilot 也在同一时段报告了稳定性和中断问题,表明问题可能出在多个产品共用的基础设施层,而非任何单一供应商的代码中[3]

这并非首次同时发生的 AI 黑屏事件

2026年9月的事件延续而非开创了一种模式。2024年6月,ChatGPT、Claude 和 Perplexity 曾同时中断,该事件被称为“AI 末日”[10]。2025年6月,ChatGPT 自身曾经历超过15小时的长时间中断,同时导致 Sora 和 API 访问中断[11]。2025年11月,全球 Cloudflare 故障导致依赖其网络的主要 AI 平台及数万个其他网站一同瘫痪[12]。到2026年4月,ChatGPT、Claude 和 Gemini 已经曾大致同时中断过一次,动摇了将三者视为可互换备份的普遍做法[13]。在9月3日事件前的三周内,仅 Anthropic 就记录了21起独立事件,是过去30天内五个组件中25起中断的一部分[14]

从数据看此次中断的规模

仅 OpenAI 就收到超过37,000条 Downdetector 报告,加上 Codex 后总数超过66,000条,使其成为2026年记录中最受关注的 AI 中断事件之一[3]。Grok 的中断持续约三小时三十七分钟,是三者中最长的,而 Claude 的中断持续约三小时零六分钟[15][16]。消费者聊天机器人应用和工作场所工具(包括 Codex 和 Claude Code 等编码助手)同时中断,一次性扰乱了普通用户和开发者的工作流程[7][15]

历史背景

更早一次多个供应商近乎同时发生AI聊天机器人中断的事件,当时被称为“AI末日”。
ChatGPT 经历了一次持续超过15小时的全球性长时间中断,同时影响了 Sora 和 API 服务。
一次全球性的 Cloudflare 中断影响了依赖其网络的主要AI平台,导致数万个依赖网站和应用下线。
此前一次 ChatGPT、Claude 和 Gemini 大致同时中断的事件,动摇了将这三者视为可互换备份的普遍做法。
在2026年9月3日中断前的8月12日至9月2日期间,Claude 记录了21起独立事件,是过去30天内五个组件中25起中断的一部分。

关键关系图

关键玩家
主题

ChatGPT、Claude 和 Grok 同时中断事件

OP

OpenAI

ChatGPT 和 Codex 的运营方;为其部分中断发布了官方的路由错误解释

AN

Anthropic

Claude.ai、Claude Code、Claude Cowork 和 Claude API 的运营方;报告其约三小时的中断源于一般性基础设施问题

XA

xAI / SpaceXAI

Grok 的运营方;将其最长的中断归咎于自有孟菲斯计算中心(即 Colossus 超级计算机所在地),并确认影响了外部计算合作伙伴

GO

Google / Gemini

因 Gemini 运行在 Google 自有云栈上而非共享第三方基础设施,受影响相对较小

MI

Microsoft Azure

被怀疑但未获官方证实为 ChatGPT、Claude 和 Grok 的共同故障点

使用

使用AI平台的企业

因高度依赖少数AI供应商而暴露于运营风险之下,且无确认的业务连续性计划应对同时故障

事实来源

16 条引用
  1. [1] ChatGPT, Claude, and Grok all had outages at the same time
  2. [2] SpaceXAI outage disrupts Grok, Claude, ChatGPT
  3. [3] Gemini survived when ChatGPT, Claude, Grok collapsed in Azure fault
  4. [4] The ChatGPT, Claude, Grok outage and the Azure theory
  5. [5] Grok outage traced to Memphis data center
  6. [6] OpenAI, Anthropic, xAI hit by near-simultaneous outages with no shared cause confirmed
  7. [7] ChatGPT, Claude, Grok, and Gemini outages disrupt users worldwide
  8. [8] ChatGPT, Claude, and Grok all went down at once: enterprises need a backup plan
  9. [9] Overlapping AI outages expose an enterprise resilience gap
  10. [10] AI apocalypse: ChatGPT, Claude, and Perplexity are all down at the same time
  11. [11] ChatGPT, OpenAI down: outage live updates
  12. [12] Biggest AI outages since 2024: ChatGPT, Claude, and Cloudflare disruptions that shook the industry
  13. [13] AI business continuity planning for model outages
  14. [14] Anthropic confirms Claude is down, multiple models affected
  15. [15] ChatGPT, Claude, and Grok are down
  16. [16] Anthropic status history

来源文章

Top 5

THE SIGNAL.

Analysts

认为此次中断应成为IT领导者忽视关键AI平台停机运营成本的警钟,警告组织可能在缺乏应急预案的情况下对AI自动化产生危险的过度依赖。

Carmi Levy
科技分析师兼记者

称近乎同时发生的故障是一种引人好奇的情景,并推测CDN、DNS或云等共享基础设施层可能是罪魁祸首;建议企业设计AI使用架构,使模型或供应商可作为热插拔商品处理,并具备备用选项。

Brian Jackson
Info-Tech Research Group 首席研究总监

以讽刺的视角解读公众在中断期间对AI聊天机器人的依赖,将其描述为短暂回归无辅助思考的状态。

Paris Marx
记者兼评论员
The Crowd

And we are taking corrective action to ensure this does not happen again (quoting @SpaceXAI: We are sorry for the issues you may have experienced with Grok following an outage at our Memphis compute center this morning. We'd also like to apologize to our impacted compute partners.)

@@elonmusk32618

AI outage: Claude, ChatGPT, and Grok are currently down for many users https://9to5mac.com/2026/09/03/chatgpt-and-codex-are-experiencing-an-outage-for-many-users/ by @apollozac

@@9to5mac1101

JUST IN: Widespread AI outage underway as ChatGPT, Claude and Grok are all down

@@axios1714

Nobody Is Saying Why OpenAI and Anthropic Had Outages Today

@u/wiredmagazine347
Broadcast
ChatGPT, Claude and Grok Went Down. It Took 6 Hours to Learn Why.

ChatGPT, Claude and Grok Went Down. It Took 6 Hours to Learn Why.

ChatGPT, Claude y Grok fallan al mismo tiempo; esto sabemos sobre la caída global

ChatGPT, Claude y Grok fallan al mismo tiempo; esto sabemos sobre la caída global

MASSIVE AI OUTAGE striking virtually every AI all at once!

MASSIVE AI OUTAGE striking virtually every AI all at once!