2026年9月3日ChatGPT、Claude、Grok和Gemini服务中断事件
TECH

2026年9月3日ChatGPT、Claude、Grok和Gemini服务中断事件

43+
Signals

战略概览

  • 01.
    2026年9月3日上午,ChatGPT、Claude和Grok均确认发生重叠的服务中断,而Gemini虽未发布官方Google事故声明,但用户投诉报告数量显著上升。
  • 02.
    OpenAI将ChatGPT和Codex的服务中断归因于大约上午7:43(太平洋时间)开始的路由错误,影响了包括对话、登录、图像生成、语音模式、GPTs和Deep Research在内的19个组件,并在约两小时内解决了该问题。
  • 03.
    Anthropic报告称,其Claude.ai、Claude Code、Claude Cowork及API出现部分中断,波及Opus 5和Opus 4.8等七种模型变体,并将原因描述为基础设施问题。
  • 04.
    xAI的Grok记录了一次持续三小时三十七分钟的“模型”中断,用户报告了“模型过载”和“高需求”错误,符合计算能力紧张的特征。

深度分析

三份不同的事后分析,同一个两小时窗口

当ChatGPT、Claude和Grok在2026年9月3日早晨几乎同时崩溃时,网络上的第一反应是存在一个共同原因,最可能是微软Azure,因为OpenAI、Anthropic和xAI都至少部分租用了其基础设施。但三家公司自己的状态页面讲述了三个不同的故事。OpenAI将其ChatGPT和Codex中断归因于“大约上午7:43(PT)开始的路由错误”[1],这是一种网络层漏洞,不同于整个云平台的全面故障。Anthropic将其影响Claude.ai、Claude Code、Claude Cowork及API、涵盖七种模型变体的事件描述为“基础设施问题”,公开感谢用户耐心等待,但未指向Azure或任何共享供应商[2]。xAI的状态页面记录了一次持续三小时三十七分钟的直接“模型”中断[3],与“模型过载”和“高需求”错误一致,这些错误在2026年早些时候已因用户群增长速度快于算力扩展而多次困扰Grok[4]

这种差异比时间上的巧合更重要。数小时后,xAI自己的Grok账号公开回应,称这些事件源于各公司各自独立、互不相关的技术问题,而非单一共同原因。一些Reddit上的技术评论推测,故障可能不均衡地影响了特定模型层级,而非整个平台同时崩溃,但这只是用户推测,并非公司声明。如果三家架构不同、故障描述各异的公司都在同一时间段内宕机,更值得思考的问题不再是它们是否共享数据中心,而是为何互联网的第一反应总是寻找一个宏大的单一原因,而不是先查看那些一小时内就已公开的、枯燥但具体的公司级事后分析。

Gemini的幸存看似一场意外的云服务多元化实验

在这次中断涉及的四个平台中,只有Gemini从未触发官方Google事故报告,尽管在同一天上午晚些时候,其在中断追踪平台上的用户投诉激增至约500起,而OpenAI同期记录的投诉超过37,000起[5]。多家媒体汇总的模式显示:OpenAI、Anthropic和xAI都在微软Azure上运行大量工作负载,而Gemini则依托于Google自有的云架构。微软自身的状态历史显示,当天上午10:26左右,其东美地区网络和入口发生了一起与基础设施升级相关的独立事件,Azure状态页面随后标记该事件已解决[6]。没有任何公司正式确认Azure是其自身中断的根本原因,OpenAI和Anthropic的解释——分别是路由错误和基础设施问题——也未明确提及Azure。然而,一个依赖多元化云服务的Gemini保持运行,而三个与Azure相关的竞争对手却接连瘫痪,这种表象将成为企业架构师多年引用的自然实验案例,无论Azure最终是否被证实为共同诱因[7]。当天YouTube新闻评论也得出了类似谨慎结论,有创作者明确指出,在涉事公司未正式确认前,将中断归咎于任何单一云服务商都属推测。

最能体现这种依赖深度的证据并非聊天机器人本身,而是下游系统所受的影响。Cursor是一款通过Claude和Grok的API路由请求的AI编程工具,因上游供应商失效而在同一时间段内完全宕机[8]。这才是周四中断事件中隐藏的真正教训:消费者聊天窗口在几小时内恢复,掩盖了自动化流水线、CI任务、编码代理、客服机器人等更长尾的系统所继承的每一分钟上游供应商停机时间,且这些系统自身没有独立的备用方案。仅OpenAI就报告了19个受影响组件,涵盖对话、登录、图像生成、语音模式、GPTs和Deep Research[9],这意味着单一路由错误可能同时破坏用户的聊天会话和编码助手。

所谓的‘Astra’巧合其实并不存在

大致在同一时间,OpenAI官方账号发布了一条神秘预告:“星辰即将对齐”,发布时间接近其下一代模型(据传代号Astra,可能命名为GPT-6)的预期发布节点[10]。在线社区迅速将这一巧合与公开猜测联系起来,甚至有人开玩笑称中断直接源于未发布的Astra模型上线,尽管该理论仅是用户推测,并非经证实的报道。这种联想虽可理解,但实际报道并不支持:OpenAI未说明中断是否与Astra准备有关,报道该预告的媒体明确表示两者关联可能性极低,指出ChatGPT频繁发生与发布日程无关的独立中断[10]

更平凡的解释也是证据更充分的解释。OpenAI状态页面提及的是路由错误,而非与发布相关的容量预留,且其以404错误为主的特征更符合后端配置问题,而非向未公布模型进行的主动资源转移[1]。Astra理论是一个典型案例,展示了当时间点吻合时,一个真实但平凡的基础设施故障如何迅速被纳入一个无关的企业叙事中,尤其当该公司当周本就在为另一种“对齐”做铺垫时。

这是两年内的第四次,且频率正在加速

2026年9月3日并非大型AI助手首次集体宕机。行业追踪机构整理的中断历史将此次事件列为反复出现模式的最新一例[11]:2024年6月,ChatGPT、Claude和Perplexity曾同时中断约六小时[12];2025年11月,一次大规模Cloudflare故障通过破坏共享互联网基础设施(而非单一公司的算力)导致ChatGPT、X及其他主要网站中断数小时[13];Anthropic在2026年3月曾于24小时内经历两次独立的Claude中断,中断追踪平台记录了数千起错误报告[11]。变化的是频率,而不仅仅是重复发生:追踪高信号AI中断事件的行业研究人员发现,2025年第一季度仅记录6起,而2026年第一季度已达51起,其中仅Claude就占了39天[14]

这种加速才是周四头条背后的真正故事,远比任何单一根本原因更重要。云安全联盟(Cloud Security Alliance)的分析从结构上框定了这一风险:如今企业依赖的AI层本身建立在少数几家超大规模云服务商之上,因此集中风险在两层叠加而非单层[14]。对企业用户而言,风险并非抽象概念:IBM商业价值研究院发现,81%的企业表示,其主要AI供应商若发生为期七天的中断,将导致严重或关键性业务中断[14]。一次两小时内解决的中断只是新闻标题;而一家将编码流水线、客服台和内部工具全部构建在单一模型供应商及其单一云平台上的公司,所承担的风险直到中断持续一周而非两小时才会显现。

历史背景

ChatGPT、Claude和Perplexity曾同时中断约六小时,是AI服务相关故障的早期先例。
ChatGPT、Sora及API服务曾发生超过15小时的长期中断,凸显反复出现的扩展挑战。
一次全球性Cloudflare中断导致ChatGPT、X及其他网站中断数小时,显示共享互联网基础设施——而不仅是云算力——也可能同时拖垮多个AI服务。
Claude在24小时内经历两次独立中断,中断追踪平台记录了1,700至4,700起错误报告。
报道称Grok在2026年1月、3月及4月初已发生数次容量事件,持续30分钟至数小时,源于用户快速增长。

关键关系图

关键玩家
主题

2026年9月3日ChatGPT、Claude、Grok和Gemini服务中断事件

OP

OpenAI

Operator of ChatGPT and Codex; applied a routing-error mitigation and restored 19 affected components in about two hours, attributing the outage to a company-specific bug rather than shared infrastructure.

AN

Anthropic

Operator of Claude; confirmed a partial outage across seven model variants and its coding and API surfaces, publicly framing it as a self-contained infrastructure issue.

XA

xAI

Operator of Grok; logged a capacity-driven 'Models' outage consistent with a recurring pattern of overload errors as its user base scales faster than available compute.

GO

Google (Gemini)

The only major chatbot that did not declare an official incident despite a report spike, cited by multiple outlets as evidence that running on its own cloud rather than shared Azure infrastructure insulated it.

MI

Microsoft Azure

Cloud infrastructure provider shared by OpenAI, Anthropic, and xAI; logged a separate East US network incident in the same window, widely cited as a possible common failure domain though never officially confirmed by any affected company.

CU

Cursor

AI coding tool dependent on Claude's and Grok's APIs; went down as a direct downstream consequence, illustrating how the outage cascaded into developer tooling.

事实来源

14 条引用
  1. [1] ChatGPT and Codex - Elevated errors and 404s
  2. [2] Anthropic Confirms Claude Is Down, Multiple Models Affected
  3. [3] Grok.com Status - Models
  4. [4] Grok Service Outages Spark Frustration as xAI Struggles With Explosive Demand
  5. [5] AI Outage: Are ChatGPT, Claude, Gemini and Grok Down?
  6. [6] Microsoft Azure Outage History
  7. [7] Gemini Survived When ChatGPT, Claude, Grok Collapsed - Azure Fault?
  8. [8] ChatGPT, Claude, and Grok Outages Hit Users Simultaneously
  9. [9] OpenAI Confirms Service Degradation Hitting ChatGPT and Codex Users
  10. [10] OpenAI Confirms ChatGPT Is Down Ahead of Astra Model Launch
  11. [11] Biggest AI Outages Since 2024: ChatGPT, Claude, and Cloudflare Disruptions That Shook the Industry
  12. [12] AI Apocalypse: ChatGPT, Claude and Perplexity Are All Down at the Same Time
  13. [13] ChatGPT, X Among Sites Blocked in Widespread Cloudflare Outage
  14. [14] AI Provider Concentration Risk: Enterprise Resilience

来源文章

Top 5

THE SIGNAL.

Analysts

认为前沿AI风险不仅集中在模型层,也存在于其底层的超大规模云层,因此当模型提供商与其底层云构成同一故障点时,企业面临相关联的失败风险:‘企业面临一个依赖于云层的AI层,集中性嵌入在两层之中。’

Cloud Security Alliance
行业研究机构,AI供应商集中风险分析(2026年6月)

发现81%的企业表示,其主要AI供应商若发生为期七天的中断,将导致严重或关键性业务中断,凸显单一供应商AI依赖已深度嵌入企业工作流程。

IBM Institute for Business Value
2026年企业调查

记录高信号AI中断事件从2025年第一季度的6起上升至2026年第一季度的51起,其中Claude占39天,表明随着使用量增长速度快于基础设施,行业整体可靠性正承受压力。

Ookla
网络与连接分析公司,2025-2026年分析
The Crowd

JUST IN: Widespread AI outage underway as ChatGPT, Claude and Grok are all down

@@axios1298

Major AI tools including ChatGPT, Claude, and Grok are currently experiencing widespread outages. Reports suggest issues with Microsoft Azure may be the cause

@@moneyacademyKE508

Temporary outages hit ChatGPT, Claude, and Grok earlier today from separate technical glitches: a routing error at OpenAI, infrastructure issues at Anthropic, and a models outage at xAI. All resolved now, services are fully operational per official status pages. Nothing bigger going on.

@@grok0

ChatGPT down: OpenAI chatbot not working in major outage

@u/MarvelsGrantMan13613000
Broadcast
ChatGPT, Claude & Grok DOWN?! Major AI Outage Hits Users Today

ChatGPT, Claude & Grok DOWN?! Major AI Outage Hits Users Today

Chat GPT | Claude | Grok Open AI Server Down

Chat GPT | Claude | Grok Open AI Server Down

Three AI Giants Went Dark at Once

Three AI Giants Went Dark at Once