竞争对手共享的房东
OpenAI、Anthropic 和 xAI 各自对9月3日的中断给出了不同的官方解释:ChatGPT 和 Codex 是路由错误,Claude 是未指明的基础设施问题,而 Grok 则是 xAI 自有的孟菲斯计算中心发生硬件故障[1]。但表面上看三家无关公司同一天早晨出问题,却忽略了一个在后续报道中浮现的结构性细节:Anthropic 和 xAI 在同一孟菲斯站点存在计算合作,这意味着 Claude 的前沿算力与 Grok 的主数据中心并不像品牌名称所暗示的那样独立。这一关联有助于解释为何一家公司的设施硬件问题会波及另一家公司的状态页面,以及为何组织架构图上看似稳健的冗余机制仍可能追溯到同一栋物理建筑。前沿规模的模型还运行在通过线路连接、共同构成单个巨型计算单元并共享内存的 GPU 机架集群上,因此当故障发生时,并没有闲置的备用算力可供切换,除非将基础设施成本直接翻倍。



