9月3日清晨,ChatGPT、Claude和Grok同时宕机,用户报告合计超1.4万份,中断近4小时。同一天OpenAI发布GPT-6 Astra,宣称人类进入AGI时代。事件暴露头部AI共享算力基座的集中性风险。
美东时间9月3日早晨,开发者刚到工位便撞上罕见的集体故障:Claude的对话框停在原地转圈,ChatGPT的请求反复报错,Grok的页面只剩一片空白。三款彼此竞争的主流产品,在同一个早晨同时失灵。

故障监测平台Downdetector上,OpenAI收到的用户报告超过1.2万份,Claude约1200份,Grok约1000份,三家合计超过1.4万份。自Claude率先报告异常起,92分钟内三家公司相继确认服务中断,网页端、App与API全部无法访问。谷歌Gemini和微软Copilot的中断报告也在同步上升,但Gemini大体维持可用,成了少数还能正常工作的主流大模型。从时间线看,美东时间9月3日9点半左右Claude率先报错,随后Grok、ChatGPT出现大规模中断。各家状态页确认问题并启动修复,但未发布正式故障报告。北京时间9月4日凌晨1点10分前后,服务陆续恢复,中断持续近四小时。
这一天原本属于GPT-6。宕机平息几小时后,OpenAI正式发布旗舰模型GPT-6 Astra,宣称“人类来到AGI时代”。舆论把两件事放在一起,给9月3日贴上了“大语言模型史上最黑暗一天”的标签。
故障波及的不只是聊天窗口。OpenAI的编程工具Codex一同失联,AI编程助手Cursor也承认,部分服务因依赖Claude、ChatGPT和Grok而受损。对把自动化任务交给API的开发者来说,宕机窗口内的每一分钟,都意味着流水线停摆。
故障源头至今没有统一说法。坊间猜测指向底层云基础设施,有人点名AWS,也有人认为三家公司共享Azure的计算资源,“多因素叠加”的说法同样存在。OpenAI和Anthropic未公布具体原因,仅在状态页将故障标记为已解决。唯一给出明确解释的是xAI,它就孟菲斯数据中心的宕机向Grok用户及受影响的“计算合作伙伴”致歉。
“计算合作伙伴”这个说法,承认了一个公开的秘密——头部AI公司共用同一批底层算力。模型层面的竞争再激烈,地基却是共享的。
宕机正酣时,ChatGPT官方账号发来一句预告:“The stars are almost aligned(星星几乎对好了)。”Astra在拉丁语中意为星辰,OpenAI把它称作“新一代智能”,称其是“当今世界智能水平最高、对齐表现最好的模型”。初期仅向部分机构开放,包括参与Daybreak Access网络安全项目的组织。“星星几乎对好了”与三家集体熄火在同一天先后抵达,AGI宣言的第一天,就这样以一场宕机开场。
宕机进行时,Hugging Face联合创始人Thomas Wolf先是转发汇总三家宕机消息的推文,问“这种情况下你会用哪个AI”,几小时后更正了自己的说法——宕机的是所有闭源AI服务。结合他此前“发起第一次自主AI攻击的将是闭源模型,而完成防御的却是开源模型”的判断,这次宕机被不少人读作又一个论据:闭源阵营的集中性风险,正以各种形式暴露。
问题不在于哪家模型更强,而在于它们站在同一片地基上——一个上游节点的故障,就能让头部产品同时倒下。这次事件真正值得审视的,不是某家公司的修复速度,而是AI行业对底层基础设施的集体依赖。头部模型厂商把大量算力集中托管在少数云厂商的数据中心,可靠性因此悬于一条供应链之上。OpenAI过去一年已多次出现服务中断,7月更一度连续多日未能保持稳定服务,基础设施承压并非偶发。
宕机的直接损失可以量化,信任的折损却难以估量。企业客户正把越来越多工作流迁到AI产品上,一次集体失联就足以打断整条生产链。“你会用哪个AI”背后真正的问题是:用户敢把多少关键业务交给它?它会不会在某天早晨和竞争对手一起倒下?
当天下午,三家公司状态页先后转绿,GPT-6 Astra按计划向首批机构开放。但这次宕机真正留下的,不是几小时的中断记录,而是一项需要重新估值的风险:头部AI服务共享同一片底层算力,模型能力的比拼之外,可靠性的竞争才刚刚开始。
免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断