🎯 科技 · AI
🔥 全球三大AI平台同天宕机,暴露云基础设施单点依赖的系统性风险
北京时间9月3日凌晨,美国人工智能行业爆发有记录以来最大规模的集体服务中断。OpenAI旗下ChatGPT、Anthropic旗下Claude、xAI旗下Grok三大头部生成式AI服务相继大面积故障,谷歌Gemini、微软Copilot亦出现访问异常,事件持续约3小时40分钟,覆盖消费端、开发者工具及企业级应用全场景。
故障最早于美东时间9月3日上午9点23分左右集中爆发。据海外故障监测平台DownDetector数据显示,OpenAI收到超过1.2万份用户报告,Claude约1200份,Grok约1000份,三家合计超过1.4万份。这场"黑色三小时"堪称LLM历史上最黑暗的故障时刻。
从Claude率先报告异常算起,三家在92分钟内相继宣布服务中断,网页端、App与API全部无法访问。谷歌Gemini与微软Copilot同期亦收到大量中断反馈,AI编程工具Cursor直接公告,其部分服务因上游大模型故障而被迫中断。
值得关注的是,此次宕机事件恰好发生在OpenAI发布GPT-6 Astra的节点。宕机平息几小时后,OpenAI正式发布旗舰模型,宣称"欢迎来到AGI时代"。舆论把这两件事放在一起,给9月3日打上了"LLM史上最戏剧性一天"的标签。
多家头部AI厂商几乎同步宕机的背后,指向整个产业的核心隐患:对共享云基础设施的高度单点依赖。业内普遍分析认为,此次故障根源与微软Azure美东区域的网络异常、Cloudflare边缘服务故障直接相关。三家厂商的核心模型计算资源大量依赖同一批底层云服务商,模型层面的竞争再激烈,地基却是共享的。
综合财联社、21世纪经济报道、新华网报道 | 2026年9月4日