🎯 科技 · AI
🔥 OpenAI、Anthropic、xAI三大AI巨头同日集体宕机,史上最严重AI服务中断事件引爆全球关注
北京时间9月3日夜至9月4日凌晨,美国AI服务遭遇集体"断更",ChatGPT、Claude、Grok三大主流模型同时出现大面积服务中断,持续时间约3小时40分钟。这是AI大模型商业化以来最大规模的服务中断事件,引发全球用户和资本市场的高度关注。
据海外实时服务故障监测平台Downdetector数据,OpenAI的故障报告超过1.2万份,Claude约1200份,Grok约1000份。谷歌Gemini、微软Copilot也收到大量中断报告,AI编程工具Cursor因依赖Claude和ChatGPT接口,同样出现大面积报错。三家公司均在官方状态页确认故障,OpenAI显示ChatGPT共15个组件、Codex共4个组件受影响。
一、故障背后:微软Azure与Cloudflare成疑点此次集体宕机的底层原因指向云基础设施。业内分析指出,微软Azure平台同期出现大量故障报告,而OpenAI、Anthropic、xAI三家均在不同程度上依赖Azure提供云计算服务。另有分析认为关键互联网底层设施Cloudflare出现了问题——其状态页面显示当天出现两项异常:影响R2自定义域名的HTTP/3问题,以及部分WARP用户的地理位置识别错误。2024年11月,Cloudflare曾同时引发xAI和ChatGPT宕机,此次疑似同样的底层故障引发连锁反应。
Anthropic技术部门员工CJ Avilla在社交媒体透露,此次事件由"基础设施问题"引发,但尚未给出预计恢复时间。AI本地化概念股Palantir股价因此暴涨7.81%,市场开始重新审视AI基础设施的集中化风险。
二、宕机之外的彩蛋:GPT-6 Astra同步发布在全球AI服务"集体罢工"之际,OpenAI反而在同一个晚上发布了最新的旗舰模型GPT-6 Astra,堪称"一边宕机一边发布"。GPT-6 Astra使用超过10万块GPU在得州Stargate数据中心完成训练,被称为"目前全球最智能、对齐程度最高的模型"。OpenAI总裁格雷格·布罗克曼在发布会上直言:"欢迎进入AGI时代",并表示人们未来或许会回头将"这个时间、这个模型"视为AGI到来的节点。
与此同时,此次宕机事件也让AI基础设施的"单点故障"风险浮出水面。当ChatGPT、Claude、Grok全部依赖少数几家云服务商时,一旦底层设施出问题,全球数百万依赖AI的用户将同时"断网"。这种集中度风险,或许正是AI产业下一阶段的必修课。
三、行业启示:AI基础设施需要"去中心化"此次事件也引发了业界对AI基础设施安全的深入讨论。有分析指出,当前AI服务高度集中在微软Azure、谷歌云、Amazon AWS等少数几家云平台,一旦某家云平台出现大面积故障,将直接导致多个AI服务同时中断。而Cloudflare作为全球最大CDN服务商之一,其基础设施问题更是直接影响了上游多个AI平台。
业内建议,AI服务商应加快"多云部署"策略,避免过度依赖单一云平台;同时,建立快速故障切换和降级机制,确保在大面积中断时核心服务仍可正常运行。此外,AI本地化部署和边缘计算的发展,也将是降低基础设施集中风险的重要方向。
综合21世纪经济报道、券商中国、华尔街见闻报道 | 2026年9月4日