🎯 科技 · AI安全
一、黑色三小时:三大AI巨头同一天"掉线"🔥 ChatGPT、Claude、Grok同一天集体宕机近4小时,暴露AI产业底层基础设施的单点依赖风险
北京时间9月3日夜,美国人工智能行业遭遇有记录以来最大规模的集体服务中断。OpenAI旗下ChatGPT、Anthropic旗下Claude、xAI旗下Grok三大头部生成式AI服务先后出现大面积故障,谷歌Gemini、微软Copilot亦收到大量中断反馈。
故障最早于美东时间9月3日上午9点23分左右集中爆发。据海外故障监测平台DownDetector数据,OpenAI服务故障报告超过3.7万份,其中80%集中于ChatGPT;Claude约1200份,Grok约1000份。AI编程工具Cursor直接公告,其部分服务因上游大模型故障而被迫中断。
三家厂商均在第一时间通过状态页确认故障。OpenAI表示,故障源于太平洋时间早7点43分出现的路由错误;Anthropic技术员工CJ Avilla透露,事件由"基础设施问题"引发;xAI则确认故障源于孟菲斯计算中心的一次事故。
二、故障根源:共享云基础设施的"阿喀琉斯之踵"三家公司同期掉线,并非巧合。业内普遍分析认为,故障根源指向整个AI产业的深层隐患——对共享云基础设施的高度单点依赖。
公开信息显示,OpenAI、Anthropic和xAI三家头部厂商的核心算力均主要部署在微软Azure平台上。与此同时,云服务巨头Cloudflare也出现异常:其R2存储服务在HTTP/3协议层面发生故障,部分WARP用户地理位置识别出现错误。
这不是Cloudflare第一次引发大规模连锁故障。2024年11月,Cloudflare一次故障曾同时让xAI和ChatGPT宕机。历史正在重演——当三大AI巨头共用同一条"数字高速公路",一次事故就能让全网断流。
三、意外插曲:OpenAI GPT-6发布遇上"黑色星期四"更具戏剧性的是,此次故障恰好发生在OpenAI预热新一代大模型的节点。当日OpenAI官方社交媒体发布预热视频,配文"The stars are almost aligned",暗示GPT-6系列即将发布,却不料遭遇服务中断,引发大量用户调侃。
而就在AI巨头集体宕机之际,OpenAI正式发布GPT-6 Astra,并称其为"目前全球最智能、且对齐程度最高的模型",使用超过10万块GPU在得州Stargate基地完成训练。OpenAI总裁格雷格·布洛克曼表示,人们未来或许会将"这个时间、这个模型"视为人工通用智能(AGI)到来的标志性节点。
有意思的是,国内大模型却依然坚挺。智谱AI在社交媒体X上发文"We are still up",随即宣布GLM-5.3-Flash在指定时段免费开放使用。这场"黑色三小时",不仅暴露了美国AI产业的基础设施脆弱性,也让更多行业意识到:AI安全与自主可控,早已不是选择题而是必答题。
综合新华网、21世纪经济报道、澎湃新闻报道 | 2026-09-05