🎯 科技 · AI应用
🔥 三大AI巨头同时宕机近4小时,底层基础设施成为AI生态最大软肋
美国当地时间9月3日清晨,一场罕见的AI服务集体"罢工"事件震惊科技圈。OpenAI的ChatGPT、Anthropic的Claude、xAI的Grok三大头部模型同时宣布服务异常,DownDetector网站数据显示,超过1.2万份用户报告指向OpenAI出现故障,Claude和Grok分别收到约1200份和1000份中断报告。
此次宕机从美国东部时间早晨9点半开始,持续了近4个小时。直到北京时间9月4日凌晨1点10分,所有服务才全部恢复。值得注意的是,谷歌Gemini在此次事件中从未报告服务中断,成为唯一"幸免于难"的头部AI模型。
一、宕机背后:底层基础设施成隐患据Anthropic技术部门员工CJ Avilla在社交媒体透露,此次事件由"基础设施问题"引发。分析指出,问题可能出在关键互联网底层设施Cloudflare。这个被全球众多网站依赖的CDN服务商,当天出现了两个问题:一是影响R2自定义域名的HTTP/3协议故障,二是部分WARP用户地理位置识别错误。
Cloudflare作为AI服务的"守门人",其稳定性直接影响上层应用。当底层网络设施出现问题时,依赖它的ChatGPT、Claude、Grok等模型无一幸免。AI编程工具Cursor也受到影响,部分服务因Claude、ChatGPT和Grok故障而中断。
二、Timing荒诞:宕机撞上GPT-6预热更具戏剧性的是,此次宕机发生在OpenAI预热"GPT-6"即将上线的时间点。就在AI服务集体下线的同一时刻,OpenAI在社交媒体上突然发布预热视频,显示被称为"GPT-6"的Astra大模型似乎即将上架。
这一" timing "引发网友集体吐槽:"醒醒,先把机房修好再炫耀吧"。更有分析指出,微软Azure同样出现了故障报告激增的情况,而三家AI平台均依赖Azure提供云计算服务。
三、智谱趁机冒头:"我们还在"在这场美国AI集体下线的危机中,中国公司智谱悄悄冒头,在社交媒体表示"我们还在"。这一策略性发声引发业界关注。有业内人士指出,此次事件凸显了AI基础设施国产化的重要性,过度依赖单一云服务商和CDN节点,将成为行业发展的潜在风险。
此次集体宕机事件也引发了行业对AI服务稳定性的重新思考。当AI从"玩具"走向"工具",其底层基础设施的可靠性将成为决定应用成败的关键因素。正如一位分析师所言:AI的竞争正在从模型能力延伸到基础设施韧性。
综合财联社、华尔街见闻、界面新闻、Downdetector报道 | 2026年9月4日