🎯 科技 · AI基础设施
一、美国打工人的崩溃早晨🔥 ChatGPT、Claude、Grok同日集体宕机近4小时,暴露AI服务高度依赖单一云基础设施的脆弱性
2026年9月3日清晨,美国当地时间的9点半,大批打工人在工位上打开电脑,发现日常离不开的AI工具全部掉链子。OpenAI的ChatGPT、Anthropic的Claude、xAI的Grok先后宣布服务异常,DownDetector上OpenAI相关故障报告突破1.2万份,Claude约1200份,Grok约1000份。AI编程工具Cursor也确认部分服务因上游故障受影响。
值得注意的是,这并非三家公司的首次独立故障——Claude在9月1日和9月2日已分别出现过服务降级,而今年6月22日Claude更是经历了约90分钟的全家桶级全局宕机。频繁"抖动"的背后,是AI服务可靠性成为落地生产环境的核心瓶颈。
二、底层设施牵一发而动全身此次集体宕机的根因很快被指向同一类基础设施问题。据Anthropic技术员工CJ Avilla在社交媒体透露,事件由"基础设施问题"引发。分析指出,关键在于微软Azure云平台出现异常——三家AI平台均依赖Azure提供云计算服务,而Azure当天下滑的稳定性直接拖累了所有挂载其上的AI应用。
与此同时,Cloudflare状态页面也显示两项问题:影响R2自定义域名的HTTP/3连接异常,以及部分WARP用户地理位置识别错误。这些看似独立的底层服务故障,最终汇聚成一场覆盖主流AI产品的连锁崩溃。
三、宕机中的尴尬与警示在AI集体下线的尴尬时刻,一个微妙的插曲引发热议:OpenAI恰在此时发布预热视频,暗示被称为"GPT-6"的Astra大模型即将上架。网友集体吐槽:醒醒,先把机房修好再炫耀吧。而智谱则低调表态"我们还在",在对手宕机时悄悄抢占用户注意力。
此次事件给全球AI产业敲响警钟:当AI从实验工具变成生产力基础设施,服务可用性不再是可选项而是生死线。多云架构、降级策略、冗余备份——这些传统IT领域的保命技能,正在成为AI公司的必答题。对于正在冲刺IPO的AI企业而言,可靠性不仅是技术指标,更是资本市场最看重的基本功之一。
综合财联社、华尔街见闻、界面新闻报道 | 2026年9月4日