🎯 科技 · AI

🔥 美国主流AI服务罕见集体宕机,暴露AI基础设施高度依赖少数云端服务商的脆弱性

一、一场罕见的"集体宕机"

美国当地时间9月3日一大早,刚到工位的打工人们惊讶地发现,美国主流AI集体宕机了。截至发稿,OpenAI的ChatGPT、Anthropic的Claude以及xAI的Grok均宣布服务出现异常。DownDetector网站显示,报告谷歌Gemini、微软Copilot出现服务中断的数量也明显上升。OpenAI故障报告突破1.2万份,Claude约1200份,Grok约1000份,多家头部AI服务罕见"同框"异常。

AI编程工具Cursor亦表示,其部分服务因Claude、ChatGPT和Grok故障受影响,用户无法正常使用。面对这场罕见的AI集体下线危机,智谱悄悄冒头表示:"我们还在。"这场集体宕机事件,让公众再次意识到AI基础设施的脆弱性。

二、幕后元凶:Cloudflare出问题了

据Anthropic技术部门员工CJ Avilla在社交媒体透露,此次事件由"基础设施问题"引发。有分析指出,此次事件可能与关键互联网底层设施Cloudflare出现问题有关。简单来说,用户访问某个网站时,请求并非直接打到网站自己的机房,而是先进入Cloudflare,由它判断用户身份和攻击风险后返回内容。

Cloudflare状态页面显示,当天出现了两个问题:一是影响R2自定义域名的HTTP/3问题,部分使用自定义域名连接Cloudflare R2存储的网站或应用,通过HTTP/3发起请求时可能出现失败或性能下降;二是部分WARP用户地理位置识别错误,一些用户可能被识别为从错误的地理位置连接。一个底层设施的故障,竟能让整个AI生态集体"趴窝"。

三、AI基建的"单点故障"隐忧

非常凑巧的是,就在"AI大崩盘"发生之际,OpenAI在社交媒体上突然发布预热视频,显示被称为"GPT-6"的Astra大模型似乎即将上架。此举也引发网友集体吐槽:"醒醒,先把机房修好再炫耀吧。"

这场集体宕机暴露了一个深层次问题:随着AI服务越来越依赖少数几家云端基础设施提供商,整个行业的"单点故障"风险正在急剧上升。当Cloudflare这样一个关键的互联网基础设施出现问题时,受影响的不是一家公司,而是整个AI生态。业内人士提醒,AI行业的快速发展背后,基础设施的冗余性和安全性仍需引起高度重视。AI跑得越快,底层基建越要稳。

综合财联社、界面新闻、第一财经报道 | 2026-09-04