🎯 科技 · AI

🔥 AI基础设施过度集中,一次"底层故障"让全球AI集体趴窝

9月3日晚间,全球AI用户经历了一场"集体宕机"。OpenAI旗下ChatGPT和Codex出现大量报错,Anthropic的Claude、xAI的Grok也未能幸免,谷歌Gemini和微软Copilot同样受到波及。据Downdetector数据,OpenAI收到超过12000份用户故障报告,成为当日受影响最严重的应用。然而仅仅几小时后,OpenAI宣布故障已解决,服务逐步恢复。

这场突如其来的"AI大崩盘",根子竟出在互联网底层设施Cloudflare身上。据Anthropic技术员工透露,事件由"基础设施问题"引发。Cloudflare状态页面显示,其R2存储服务的HTTP/3协议出现故障,部分WARP用户地理位置识别也出现错误。由于大量AI服务通过Cloudflare进行流量调度,一旦底层出现问题,上层的ChatGPT、Claude、Grok等应用便会集体"断炊"。

更讽刺的是,在AI集体宕机之际,OpenAI还在社交媒体上发布了新模型Astra的预热视频,引发网友集体吐槽:"醒醒,先把机房修好再炫耀吧。"这一事件也暴露出AI行业的隐忧:当多家顶级AI公司共用同一套基础设施时,单点故障的后果将被无限放大。据估算,此次宕机影响全球数亿用户的正常使用,经济损失难以精确统计。

随着故障恢复,OpenAI也再次强调了AI服务的稳定性挑战。专家指出,AI基础设施的集中化趋势正在加剧行业脆弱性,多元化部署和冗余备份将成为未来必选项。AI越来越强大,但"脆皮"的本质仍未改变。

综合财联社、界面新闻、网易新闻报道 | 2026年9月4日