🎯 科技 · AI服务

🔥 美国主流AI服务集体宕机超3小时,Cloudflare基础设施故障牵动整个AI生态

一、AI巨头集体宕机,打工人崩溃

美国当地时间9月3日上午9点半,全球顶级AI服务几乎在同一时间集体瘫痪。ChatGPT、Claude、Grok三大头部AI平台纷纷发布服务异常公告,谷歌Gemini和微软Copilot也收到大量用户中断报告。Downdetector数据显示,OpenAI故障报告突破12000份,Claude约1200份,Grok约1000份,AI编程工具Cursor也因依赖上游模型而受影响。

这在美国AI发展史上极为罕见。此前各平台故障通常是孤立事件,但此次三巨头同框趴窝引发了市场对AI基础设施依赖程度的广泛讨论。有分析指出,这暴露了当前AI服务过度集中化带来的系统性风险。

二、底层基础设施成关键瓶颈

据Anthropic技术员工CJ Avilla在社交媒体透露,此次事件由基础设施问题引发。更有分析直指关键互联网底层设施Cloudflare——当用户访问网站时,请求通常先经过Cloudflare进行安全校验和路由,而Cloudflare状态页面显示当天出现两个问题:一是影响R2自定义域名的HTTP/3问题,部分使用自定义域名连接Cloudflare R2存储的网站出现请求失败;二是部分WARP用户地理位置识别错误。

另有消息指出,底层原因可能与微软Azure有关,该平台当天同样出现大量故障报告。Anthropic、xAI与OpenAI均依赖Azure提供云计算服务,其算力架构中也包含谷歌等其他服务商。这种多层依赖结构使得任何一环出现问题都会产生连锁反应。

三、宕机之际OpenAI逆势发布GPT-6

非常戏剧性的是,就在主流AI集体宕机之际,OpenAI于同日发布新一代旗舰模型GPT-6 Astra。OpenAI总裁Greg Brockman称人们未来或许会将这个时间这个模型视为AGI到来的节点。Astra使用超过10万块GPU在得州Stargate基地完成训练,在软件工程、科学推理、计算机操作和网络安全等领域实现重大突破。

行业观察人士认为,此次宕机事件与GPT-6发布形成鲜明对比,恰恰说明AI基础设施的脆弱性与AI能力跃升之间存在巨大张力——模型越强,对底层基础设施的依赖就越深,系统韧性建设成为下一个关键战场。AI基础设施的稳定性,正在成为继模型能力之后新的竞争分水岭

综合财联社、券商中国、中国蓝新闻报道 | 2026年9月4日