🎯 科技 · AI基础设施

🔥 美国三大AI巨头OpenAI、Anthropic、xAI服务同日遭遇大规模宕机,持续近4小时,凸显AI基础设施高度集中于少数云服务商的脆弱性

北京时间9月3日晚至4日凌晨,美国主流AI服务遭遇历史性集体宕机。OpenAI旗下ChatGPT与Codex、Anthropic旗下Claude、xAI旗下Grok几乎同一时间出现大规模故障,受影响用户数以百万计。此次事件被业界称为黑色星期四,也成为有报告以来最大规模的AI宕机事件。

故障最早于美东时间9月3日上午9点23分左右集中爆发。据海外故障监测平台DownDetector数据显示,Anthropic的Claude系列模型率先出现错误率飙升,涵盖Mythos 5.1、Opus、Fable 5.1等核心模型。仅两分钟后,xAI的Grok服务全端下线,网页、移动应用、API接口均出现访问超时。约一个半小时后,OpenAI的ChatGPT与编程工具Codex也出现大规模访问错误。事件峰值期间,全球针对OpenAI服务的故障报告超过3.7万份,其中80%集中于ChatGPT。

此次宕机持续约3小时40分钟,截至北京时间9月4日凌晨1点10分,所有服务已逐步恢复。Anthropic技术部门员工CJ Avilla在社交媒体透露,事件由基础设施问题引发。有分析指出,底层原因可能与关键互联网底层设施Cloudflare出现问题有关。Cloudflare状态页面显示当天出现两个问题:影响R2自定义域名的HTTP/3问题,以及部分WARP用户地理位置识别错误。OpenAI、Anthropic、xAI均依赖微软Azure提供云计算服务,Azure平台同期也出现��障报告激增。

二、国内模型稳如泰山

在美方AI巨头集体宕机的同时,中国大模型表现稳健。9月3日晚间,国内大模型巨头智谱在社交媒体X上发文我们还在线,引来大量关注。智谱同期宣布,即日起至9月20日,每晚23点至次日9点,调用套餐中的GLM-5.3-Flash在Z Code中免费使用,在套餐支持的其他Agent中使用额度翻倍。GLM-5.3-Flash是全球权威Artificial Analysis Intelligence Index中取得57分的前沿模型。

三、AI基建集中度风险凸显

此次集体宕机暴露了AI基础设施的高度集中风险。OpenAI、Anthropic、xAI等头部AI公司大量依赖微软Azure等少数云服务商,一旦底层基础设施出现波动,将引发连锁反应。AI编程工具Cursor直接公告,其部分服务因Claude、ChatGPT和Grok故障而被迫中断。业内消息指出,这一事件也推动AI本地化概念股Palantir美股暴涨7.81%。

综合21世纪经济报道、界面新闻、澎湃新闻报道 | 2026年9月5日