【TechWeb】9月4日消息,华盛顿时间9月3日晚间至4日凌晨,美国互联网世界经历了一场罕见的"AI地震"。从OpenAI的ChatGPT到xAI的Grok,从Anthropic的Claude到微软Copilot,几乎所有主流人工智能服务在同一时间陷入瘫痪,持续时间长达近4个小时。
这场被业界称为"有报告以来最大规模的AI宕机事件",不仅让数亿美国用户被迫与AI"断联",更将AI产业隐秘而脆弱的基础设施命脉暴露在聚光灯下。
集体宕机
美国东部时间9月3日早晨9时30分许(北京时间9月3日深夜),故障率先在OpenAI的ChatGPT平台上爆发。全球最大的在线服务监测网站Downdetector在短短20分钟内收到了超过12,000份用户报告,页面加载失败、对话中断、API调用超时等异常接连涌现。
几乎在同一时刻,Anthropic旗下的Claude、xAI的Grok、微软Copilot以及谷歌Gemini也相继出现服务异常。故障监测地图显示,整个北美大陆东海岸至西海岸几乎被红色警报覆盖,呈现出一幅触目惊心的"断网图景"。
此次宕机的波及面远超消费者端AI聊天应用。多位开发者吐槽,AI编程辅助工具Cursor也因底层模型依赖而出现服务降级,代码自动补全和智能建议功能几乎完全失效。
在美国社交媒体推特上#AIdown冲上了热搜。这次宕机在推特上催生了大量表情包和段子。许多用户开玩笑说,AI宕机后自己不得不“在工作中使用自己的智力”。有用户发帖说“ChatGPT宕机了、Grok宕机了、Claude宕机了,我也宕机了”,调侃自己对AI的依赖。
这场集体宕机一直持续到美国东部时间下午1时10分许(北京时间9月4日凌晨1时10分)才陆续恢复,累计影响时长约3小时40分钟。
矛头直指云基础设施:Azure还是Cloudflare?
对于此次集体宕机的根本原因,业界分析指向了两个可能的"元凶"。
第一个嫌疑指向微软Azure云服务。 公开信息显示,OpenAI、Anthropic和xAI均在不同程度上依赖Azure的云计算能力。而Downdetector数据表明,在AI服务大面积瘫痪的同时,Azure平台自身的故障报告也出现异常激增。这一时间线上的高度重合,令业界普遍认为Azure可能是此次连锁反应的"震中"。
第二个可能则是全球网络基础设施服务商Cloudflare。 事发时段,Cloudflare状态页面显示其服务出现两项异常:一是影响R2自定义域名的HTTP/3连接问题,二是部分WARP用户的IP地理位置识别错误。由于大量AI平台的请求流量需要经过Cloudflare的网络中转,其服务异常完全可能引发"蝴蝶效应"。值得注意的是,2024年11月Cloudflare的一次故障就曾导致xAI和Grok出现类似中断。
目前,微软Azure和Cloudflare均尚未对此次事件发布官方说明。
同一夜,OpenAI在"秀肌肉"。北京时间2026年9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra。距GPT-5首次发布约一年,距离上一个重要更新版本GPT-5.6仅过去两个月。OpenAI将此次发布定义为一次“代际跃迁”,公司总裁格雷格·布罗克曼在发布会上宣告:“欢迎来到AGI时代。”
