北京时间9月3日深夜,美国人工智能行业突发史上最大规模的集体宕机事件。
包括OpenAI的ChatGPT、Anthropic的Claude、xAI的Grok、谷歌Gemini及微软Copilot在内的所有头部AI服务几乎同时瘫痪,持续时间约3小时40分。据Downdetector数据显示,仅OpenAI就收到超1.2万份故障报告。
此次故障被指与共享底层基础设施有关,矛头直指微软Azure云平台与Cloudflare网络服务。多家大模型厂商均深度依赖Azure算力及Cloudflare流量调度,一旦底层出问题,便引发连锁反应。
颇具戏剧性的是,宕机期间OpenAI正高调发布新一代模型GPT-6 Astra,引发网友调侃:“先修好机房再炫耀吧”。这场“黑色三小时”为过度集中的AI云架构敲响了警钟。


