会懂网AI资讯,9月5日,北京时间9月3日深夜,美国主流AI服务集体出现故障,ChatGPT、Claude、Grok相继宣布服务异常,谷歌Gemini与微软Copilot也收到大量中断报告。此次大规模宕机持续约3小时40分,截至北京时间9月4日凌晨1点10分所有服务恢复。

据Downdetector数据,故障高峰时关于OpenAI的问题报告超过12000份,Claude约1200份,Grok约1000份,编程工具Cursor也因底层模型故障受到影响。Anthropic技术部门员工在社交媒体透露,事件由”基础设施问题”引发,另有分析指向微软Azure。
多家独立媒体还原了时间线:宕机约开始于美东时间9月3日上午,ChatGPT与Codex先报”访问量激增、错误率升高”,随后Claude与Grok几乎同步失联,Gemini出现零星报错。根因被广泛认为与微软Azure”美国东部”区域的基础设施故障相关——OpenAI、Anthropic、xAI均依赖Azure提供云计算,而运行在谷歌云上的Gemini基本未受影响。
这次”同框宕机”暴露了AI产业的集中风险:三大互相竞争的平台竟共享同一云底座,一旦区域故障便连锁崩塌。行业观察者指出,真正存活的Gemini靠的是谷歌自建TPU与独立云,而非基础设施独立性。这也提醒企业用户,多模型备份若跑在同一朵云上,并不能真正分散风险。
会懂网观察,当AI成为数百万开发者与企业的关键基础设施,其可靠性已不取决于模型能力,而取决于底层云的冗余与故障域隔离。这场宕机给所有依赖单一云厂商的AI应用敲响了警钟。






















暂无评论内容