4个最聪明的AI,在同一个早上几乎同时"断片"了。
上周四(北京时间9月3日晚),Anthropic的克劳德、OpenAI的ChatGPT、马斯克xAI的Grok、谷歌的Gemini——全球最顶尖的四款AI模型——陆续出现大面积服务中断。用户打开对话框,迎接他们的是冷冰冰的报错信息。
一个AI宕机不稀奇,四个一起出事,行业里几乎没见过。
先挂的是克劳德。早上9点23分(美国东部时间),Anthropic报告Mythos 5.1、Fable 5.1和Opus 5三款模型同时"高报错",15分钟后找到原因,3小时内修复。紧接着Sonnet 5也在中午短暂"抽风"。
一小时后,OpenAI的ChatGPT和Codex也开始"降级运行",11点13分才缓解,整个故障持续了约2小时。
Grok的崩盘最戏剧性。DownDetector的用户报错数从早上9点前的10条,45分钟内飙到1365条。屏幕上显示:"模型正在经历问题,我们正在尽快恢复服务。"
谷歌没公开承认Gemini有问题,但数据骗不了人:DownDetector上Gemini的报错从23条冲到412条,API状态监测站StatusGator直接判定Gemini API在10:45到11:15之间"疑似宕机"。
几个关键数据:
(1) Anthropic克劳德过去90天正常运行时间99.4%,上一次类似规模的部分中断发生在8月24日
(2) OpenAI的ChatGPT正常运行时间99.63%,Codex是100%
(3) AWS、Azure、Cloudflare三大云基础设施未报告重大问题,但DownDetector上这三家的报错数今天早上也明显抬升
OpenAI员工Tibo在X上给出一个解释:可能是"多米诺骨牌效应"——很多企业同时配置多家AI做备份,一家挂了流量瞬间涌向其他几家,其他几家扛不住又挂,传染一样扩散。
听起来合理。AI圈这两年讲的故事就是"全栈冗余",结果冗余方案在同一天被同一波压力打穿。
真正的问题不是这4家AI谁先出问题,而是整个AI行业的底层假设——"AI永远在线、随时可用"——第一次被同时击穿。企业把核心业务塞进大模型API的那一天起,宕机就不再是运维八卦,是商业事故。
8月31日,ChatGPT的"Work Mode"已经连续几个小时延迟。今天四大模型再次集体趴窝。用户开始问一个尴尬的问题:当最聪明的AI集体失联,我们到底在用什么撑业务?
AI不是永不宕机的云服务,它只是个有时候很聪明的程序。当四个最聪明的程序同时犯错,你最好提前想好B计划。