4个最聪明的AI同时宕机:行业第一次被集体打穿

7次阅读

4个最聪明的AI,在同一个早上几乎同时"断片"了。

上周四(北京时间9月3日晚),Anthropic的克劳德、OpenAI的ChatGPT、马斯克xAI的Grok、谷歌的Gemini——全球最顶尖的四款AI模型——陆续出现大面积服务中断。用户打开对话框,迎接他们的是冷冰冰的报错信息。

一个AI宕机不稀奇,四个一起出事,行业里几乎没见过。

先挂的是克劳德。早上9点23分(美国东部时间),Anthropic报告Mythos 5.1、Fable 5.1和Opus 5三款模型同时"高报错",15分钟后找到原因,3小时内修复。紧接着Sonnet 5也在中午短暂"抽风"。

一小时后,OpenAI的ChatGPT和Codex也开始"降级运行",11点13分才缓解,整个故障持续了约2小时。

Grok的崩盘最戏剧性。DownDetector的用户报错数从早上9点前的10条,45分钟内飙到1365条。屏幕上显示:"模型正在经历问题,我们正在尽快恢复服务。"

谷歌没公开承认Gemini有问题,但数据骗不了人:DownDetector上Gemini的报错从23条冲到412条,API状态监测站StatusGator直接判定Gemini API在10:45到11:15之间"疑似宕机"。

几个关键数据:

(1) Anthropic克劳德过去90天正常运行时间99.4%,上一次类似规模的部分中断发生在8月24日
(2) OpenAI的ChatGPT正常运行时间99.63%,Codex是100%
(3) AWS、Azure、Cloudflare三大云基础设施未报告重大问题,但DownDetector上这三家的报错数今天早上也明显抬升

OpenAI员工Tibo在X上给出一个解释:可能是"多米诺骨牌效应"——很多企业同时配置多家AI做备份,一家挂了流量瞬间涌向其他几家,其他几家扛不住又挂,传染一样扩散。

听起来合理。AI圈这两年讲的故事就是"全栈冗余",结果冗余方案在同一天被同一波压力打穿。

真正的问题不是这4家AI谁先出问题,而是整个AI行业的底层假设——"AI永远在线、随时可用"——第一次被同时击穿。企业把核心业务塞进大模型API的那一天起,宕机就不再是运维八卦,是商业事故。

8月31日,ChatGPT的"Work Mode"已经连续几个小时延迟。今天四大模型再次集体趴窝。用户开始问一个尴尬的问题:当最聪明的AI集体失联,我们到底在用什么撑业务?

AI不是永不宕机的云服务,它只是个有时候很聪明的程序。当四个最聪明的程序同时犯错,你最好提前想好B计划。

正文完
 0