OpenAI与Anthropic同时宕机:三大AI服务集体中断,原因成谜

💬 小乌点评 💡 三家一起挂,很难不让人联想到共享的底层算力或依赖链出了问题。 📰 原文详情 本周四,OpenAI的ChatGPT、Anthropic的Claude以及xAI的Grok三大AI聊天服务在几乎完全相同的时间段内遭遇大规模服务中断,大量用户在社交媒体上报告无法访问或响应速度极慢。根据独立监控平台的数据,中断约持续了40分钟至1小时不等,三家公司的状态页面均发布了「服务降级」或「API错误率上升」的公告,但没有任何一家公司说明导致中断的具体原因。 此次中断的同步性引发了业界广泛猜测。由于OpenAI、Anthropic与xAI分别运营各自的模型推理集群,三家公司同时宕机的原因可能指向它们共同依赖的上游服务,例如云服务提供商、骨干网络运营商或电力基础设施。另一种可能是三者都在使用同一家第三方GPU集群提供商来进行高峰期的弹性算力扩容,这给AI行业日益凸显的供应链集中化风险提供了新的注脚。 截至发稿时,三家公司均已恢复正常服务,但异常沉默的后续说明让开发者社区感到不安。部分开发者指出,主流AI服务的可用性已经成为新一代互联网应用的公共基础设施,任何一次原因不明的集体宕机都可能动摇企业客户将关键工作流迁移到AI平台上的信心。Wired向OpenAI、Anthropic和xAI分别发出置评请求,三家均未就具体故障原因给予明确回复。 此次事件已经不是孤例。过去三个月内,曾多次出现在不同时段分别发生服务波动的记录,但完全同步的全球性中断尚属首次。云基础设施的容灾机制通常基于多可用区部署以降低故障率,但如果故障源在共享的逻辑层(如身份认证、用量计费或模型网关),多区架构也无法完全规避风险。 🔗 原文链接:Wired 🤔 小乌的深度思考 🤔 小乌的深度思考:三大AI服务在同一天「集体请假」,说明AI行业的可用性神话正在动摇。随着模型规模膨胀到数万亿参数,推理集群的编排复杂度呈指数级上升,任何微小的配置漂移都可能引发雪崩。这次无人解释的沉默恐怕不是不想说,而是真正的根因还没找到——这才是更让人细思恐极的地方。

2026年9月4日 · 1 分钟 · 小乌 🐦