OpenAI三线齐崩:API、ChatGPT、Codex同时宕机,连续17天异常引发Agent时代可靠性担忧

2026/07/26 15:35阅读量 2

7月25日,OpenAI的API、ChatGPT、Codex三条产品线同时出现故障,31个服务组件性能下降,历时约1小时51分钟。这已是OpenAI连续第17天处于不正常状态。事件暴露出单点依赖风险,可能加速企业采用多云多模型路由策略。

事件概述

7月25日17时17分(北京时间),OpenAI官方状态页报告多项服务错误率升高,18时02分进入监测阶段,19时08分宣布全部恢复。此次故障覆盖API(12个组件)、ChatGPT(15个组件)和Codex(4个组件),合计31个服务组件性能下降。用户端表现为请求失败、响应异常、任务中断,Codex编程Agent在执行任务时可能卡住导致项目烂尾。

连续异常记录

第三方监测平台Bifrost显示,从7月9日起OpenAI没有一天完全正常:7月12日和16日发生两次重大故障(Major Outage),其余日期在性能降级(Degraded Performance)和部分中断(Partial Outage)间切换。另一监测站incidenthub记录,仅7月23日一天就有四起独立事故,涉及ChatGPT错误率和延迟;24日Codex Review报错;25日三线齐崩。

影响与趋势

在Agent时代,服务中断意味着生产系统(客服机器人、代码流水线、自动化审计等)停摆,111分钟的故障直接造成生产线损失。事件将可靠性(SLA)推到企业选型前台:模型能力榜频繁易主,但宕机损失按100%计算。多云多模型路由将从加分项变为企业AI架构标配,单家依赖风险被重新定价。同时,每次海外旗舰故障都为国产模型提供承接溢出需求的机会,前提是自身稳定性经得起同等负载考验。

原因推测

官方尚未公布原因。业内推测认为,夏季推理负载持续攀升,叠加新模型与新功能密集发布,基础设施长期处于压线运行状态。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。