本文要点
- 官方事件影响 ChatGPT 的 15 个组件和 Codex 的 4 个组件;状态页未公开根因,也未给出统一错误码。
- 先记录入口、时间、错误正文、request ID、客户端版本和任务副作用,再暂停同一任务并发与自动补跑。
- 网页 404、登录失败、响应不生成、Codex agent 中断可能同属事件症状,但具体账号影响仍须以现场日志为准。
- 状态进入 monitoring 只表示缓解已应用;应等 resolved,并用固定入口的无副作用请求连续验证。
- 恢复后只有 Remote Control 仍断开时,才按官方提示重新配对移动设备;不要无证据清空工作区或重装客户端。
- 网络出口不能修复 OpenAI 服务端组件故障;只有 DNS、TLS、连接超时或 407 等独立证据才进入代理排查。
官方时间线:22:43 调查,00:55 恢复
OpenAI 状态页记录,事件于 2026 年 9 月 3 日 14:43 UTC(北京时间 22:43)进入 investigating,15:17 UTC(23:17)应用缓解并进入 monitoring,16:55 UTC(9 月 4 日 00:55)标记 resolved。受影响范围列为 ChatGPT 15 个组件、Codex 4 个组件。
官方只确认 elevated errors 已解决,并提示部分 Codex Remote Control 用户可能需要重新配对移动设备;没有公开根因、逐地区错误率或所有客户端的统一症状。社区关于模型发布、共享基础设施或攻击的猜测不能写成事实。
先判断是不是同一事件,不要看到失败就重启一切
核对发生时间、ChatGPT 或 Codex 入口、状态页组件、HTTP 状态与错误正文。公开讨论中有人遇到 ChatGPT 主页 404、页面不加载,以及 Codex 部分 agent 连续失败;这些是需求信号,不代表每个用户或 API 都经历相同错误。
如果状态页覆盖当前入口,优先冻结会产生外部写入的任务。若只有单一组织、单一设备或单一路由异常,而官方组件已恢复,则保留脱敏 request ID、账号类型、客户端版本和最小复现,转入账户或客户端排查。
六步止损:保存、暂停、对账、分类、等待、探测
第一,保存错误与北京时间。第二,停止相同 prompt、agent 或 automation 的并发重跑。第三,检查 Git、文件、工单、消息和部署记录,确认上一次是否部分完成。第四,把任务分为已完成、未执行、结果未知。第五,订阅或刷新官方事件页。第六,仅用无副作用的小请求做恢复探测。
结果未知的写操作不能直接补跑。为每个任务保留幂等键、原线程或原工作区和外部系统回执;先人工确认是否已提交,再决定续跑、补偿或放弃,避免重复提交代码、工单和消息。
Remote Control 何时需要重新配对
事件 resolved 后,如果 Codex 本地任务正常、但 Remote Control 手机端仍无法连接,才按官方事件提示重新配对移动设备。先记录原连接状态和客户端版本,再从当前 Codex Remote Control 界面发起新的配对,按界面提示完成验证。
官方事件页没有说明所有用户都必须重配对,也没有授权删除项目、清空本地状态或轮换账号。若重新配对入口不存在、验证持续失败或设备反复掉线,应停止尝试并携带事件时间与脱敏错误联系官方支持。
恢复门槛:resolved 之后仍要逐步放量
恢复至少要同时满足:官方事件已 resolved;固定入口的最小无副作用请求连续成功;本地错误率、延迟和队列深度回到基线。一次成功响应或社区有人说恢复,不足以直接放开全部定时任务。
先恢复读取和短任务,再恢复具有外部写入的 Codex 工作流。每批记录开始时间、完成率和失败类型;如果错误率再次上升,按原熔断阈值暂停,避免补偿流量制造第二轮拥塞。
把平台故障、账号错误与网络错误分开
官方组件故障影响服务端可用性;401、403、套餐权限、工作区政策和本地客户端配置属于其他层。DNS 解析失败、TLS、连接超时或 407 才是网络路径证据。不要因状态页事故同时修改密钥、模型、代理和提示词,否则恢复后无法定位真正变量。
需要稳定访问官方页面时可<a href="/" target="_blank" rel="noopener noreferrer">访问 PuppyIP 官网</a>了解固定网络出口,并参考<a href="/resources/proxy-connection-troubleshooting-checklist">代理连接排查清单</a>;固定出口不能修复 ChatGPT 或 Codex 的服务端 elevated errors。
资料来源
常见问题
这次 ChatGPT 与 Codex 故障什么时候恢复?
OpenAI 状态页在 2026 年 9 月 3 日 16:55 UTC,即北京时间 9 月 4 日 00:55,将事件标记为 resolved。
Codex 失败后可以直接重跑 agent 吗?
先检查文件、Git 和外部系统,确认上一次有没有部分执行。结果未知的写操作直接重跑可能造成重复提交或重复外部动作。
所有 Remote Control 用户都要重新配对吗?
不是。官方只说部分用户可能需要重新配对;应在事件恢复后且手机端仍断开时再按当前界面操作。
状态页进入 monitoring 就能恢复全部任务吗?
不能。monitoring 表示缓解已应用但仍在观察;等待 resolved,并用无副作用探针和自身错误率确认后再逐步放量。
换 IP 能解决 OpenAI elevated errors 吗?
不能修复服务端组件故障。只有 DNS、TLS、连接超时或 407 等独立网络证据出现时,才应排查代理路径。
官方说明了故障根因吗?
没有。事件页只说明 elevated errors、缓解和恢复状态,不能把社区关于模型发布、攻击或基础设施的猜测当成官方根因。