当前高影响问题
Codex 用量异常消耗可能是误限流
usage
rate limits
official incident
重点:用量突然消耗得异常快时,先查官方状态;不要反复重试、清配置,或立刻认定订阅失效。
OpenAI 在 2026 年 6 月确认:部分 Codex 账号可能被 abuse / fraud prevention 系统错误限流,导致用量消耗快于预期。官方称影响范围有限,事件现已恢复。
训练规则
- 先确认 Usage UI、实际限额错误、订阅档位、模型和发生时间是否一致。
- 先查状态页;有相符事件时暂停高消耗任务并等待恢复,不反复发送同一请求。
- 状态正常且多端持续复现时,再保存错误原文、reset 时间、版本和使用表面,按账号或限额问题上报。
来源
OpenAI Status: Codex Usage Limits Depleting Faster Than Expected
服务过载先按状态页止损
capacity
status
gpt-5.6-sol
重点:多端同时出现 server overload 时,先查状态页并暂停盲目重试;不要马上改网络、清配置或重复发起长任务。
OpenAI 在 2026 年 7 月确认 Codex 5.6-sol 出现 increased server-overload errors,随后已恢复;官方 6 月复盘还确认一次服务端配置事故曾让 Codex 请求被错误拒绝为 HTTP 429。相近错误在同一时间跨表面出现时,应先判断为服务侧事件,不要直接认定个人额度耗尽。
训练规则
- 先记录发生时间、模型、使用表面和错误摘要,再查看状态页。
- 状态页有相符事件时,暂停重复提交;对长任务先保存已完成摘要,等待恢复后用一个最小请求复测。
- 遇到突发 429 时,同时核对状态页、Usage 和受影响表面;只有状态正常且跨表面持续时,才按个人限额或授权处理。
- 状态页恢复但问题仍持续时,再分层检查账号、网络、客户端版本和本机日志。
来源
OpenAI Status: Codex 5.6-sol Experiencing Increased Server-Overload Errors、OpenAI Status: 429 incident write-up
access denied 先分服务事件和本地凭据
auth
Desktop
CLI
重点:Desktop 与 CLI 同时出现 access denied,先查状态页;不要立刻反复退出登录、清配置或重装。
OpenAI 在 2026 年 7 月确认,部分用户使用 Codex Desktop 与 CLI 时会收到 access-denied errors,事件现已恢复。这说明“未授权”文本也可能来自服务侧访问故障,而不必然是本地凭据失效。
训练规则
- 先记录发生时间、错误摘要、客户端版本和受影响表面,再查看状态页。
- 状态页有相符事件时,等待恢复后用最小请求复测,不反复登录或重复发起长任务。
- 状态正常且只在单一设备或表面持续时,再检查登录状态、网络路径和客户端版本;上报时不提交 token。
来源
OpenAI Status: Some users are unable to access Codex
会话加载失败和 Codex 请求失败可能同属服务侧容量事件
auth
capacity
official incident
重点:如果会话无法加载或继续,同时 Codex 请求失败,先留检查点并查状态页;不要先清登录态或重建配置。
OpenAI 对 2026 年 7 月 19 日事件的复盘说明,区域身份服务的数据库副本维护导致容量不足,使部分 ChatGPT 会话与部分 Codex 请求出现错误。服务已通过切走受影响区域流量恢复。
训练规则
- 记录开始时间、使用表面、能否继续已有会话和最小 Codex 请求结果。
- 状态页有相符事件时,先保存任务摘要,暂停重复提交和破坏性本地修复;恢复后用一个最小请求验证。
- 状态正常且只在单端持续时,再检查网络、登录、版本和本机日志。
来源
OpenAI Status: Elevated errors affecting ChatGPT (July 19 write-up)
Codex Review 报错先确认服务状态,再处理单个 PR
review
GitHub
official incident
重点:Review 错误并不总是 GitHub 授权或 PR 配置问题;先查状态页,恢复后再做一次最小重试。
OpenAI 于 2026 年 7 月 24 日确认 Codex Review 出现 elevated errors,受影响组件已恢复。状态页未公开根因,因此不能把这条服务事件归结为任一仓库、connector 或本机配置。
训练规则
- 保留 PR 链接、提交、发生时间、使用入口和错误摘要。
- 状态页有相符事件时,暂停批量重复 review;恢复后只重试一次,避免重复评论或重复消耗。
- 状态正常且仅单个 PR 持续失败时,再核对 GitHub app 安装、connector 授权、目标仓库和 review 设置。
来源
OpenAI Status: Elevated Errors in Codex Review
Desktop 恢复线程时可能因 thread_tools 崩溃
Desktop
session
config
重点:旧线程一打开就崩时,先保护会话数据;thread_tools 不一定来自用户手写配置。
新的公开报告显示,macOS Codex Desktop 在恢复线程时可能出现 SIGKILL 和 unknown feature key in config: thread_tools,即使用户确认本地配置里没有这个 key。类似 thread_tools 问题此前也在 extension/app-server 路径中出现过。
训练规则
- 先判断是特定旧线程崩,还是新线程也崩。
- 先只读备份会话、附件、错误原文和版本信息,不要直接清空全部状态。
- 能开新线程时,用摘要接力继续关键工作;不能开时切 CLI/Web 或等待修复版本。
- 上报时带 App 版本、平台、是否 resume 崩溃、是否特定线程、配置里是否真的有该 key。
来源
openai/codex #29322、openai/codex #29140、OpenAI Status
SessionStart compact hook 可能延迟到后续轮次
hooks
context
compaction
重点:不要把压缩后的规则恢复完全托付给 SessionStart(source=compact);长任务先写检查点。
公开报告显示,长轮次中发生 auto-compaction 后,匹配 compact 的 SessionStart hook 可能没有在压缩边界立即送达,而是排队到后续用户轮次才执行。这会造成压缩后上下文没有及时恢复,或后续普通轮次出现旧 context 重复注入。
训练规则
- 依赖 hooks 恢复规则时,先用最小 marker 验证 hook 是否在压缩边界真实触发。
- 长任务接近上下文上限时,主动写检查点和关键规则摘要。
- 如果后续轮次突然出现旧规则复活,先查 compact hook 是否延迟执行。
- 上报时带 hook 配置、事件名、压缩标记、hook payload 时间顺序和最小复现。
来源
openai/codex #28736、openai/codex #22220
MCP Auth required 先分 OAuth 和 bearer token
MCP
auth
config
重点:错误提示让你运行 codex mcp login,不一定代表 OAuth 未登录;先看该 server 是 OAuth 还是 bearer token。
公开报告显示,使用 bearer_token_env_var 的 MCP server 如果 token 缺失、过期或被拒绝,也可能被提示成 OAuth 登录问题。官方 MCP 文档同时支持 bearer token authentication 和 OAuth authentication;只有支持 OAuth 的 server 才应优先运行 codex mcp login <server-name>。
训练规则
- 看到 MCP
Auth required,先检查配置中的认证模式。
- 如果是 bearer token,检查环境变量是否存在、token 是否有效、当前 Codex 进程是否能读到它。
- 如果是 OAuth,才执行 MCP login,并用新线程或重启验证授权是否刷新。
- 上报时带 server 类型、transport、认证模式和错误原文;不要上传 token 值。
来源
openai/codex #26760、Codex MCP docs
MCP OAuth 登录成功后当前线程仍可能卡住
MCP
OAuth
session
重点:MCP 登录成功不等于当前已打开线程已经刷新授权;要分清浏览器授权、Codex 凭据缓存和线程内 MCP client 状态。
公开报告显示,远程 HTTP MCP server 通过 OAuth 浏览器登录成功后,原本已经打开的 Desktop 线程仍可能继续报 OAuth required。另一则尚未确认的报告称,部分服务器在 access token 过期后的 refresh 请求要求 resource 参数;缺失时,标为 required 的 MCP server 甚至可能阻止新任务初始化。官方文档说明 Streamable HTTP MCP 支持 OAuth,并通过 codex mcp login <server-name> 登录;官方认证文档也说明 Codex 会缓存登录详情。
训练规则
- 先问 MCP server 名称、登录入口、是否当前线程在登录前已经打开、重开线程/重启 Codex 后是否恢复。
- 把“OAuth provider 已授权”“Codex 已缓存凭据”“当前线程 MCP client 已重新握手”拆成三层验证。
- 若只在 token 过期后失败,记录 transport、resource/audience 配置、过期时间和是否阻断新任务;先隔离 required server 再继续基础任务,不要反复浏览器登录。
- 临时绕过:新开线程、重启 Codex、禁用再启用该 MCP,或改用 bearer token/env 配置;不要把它误判成 ChatGPT 主账号登录失败。
- 上报时带 server 类型、Codex 版本、平台、错误原文、是否新线程可用;不要上传 token、auth 文件或私密工作区内容。
来源
openai/codex #29279、openai/codex #33403、Codex MCP docs、Codex Authentication docs
线程从列表消失不等于数据删除
session
index
recovery
重点:会话列表里找不到线程时,先按索引/预览失效处理,不要立刻判定历史被删。
公开报告显示,Desktop 线程的第一条真实请求如果来自粘贴文本附件,重建本地索引后可能从项目会话列表消失,但原始 session 和附件仍在本地。另有 macOS 单例报告称,刚启动时的 runtime 同步重启可能让已经提交的首条提示没有持久化进新线程。再加上跨 Web/Desktop 后长对话不可见的未确认报告,结论仍不是“数据已删除”,而是重要内容必须有检查点。
训练规则
- 先只读备份:会话文件、附件、线程标题、可见最终消息和项目文件,不先清理、不先覆盖。
- 重要首条提示在启动或插件同步期间提交后,先确认它已出现在当前线程或已有 turn 进度;空白线程要先留证并开新线程接力。
- 跨 Web/Desktop 切换重要长任务前,确认产物已保存并写短检查点;若两端都找不到线程,先停止继续发送消息或清状态,再记录标题、时间、surface、账号/工作区和产物引用。
- 排查顺序:列表索引、归档状态、线程标题/预览、附件型首条消息、session replay 错误,再判断是否需要新线程接力。
- 如果只是列表消失,优先恢复索引或按 session id 查找;如果 replay 失败,保留错误原文并请求内置修复或上报。
来源
openai/codex #29323、openai/codex #25290、openai/codex #33080、openai/codex #32944
提交后界面冻结,不等于任务没开始
Desktop
session
duplicate
重点:提交任务后界面冻结,先确认任务状态;不要因为看不到进度就重复提交同一任务。
一则 macOS Desktop 公开报告称,Add to task 在任务被接受后可能冻结界面,但远端任务仍继续执行;再次提交会产生重复任务、额外用量,以及同一工作区并发写入风险。该报告尚未获官方确认。
训练规则
- 先检查任务是否已接受、是否仍在运行,或是否能从另一个可见入口确认进度。
- 未确认原任务停止前,不要再发第二个会修改同一工作区的任务;先降级为只读检查或等待。
- 上报时提供发生时间、Desktop 版本、提交方式、任务状态和错误摘要,不附私密提示或工作区内容。
来源
openai/codex #33900
Usage remaining 和真实限额可能不同步
usage
rate limits
entitlement
重点:看到“还有用量”但新消息立即限额,先分清 Usage UI、订阅权益和实际 rate-limit 判定,不要反复重试。
公开 issue 报告过两类相近现象:CLI/WSL 用户任意 prompt 都返回 usage limit 并给出下次可用时间;另有用户报告 Codex Usage 面板仍显示 remaining,但新 conversation 立即限额。官方定价页说明不同计划包含 Codex 且 Pro 有更高限额;官方状态页历史里也出现过 Codex rate limits 事件,但单个 issue 不能直接当作全局故障。
训练规则
- 先问订阅档位、模型、使用表面、是否多账号、多端后台任务、reset 时间和错误原文。
- 对比 Usage UI、CLI/TUI
/usage 或 /status、Web/Cloud 是否一致,并检查官方状态页是否有当前事件。
- 如果错误给出明确 try again 时间,先暂停长任务;改短任务、换低成本模型或等待窗口刷新,并保留截图、版本和发生时间。
来源
openai/codex #29228、openai/codex #29312、Codex Pricing、OpenAI Status History
Desktop 自动压缩失败会让长线程卡住
Desktop
context
long thread
重点:长线程卡住时,先保存摘要并开新线程接力,不要在旧线程里硬重试。
OpenAI 曾确认部分用户的 Codex compaction 出现服务侧延迟,且事件已恢复。另有公开报告显示,Desktop 长线程接近上下文上限后可能自动压缩未完成,继续发送消息时报 context length exceeded;大型工具/MCP 输出后漏算 token 的具体根因仍未获官方确认。
训练规则
- 长任务先写检查点,不要等到完全塞满上下文再整理。
- 压缩明显变慢时,先查状态页;有相符事件时保存检查点、暂停旧线程的盲目重试,恢复后再用最小续接验证。
- 大型工具结果先摘要、分页或落文件,只把必要结论带回线程,避免原始 JSON、HTML、日志和历史会话直接回灌。
- 遇到压缩失败,先开新线程带摘要继续,不要在旧线程里无限重试。
- 上报时带线程长度、触发时间、模型、Desktop 版本和完整错误文本。
来源
OpenAI Status: Increased latency for Codex compaction、openai/codex #29319、openai/codex #32888
MCP 启动慢可能拖住线程和工具列表
MCP
startup
performance
重点:工具列表或新线程启动慢,先怀疑最近新增或不可达的 MCP,不要先归因到账号或模型。
有公开报告指出,配置的 MCP server 如果还在启动或不可达,聚合工具列表时可能阻塞核心 Codex 工作流,让可选扩展变成启动关键依赖。
训练规则
- 新线程或工具列表启动很慢时,先隔离最近新增或不可达的 MCP server。
- 不要把 MCP 启动超时直接当成模型、账号或全局网络问题。
- 上报时带 MCP server 名称、启动方式、cached tools、超时日志和 Codex 版本。
来源
openai/codex #29321
子代理结果可能在父线程压缩后丢失
subagent
context
long task
重点:子代理长任务要落文件或写短摘要,父线程接近上限时先留检查点再等待。
父线程在子代理仍运行时发生 compaction,子代理后续完成结果可能没有送回父线程,表现为“子代理做完了但主线程没收到”。
训练规则
- 父线程接近上下文高水位时,先写检查点再等待子代理。
- 子代理长任务要尽量把结果写成文件或短摘要,避免只靠父线程回传。
- 如果结果丢失,查父线程是否刚 compact、子代理日志、pending completion 和独立输出。
来源
openai/codex #26728
大型工具输出先摘要,也要防外层聚合截断
SDK
MCP
JSONL
重点:JSONL 解析失败时,先把大型 MCP 输出降成摘要或文件路径,再排查 SDK。
TypeScript SDK / codex exec --experimental-json 被报告在大型多行 MCP tool result 上抛出 Failed to parse item,应用层收不到结构化事件。另一则尚未确认的报告指出,程序化外层 exec 聚合多项命令时,即使每项申请了更大预算,外层结果仍可能先被截断,导致无效重试和额外消耗。
训练规则
- 遇到 JSONL parse 错误,先查 MCP 结果是否包含多行、大块 XML/HTML 或非 ASCII 内容。
- 临时要求 MCP 返回摘要、截断内容,或把大结果保存成文件后只传路径。
- 并发汇总命令时,只返回必要输出并控制总量;确需大输出时设置外层预算,看到 truncation warning 后改为分页或定向读取,不盲目重跑。
- 上报时带 SDK/CLI 版本、MCP server、工具名、payload 形状和错误原文。
来源
openai/codex #23131、openai/codex #33402
自动化要验证产物,不只看 exit code
CLI
automation
artifact
重点:自动化完成后,既要看命令结果,也要确认预期文件确实存在且非空。
一则 macOS CLI 公开报告称,codex exec --output-last-message 在目标父目录不存在时可能先完成任务、随后写最终消息失败,但仍返回 exit code 0。该报告尚未获官方确认。
训练规则
- 写结果文件前先创建目标父目录。
- 命令结束后验证目标文件存在且非空;exit code 0 不能替代产物校验。
- 产物缺失时保留脱敏错误摘要,并仅在任务幂等时重跑;否则先从已有结构化输出恢复。
来源
openai/codex #33898
Codex 可能把自己的 JSONL 会话当成项目资料读进去
context hygiene
sessions
token
重点:搜索项目前先排除会话、日志和缓存目录,避免把 Codex 自己的历史读回上下文。
公开报告提到,任务读取仓库或工作目录时可能误读本地会话 JSONL,导致上下文快速膨胀、隐私边界变差和总结质量下降。
训练规则
- 搜索项目时排除会话、日志、缓存和导出目录。
- 如果 token 暴涨,先查是否读入
sessions、logs、备份或生成物。
- 需要分析历史时,只抽取必要片段,不整包喂回当前线程。
来源
openai/codex #27131
会话恢复列表可能漏掉仍可直接恢复的 session
session
resume
CLI
重点:会话“不见了”时,先按 session id 和本地文件只读查找,不要只相信列表页。
codex resume --all 可能因为扫描窗口限制漏掉可按 session id 直接恢复的会话,尤其是首个用户消息出现在 JSONL 较后位置时。
训练规则
- 用户说“会话不见了”时,不要只看
resume --all。
- 同时查 session id、
~/.codex/sessions、本地索引、archived 状态和直接 resume。
- 恢复优先只读检查,避免误删会话文件或状态库。
来源
openai/codex #21619
Git worktree 中项目 hooks 可能静默失效
hooks
worktree
repo safety
重点:hook 文件存在不等于 hook 生效;在 worktree 里必须先做最小触发测试。
公开报告显示,Codex 在 Git worktree 中运行时,项目级 .codex/hooks.json 可能不加载;同样配置在普通 repo 中可触发。
训练规则
- 不要把
.codex/hooks.json 存在当成 hook 已生效的证据。
- 在 worktree 中依赖 hook 做安全拦截前,先跑最小 hook probe。
- 不触发时,临时改用用户级
~/.codex/hooks.json 或普通 checkout。
来源
openai/codex #27133、Codex hooks 文档
PreToolUse 可能不覆盖内部编辑路径
hooks
apply_patch
repo safety
重点:关键写入保护不能只靠 PreToolUse,shell、patch、插件工具都要分别验证。
公开报告显示,部分内部编辑或 patch 路径可能没有触发预期的 PreToolUse hook,导致安全规则只覆盖了一部分工具调用。
训练规则
- 不要把 hook 配置存在当成所有写入路径都被拦截。
- 分别测试 shell、patch、插件工具、Computer Use 等真实路径。
- 关键仓库仍要靠 Git、备份、只读检查和人工确认兜底。
来源
openai/codex #26733、Codex hooks 文档