
Codex 又改回去了5 小时限额回归「双限额时代」正式来临发生了什么如果你今天打开 Codex发现额度消耗的感觉和上周不太一样了——你的感觉是对的。8 月 25 日晚OpenAI Codex 团队确认5 小时滚动限额正式恢复与现有的每周限额并行生效。Plus 用户首当其冲Pro 的高档位5X 与 20X暂时获得豁免但官方的说法是「暂时」没有人能保证豁免期有多长。这意味着 Codex 的额度体系正式回到了「双层闸门」结构5 小时滚动窗口从你的使用开始计时窗口内的用量触顶即限流随时间滚动恢复不是整点重置每周上限无论每个 5 小时窗口是否用满一周的总用量另有一道上限。两把锁同时生效撞上任何一把都得停。周额度耗尽时5 小时窗口恢复了也没用反过来5 小时窗口撞墙时哪怕周额度还剩大半你也只能干等。回顾这两个月的剧情颇有些反复横跳的意味7 月初 GPT-5.6 系列发布需求在 48 小时内翻倍OpenAI 在发布周手忙脚乱地连续重置额度随后于 7 月 12 日宣布「暂时」移除 5 小时限额只留周限额——那一周被很多用户称为 Codex 最好用的日子。7 月 30 日5 小时限额第一次回归而昨晚的这次更新则是在反复拉扯之后把「5 小时窗口 每周上限」的双层结构正式确立为常态。这次更新带来的问题1. 你得同时盯两个时钟单层限额时代额度管理是一道简单的减法题还剩多少还能干多少。双层结构把它变成了一道统筹题——你得同时关心 5 小时窗口的滚动恢复时间点和周总额的消耗速度。CLI 里的/status会显示两个窗口各自的剩余量和重置时间但「看懂」和「规划好」是两回事。很多用户的真实体验是正专注改着代码突然弹出限额提示愣住跑/status才发现撞的是哪把锁。2. 它精准惩罚了最需要它的场景软件开发的用量天然不是均匀分布的。发布前的冲刺、线上事故的救火、一次大型重构的攻坚——这些恰恰是需要连续高强度使用 AI 的时刻也恰恰是 5 小时窗口最容易触顶的时刻。一次多文件重构、一轮深度调试、一场多智能体协作两三个小时内打空窗口并不夸张。周限额管的是「总量公平」5 小时窗口管的是「峰值节奏」而后者打断的往往是心流最值钱的部分。3. 共享池让额度去向更难追踪很多人没意识到Codex 的 CLI、IDE 扩展、云端任务和 ChatGPT Work、ChatGPT for Excel 等工作空间智能体共用的是同一个用量池。白天用 Codex 写代码下午用 ChatGPT 处理表格晚上又开了几个云端任务——感觉「没写几行代码额度就没了」的用户多半是没意识到池子在别处漏了水。双层限额叠加共享池让「我的额度去哪了」成为一道需要侦探精神的谜题。4. 套餐之间的体验断层Plus 恢复 5 小时限制Pro 高档位暂时豁免——这种差异化处理在商业上可以理解但在体验上制造了明显的落差同一个团队里不同套餐的成员在同一场协作中会有完全不同的「续航」。更微妙的是心理层面7 月尝过无窗口限制的甜头如今由奢入俭同样的额度感觉上就是变少了。好处别急着骂这套结构有它的道理1. 它保护的是大多数人的基本体验7 月发布周的教训是惨痛的需求 48 小时翻倍官方连续四次人工重置额度服务质量剧烈波动。没有短窗口限制时少数 7×24 小时挂机跑量的重度用户会挤占所有人的容量。5 小时窗口本质上是一个「削峰器」它把极少数人的突发消耗摊平换来的是大多数人打开 Codex 时它还在正常工作。2. 双层结构比单层结构更公平纯周限额的问题在于一旦提前打空剩下的几天就是漫长的旱季没有任何缓冲。而 5 小时窗口是滚动恢复的——撞墙了最多等几个小时就能继续它把「惩罚」从以周为单位缩短到以小时为单位。短窗口防突发挤兑周窗口防持续透支两者各司其职。3. 撞墙不再意味着任务烂尾一个值得知道的细节如果限额是在一个任务执行中途耗尽的Codex 通常会把当前这一轮做完受合理使用约束之后才阻止新任务。改到一半的代码不会被扔下。这降低了双层限额最吓人的那种场景——「重构到一半断了仓库处于不一致状态」。4. 约束逼出了更好的使用习惯额度充裕时没人有动力优化自己的用法上下文乱塞、任务乱抛、模型乱选。限额收紧后精简上下文、拆分任务、选对模型这些「最佳实践」从建议变成了必修课——而它们恰好也是让 AI 输出质量更高的做法。从这个角度说限额是苦口的良药。5. 省下的算力在变成实际的效率改进OpenAI 在 7 月底同步做了一件事降低轻量模型Terra、Luna的额度消耗费率。限额收紧与效率提升是同一枚硬币的两面——容量规划可控了省下来的资源才能转化为「同样的额度能跑更多任务」。坏处这些问题不会因解释而消失1. 「额度焦虑」是一种真实的生产力税当你的注意力的一部分被分配给「还剩多少额度、这个任务值不值得跑、要不要再等等窗口」它就不再分配给代码本身。心理学上这叫稀缺心态——稀缺本身就会消耗认知带宽。对靠心流吃饭的开发者来说这是看不见但真实存在的成本。2. 额度消耗依然是个黑箱自今年 4 月改为按 token 计量后一条消息消耗多少额度取决于模型、任务复杂度、上下文长度、推理深度、速度设置和工具调用次数——官方给的限额只是一个区间而不是确定数字。这让「规划用量」在某种程度上变成了玄学你永远无法精确预知下一个任务会烧掉多少。3. 它把最忠诚的用户推向别处受影响最深的恰恰是重度用户——那些把 Codex 深度集成进日常工作流、最有可能向他人安利的人。当他们反复撞墙自然会去评估替代品竞品工具、API 按量付费、本地模型。限额守住的是容量流失的可能是口碑。4. 「暂时豁免」制造了新的不确定性Pro 高档位的豁免没有任何时间承诺。对于把生产力押在 Codex 上的团队和独立开发者「政策随时可能再变」本身就是一种成本——你没法围绕一个移动的目标做长期规划。怎么用最省额度一份精打细算指南1. 模型分级使用别让旗舰干杂活。轻量模型Luna、Terra单窗口能跑的消息数远多于旗舰模型Sol且 7 月底起轻量模型的消耗费率还降了。命名、改错、写测试、格式化这类杂活交给轻量模型只有真正的硬骨头——复杂架构调整、疑难 bug 定位——再请旗舰出马。2. 管好上下文这是最大的省额度杠杆。用 AGENTS.md 把项目约定、目录结构、代码规范一次性写清楚避免模型每次任务都重新翻读整个仓库。提问时直接指定相关文件而不是让它自己去大海捞针。上下文越干净同样的窗口能跑的任务越多——官方自己的 FAQ 都承认加载整个大仓库的任务消耗可以是简短提问的十几倍。3. 勤开新会话别让历史拖垮你。长会话的上下文是累积的会话越长每条后续消息越贵。一个阶段的任务完成就开新会话或者用压缩功能整理上下文再继续。4. 谨慎使用 Fast mode。快速模式大约提速 1.5 倍但按标准模式约 2.5 倍计量。只有当响应时间真的影响产出时才值得开全天候开着它属于奢侈消费。5. 提示词写清楚减少返工。最烧额度的不是大任务是返工。让模型先出计划、确认无误再动手比直接让它上手改、改错了再推翻重来省得多。6. 普通问答别占 Codex 的额度。普通的 ChatGPT 聊天有独立的额度池。「这个 API 怎么用」这类纯问答在普通聊天里问不碰 Codex 的池子。7. 学会排班。开工前先跑/status看一眼两个窗口的余量。把大任务安排在窗口刚恢复之后撞了 5 小时窗口就切换去干不耗额度的事——手动写代码、做 code review、写文档等窗口滚动恢复再战。8. 云端任务别盲目并行。云端任务和本地消息共享同一个窗口并行开一堆云任务会快速蚕食本地会话的余量。9. 真到不够用按这个顺序补救等滚动恢复免费→ 用攒下的重置免费且能同时重置两个窗口→ 买 Credits 续命适合偶尔超量→ 升级套餐适合每周稳定撞墙→ 切 API Key 按量付费适合用量极不规律或接入自动化流程。怎么用最费额度一份反面教材如果你想知道额度是怎么光速蒸发的以下是标准操作请勿模仿除非你想测试限额系统的响应速度1. 全程旗舰模型。用 Sol 改错别字、写注释、跑格式化每一发都是重炮打蚊子。2. 每次提问都让它读整个仓库。不指定文件不写 AGENTS.md让模型在几十万行代码的 monorepo 里自由探索。3. 一个会话用到天荒地老。从不压缩、从不开新会话让上下文滚成一座大山之后每条消息都背着这座山计费。4. Fast mode 全天候开启。2.5 倍计量换 1.5 倍速度用来跑那些你根本不着急看结果的任务。5. 三线作战。本地 CLI、IDE 扩展、云端并行任务同时开火——它们共享同一个池子三倍消耗一份额度。6. 提示词随缘。「帮我优化一下这个项目」——然后看着模型在无数次试错和返工中燃烧你的窗口。7. 挂满工具调用。一大堆 MCP 服务器常开每个任务触发几十轮工具调用与子智能体额度如流水。8. 拿 Codex 当百科全书闲聊。在共享池里问本来可以在普通聊天里免费问的问题。9. 撞墙就买 Credits 硬顶。不等滚动恢复不看周余量用真金白银为糟糕的规划买单。10. 大任务专挑窗口尾声开工。在 5 小时窗口即将重置前启动大型重构确保任务中段撞墙、后续被迫中断等待——时机艺术的巅峰。结语从 7 月的「暂时移除」到 8 月的「正式回归」Codex 的限额政策走了一个完整的轮回。这背后是一个朴素的现实前沿模型的算力依然是稀缺资源而稀缺资源必然需要配给机制。5 小时窗口与周限额的双层结构是 OpenAI 在「用户体验」和「容量可持续」之间找到的最新平衡点——它不会是最后一个。对普通用户来说抱怨解决不了问题适应可以。这套规则的真正启示是AI 编程工具已经从「无限量的新奇玩具」变成了「需要预算管理的生产资源」。学会像管理云账单一样管理你的额度——选对模型、管好上下文、规划好节奏——你会发现在双层限额的约束下效率反而可能比以前更高。毕竟约束从来不是创造力的敌人挥霍才是。