新闻 / 模型观察 · 编程工具经济学
Codex 恢复 5 小时限制,Claude Code 额度缩减 25%:当订阅制额度焦虑遇上按 Token 计费的中国模型 API
8 月 31 日更新:OpenAI 于 8 月 30 日再次重置额度,并公布了背后排查出的一批 Bug(详情见下文)。六天内的两则公告,为 AI 编程工具充满变数的 8 月画上了注脚。OpenAI 于 8 月 25 日悄然恢复了 Codex 的 5 小时用量限制——此前整个 8 月他们还在像发派对小礼品一样频繁重置额度——而Anthropic 的 Claude Code 将自 9 月 14 日起削减 25% 的用量限制。如果你的工作流高度依赖这些额度,以下是 8 月的时间线、官方具体变更,以及国产大模型生态所提供的按量计费 API 替代方案。
Codex 于 8 月 25 日恢复了面向 Plus 用户的 5 小时用量上限(工程负责人 Tibo Sottiaux 于 8 月 24 日在 X 上宣布,并承认“我之前提过这件事,但后来推迟了”)。8 月共经历了三次全量额度重置(8 月 8 日、13 日、21 日),据报道还测试了付费重置功能。 8 月 30 日更新:额度再次被重置——这是 8 月的第 4 次——OpenAI 透露其修复了 8 个严重消耗额度的 Bug(卡住的 /goal 任务曾一度吞掉每周额度的 15-70%);同样的额度现在能多用 10-50%,应用内用量明细功能也正在开发中。 Claude Code 限额将于 9 月 14 日起下调 25%(ClaudeDevs 官方 8 月 29 日发帖)。 国产大模型 API 均按公开费率按 Token 计费——没有 5 小时窗口限制,没有每周用量上限——并官方支持 Claude Code、Codex 风格的 CLI 以及 20 多款编程工具。
基于官方公告的 8 月时间线
- 8 月 8 日 —— 第 1 次重置。Sottiaux 为所有 Codex 和 ChatGPT Work 付费用户重置了用量,以庆祝 GPT-5.6 Sol 的上线,同时还颇有深意地澄清自己不会跳槽去 Anthropic。
- 8 月 13 日 —— 第 2 次重置。活跃用户突破 1500 万里程碑;另一轮重置“将在接下来一小时内生效”。
- 8 月 21 日 —— 第 3 次重置。活跃用户达 2000 万;每位 Codex/Work 用户均获赠一次可随时取用的储备重置额度(储备重置额度在发放后 30 天内有效)。
- 8 月 24-25 日 —— 5 小时上限回归。在仅按周限额运行数周后,Plus 账户重新引入了 5 小时滑动窗口限制。官方给出的理由是:平滑算力负载有助于维持相对充裕的周配额,并且轻度用户此前经常误将整周额度一次性消耗殆尽。此外,Business Insider 另外报道称,一项未公开的 $8 付费重置按钮正在部分 Plus 用户中进行测试。
- 8 月 30 日——第 4 次重置,原因正式揭晓。在集中修复了 8 个用量统计相关的 Bug 后,Sottiaux 再次重置了所有付费用户的额度:上下文压缩导致旧图片残留在 Context 中(重度图片用户用量增加约 10%)、已完成的 /goal 任务仍持续运行、报错的工具无限重试——单个失控任务就消耗了每周额度的 15-70%;一个 Memory 后台任务甚至运行了近 15,000 次。最终效果:同样的额度现在能多用 10-50%。架构级防护与自动告警机制已就位,应用内用量明细功能正在开发中——Tibo 还透露称“两三个月后,现在的 Codex 看起来会显得很原始”。
- 8 月 29 日 —— Claude Code 额度削减。Anthropic 的 ClaudeDevs 账号宣布用量上限自 9 月 14 日起下调 25%;社区根据细则推算,每周倍率从 +50% 降至 +25%,实际有效削减幅度约为 17%。
背景:这已形成一种规律,而非单周偶发事件。6 月下旬,官方曾设立“作战室”排查 Codex 用量消耗过快的问题——修复说明中承认后台功能(自动审查、子 Agent)有时会重复执行或过度重试,且仪表盘显示了未实际扣费的活动。今年 3 月,用量限制曾在一个月内被重置了六次。目前已有社区追踪网站(codex-resets.com)专门归档每一次官方重置公告。
订阅制配额 vs 按量计费的中国模型 API
| 对比维度 | Codex / Claude Code 订阅方案 | 中国模型 API |
|---|---|---|
| 计费模式 | 按月订阅;配额计算规则不透明(积分、倍率、隐式时间窗口) | 按 Token 付费,公开费率 —— 例如 GLM-5.3 每 1M 为 $1.40/$4.40;DeepSeek V4 提供约 50% 的闲时折扣 |
| 用量时间窗口 | 5 小时滑动窗口(已恢复)、每周上限,且政策每月都在变动 | 无限制 —— 哪怕凌晨 3 点同时跑 100 个任务也没问题;仅受并发数限制 |
| 额度用尽时 | 等待重置、购买积分(据报道 $8 一次的重置正在测试中),或使用 30 天内过期的储备重置 | 充值余额即可;实际用量上限取决于你的预算,而非时间窗口 |
| 工具兼容性 | 原生生态系统(VS Code、JetBrains、CLI) | GLM Coding Plan 官方支持 Claude Code、Cline、Roo Code 及 20 多款工具;Codex CLI 已开源并支持自定义服务商接入 |
费率已对照截至 2026 年 8 月 30 日的官方文档核实;配额机制依据下方链接的官方 X 公告及媒体报道。
对编程工作负载的务实建议
这一切并不代表 Codex 或 Claude Code 不好用——它们本身非常出色,且官方赠送重置也确实相当慷慨。但对于支撑生产级工作负载的开发者来说,背后的机制至关重要:当你的成本取决于他人的配额政策时,你的产能规划就只能被写进别人的更新日志里。中国模型 API 系列——GLM-5.3 及更实惠的 GLM-5.3-Flash、Kimi K2.6/K3、DeepSeek V4 Flash/Pro、Qwen3.8——以明确可查的价目表按 Token 为同样的工作计费,且不存在突然重置你的时间窗口。对于突发流量、CI 任务,或是那些不断被订阅配额挤压的工作负载而言,这就是结构性优势所在:你用完全自主可控的计费器,换掉了订阅制的额度焦虑。
一手信息来源
常见问题解答 (2026)
5 小时限制是什么时候恢复的?
8 月 25 日,覆盖 Codex 及 ChatGPT Work 的 Plus 账户。8 月 24 日在 X 上宣布——并坦言此前曾推迟该计划。官方原因:平滑算力负载、保护轻度用户。
8 月份共重置了几次?
共 4 次:8 月 8 日(GPT-5.6 Sol)、8 月 13 日(1500 万用户)、8 月 21 日(2000 万用户 + 结转额度重置)、8 月 30 日(公布 8 项 Bug 修复,等效可用额度提升 +10-50%)。6 月的用量 Bug 曾引发紧急攻关(War Room)、修复与补偿;而 3 月曾在单月内重置了 6 次。
Claude Code:额度削减了多少?
官方公布为 25%,自 9 月 14 日起生效。社区根据倍率计算(由基础额度的 +50% 降至 +25%),实际有效降幅接近 17%。来源:8 月 29 日 ClaudeDevs 官方 X 帖子。
中国模型 API 有使用时间窗口限制吗?
没有。仅按 Token 公开费率计费——没有 5 小时窗口,没有每周上限。DeepSeek 还增加了分时段闲时定价;GLM Coding Plan 则提供月度配额包,并官方支持 20 多款编程工具。
Codex CLI / Claude Code 可以使用中国模型吗?
可以 —— Claude Code 可通过 GLM Coding Plan(官方支持)接入;开源的 Codex CLI 可通过自定义兼容 OpenAI 的服务商接入:GLM-5.3、Kimi K2.6/K3、DeepSeek V4 均可通过兼容端点调用。
这会影响中国模型 API 的价格吗?
不会直接影响 —— 这些属于订阅端配额调整。但从过往趋势来看,海外工具收紧配额加上国内模型持续降价,往往会推动价格敏感型的编程工作负载转向按量计费的中国模型 API。