Claude Code 9 月 14 日额度变了:"+25%" 等于少 17%
9 月 14 日,Anthropic 对 Claude Code 的周额度动刀。官方说法是”永久提升 25%“,对着当前额度一算,是 17% 的缩减。
数字怎么来的
5 月 13 日,Anthropic 给 Claude Code 加了一轮临时额度,在原始基准上加 50%。促销延期四次,延到 9 月 13 日截止。
9 月 14 日起,临时额度到期,永久额度定为基准的 125%。
算一笔账。假设基准为 100:
| 时段 | 额度 |
|---|---|
| 5 月 13 日前 | 100 |
| 5 月 13 日 – 9 月 13 日 | 150(临时 +50%) |
| 9 月 14 日起 | 125(永久 +25%) |
100 → 125,涨。150 → 125,降。降幅 16.7%,少了六分之一。
Anthropic 选了对自己有利的参照系:拿 5 月前的基准做对比,+25% 成立。但在 150% 额度下工作了四个月的人,看到的是到手资源缩水。
谁受影响
Pro、Max(5x / 20x)、Team、按席位计费的 Enterprise,四类订阅的周额度同日调整。
要注意的是:5 小时窗口内的额度分配不在这次调整范围内。这次动的是周累计上限。
“5 小时窗口”和”周额度”是两件事
这组概念容易混淆,有必要拆开。
5 小时窗口是滚动重置周期。窗口开启时分配一份使用量,耗尽后要等窗口期满,到期后无论消耗多少,额度重置。它管的是短期速率——防止你在短时间内把资源烧光。
周额度是七天内的累计上限,按账户绑定的固定日期和时间重置。它管的是总量——一周能用多少。
两者独立运作。5 小时窗口有余量,但周额度见底,会被限流。反过来,周额度充裕,但在一个窗口内用得太猛,窗口额度耗尽,照样等。
另一件事:Claude Code 与 claude.ai 共用同一个额度池。在网页端消耗的量会挤占 Claude Code 的空间。重度使用 Claude Code 的人,值得把 claude.ai 的用量分开管理——或者把日常对话挪到别的工具上。
额度收紧后怎么用
少了 17%,同样的工作节奏下,周内触限的时间点会前移。几个做法可以拉长续航。
一、给 Agent 划边界
放任 Agent 是额度杀手。每一次工具调用——读文件、跑命令、搜索代码——产生的 token 留在上下文里,后续每一轮对话都要重读一遍。上下文膨胀的速度是复利式的。
做法:给 Agent 明确的目标和范围约束,一个任务结束后用 /clear 清掉上下文,避免旧 token 成为死重。分拆大任务为多个短会话,比一个长会话的总 token 消耗低得多。
二、压低 Effort
Effort 控制模型投入的思考量。Low 跑得快、消耗小;medium 适合日常开发;high 和 max 留给深度推理。
数据上看,medium 和 low 在多数编辑任务上的输出质量差距可忽略,token 消耗的差距是倍数级的。把 Effort 从 max 降到 medium,一周下来省出的额度相当可观。
三、Loop 任务分段
/loop 跑重复任务时,每轮迭代的上下文会叠加。十几轮之后,上下文窗口塞满,token 消耗飙升。
做法:长任务拆成多段,穿插 /compact 压缩历史,或用 /clear 开新段。每一段的起始上下文干净,token 消耗回到起点。
四、选对模型
Sonnet 处理日常编码任务的能力够用,token 成本低于 Opus。把 Opus 留给架构设计、复杂 debug 这类需要深度推理的场景。
在 Claude Code 里可以用 /model 切换。写代码用 Sonnet,想问题用 Opus,按场景分配。
五、盯住消耗
/usage 查看本周和当前窗口的用量,/cost 看单次会话花费。在启动大任务前看一眼余量,避免做到中途被限流。
知道自己的消耗节奏,比知道上限数字更有用。
Anthropic 的解释是:促销从设计上是临时的,125% 是长期可持续的水平。商业逻辑说得通,但对用户来说,体感是到手的东西被收走了一部分。150% 用了四个月,心理锚点在那里,125% 不管怎么包装,感受是降级。
3–7 天窗口期内可以做的事是把工作习惯调到 125% 额度下能跑通的状态——试试上面那几个省额度的做法,算算自己一周的消耗节奏,把缓冲空间留出来。到了 9 月 14 日那天被限流再去调整,代价高得多。