你的 Claude Code 一周,马上要短三分之一
+50% 每周限额加成计划于 8 月 19 日到期。限额是天气——由算力驱动,一年变了五次。每任务 token 数是你唯一能控制的天气预报。
这个月,每个 Claude Code 团队的日历上都圈着一个日期——无论他们自己知不知道:8 月 19 日。那天,自 5 月 13 日起作为促销运行、已经延期三次的 +50% 每周用量加成,按计划到期(截至发稿)。一旦到期,每周的墙会比你团队整个夏天校准的那堵提前大约三分之一到来。5 月 6 日的 5 小时限额翻倍是永久的——你的会话还是那么长。缩水的是那一周。
也许 Anthropic 会第四次延期。也许不会。这种不确定性恰恰是本文的重点。
限额天气的一年
看看记录。2025 年 8 月 28 日:在滚动 5 小时窗口之上引入每周上限,针对 724 自动化和账号转售。2026 年 3 月 13–28 日:为期两周的非高峰翻倍促销,然后消失。2026 年 5 月 6 日:5 小时限额永久翻倍、取消高峰限流——搭上 Colossus 1 协议带来的 300 多兆瓦新算力。2026 年 5 月 13 日:每周限额”临时”+50%——7 月延一次,再延一次,第三次延到 8 月 19 日。而自 7 月 20 日起,Fable 5 就住在同一个每周池子里,上限为其中 50%,且单任务烧限额比其他模型更快。
十二个月五次变动,背后的规律不是秘密:算力。新算力上线,限额放松;需求跑赢供给,限额收紧。你的每周额度是数据中心协议和需求曲线的下游——那些你永远看不到的东西——而且它会继续动:好季度向上,紧季度向下。
换句话说,限额是天气。你控制不了天空。你控制的是每公里烧多少油。
官方建议本身就说明问题
翻任何一篇”如何撑过 Claude Code 限额”的指南——包括呼应 Anthropic 自家建议的——清单永远一样:任务之间跑 /clear,任务中途 /compact,CLAUDE.md 保持精简,默认用 Sonnet,还有最大的一条——“给 Claude 指文件路径,而不是把整个文件贴进去。”
清单上每一条都是上下文卫生。整套应对限额天气的官方剧本就是少喂模型。这就引出一个显而易见的问题:如果杠杆最大的一招是少加载上下文,它为什么是一份手工清单,而不是基础设施?
清单追着打的浪费是可测量的。你的代理靠关键词搜索或向量相似度找代码——为召回率优化的工具,把一切沾边的都返回。在代码里,重要的是依赖边:OrderService.place_order() 调用一个 repository,后者用到一个缓存策略。四个文件构成链。关键词消防水管返回二十个。(完整入门在这。)
Coograph 在仓库里附带一个已提交的基准测试——单个固定任务(“给 OrderService.place_order() 加缓存”)跑在单个已提交的 fixture(bench/fixtures/sample-app/)上,都在版本库里,任何人都能复跑。在这个任务上:
- 朴素 grep + 读取所有匹配文件: 20 个文件,约 4,764 输入 token,21 次工具调用。
- 图最小上下文查询: 4 个文件,约 969 输入 token,5 次工具调用。
约 80% 的输入 token 是暴露在天气里的燃烧——什么都没买到的消耗,在一个有代表性的任务上。
回落的算术
把两个数字放在一起。回落把每周罐子从基准的 150% 缩到 100%——墙提前三分之一到来。图把单任务燃烧缩小约 4.9 倍(4,764 ÷ 969——示意性,仅计输入 token)。
现在数一数每周任务量,基准 = 回落后限额上的朴素代理:
- 朴素代理,加成限额(今天): 约 1.5 倍基准任务量。
- 朴素代理,8 月 19 日之后: 1 倍——你团队失去的那三分之一。
- 图上下文,8 月 19 日之后: 约 4.9 倍——比朴素方案带着加成还多出三倍以上。
把每任务上下文砍掉约 5 倍,8 月 19 日就隐形了。不是缓和——是隐形,还有余量。修好燃烧率的团队不会在周三刷用量仪表盘,不关心加成会不会第四次延期,也不用每次天气变化就重谈一遍工作流。示意性算术仅计输入;真实数字由你的仓库和任务构成决定。但无论你打几折,方向不变。
而且因为每周池子是所有模型共享的——Fable 5 封顶在其中一半、单任务烧得更快——同样的削减能拉长你的 Fable 份额、Sonnet 批量活,以及下个季度池子里装的随便什么。这是我们六月以来写的第五种电表形态:配额、美元、上限、包含,现在是回落。电表一直在变。杠杆从没变。
把清单变成基础设施
Coograph 是开源、MIT 许可的解析器和图引擎。它用 tree-sitter 解析你的代码库(Python、TypeScript、JavaScript、Go、Rust、Java、C#、Ruby 等,另有正则兜底),产出一个本地 SQLite 文件——.code-graph/graph.db——永远不离开你的机器。你的代理通过 MCP 工具(get_minimal_context、query_graph)查询它而不是 grep,一次拿到依赖链——那 4 个文件,而不是 20 个。git 钩子在每次提交时只重新解析变更的文件。
安装只要几分钟:把 Coograph 克隆为同级目录,在 Claude Code(或 Copilot、Cursor、Windsurf、Codex CLI、OpenCode、Aider、Cline)里运行 /coograph-init,构建图。它就是”指路径、别贴整个文件”这条建议的结构化版本:代理不需要自律,因为图直接把正确的路径递给它。
8 月 19 日到底会变什么?
截至发稿,+50% 每周用量加成(5 月 13 日起的促销,已延期三次)计划到期。每周限额回到基准——每周的墙提前大约三分之一到来。5 月 6 日永久翻倍的 5 小时会话限额不受影响。Anthropic 可能再延期;三次延期之前,时间表也是这么写的。
Anthropic 不会又延期吗?
有可能——已经发生三次了。但记录显示限额十二个月里动了五次,两个方向都有,由算力驱动。把团队吞吐量押在下一次延期上,等于押在天气上。砍每任务 token 数在任何天气预报下都成立。
图到底能抵消多少?
在已提交基准上,依赖图上下文把输入 token 减少约 80%(4,764 → 969,约 4.9 倍)、工具调用减少约 4 倍(21 → 5)。套到回落上,示意性且仅计输入:加成限额上的朴素代理完成约 1.5 倍基准任务;回落限额上的图上下文代理完成约 4.9 倍——是带加成朴素方案的 3 倍以上。真实数字由你的仓库和任务构成决定。
/clear 和 /compact 不是已经解决了吗?
有帮助——要用。但它们修剪的是会话状态,不是检索浪费:在有东西可压缩之前,代理已经读了 20 个文件才改 4 个。图砍的是一开始加载进来的东西。两者是叠加的。
开源还是付费?
整个仓库 MIT 许可、永久免费——没有付费墙功能。Coograph Pro 是定制服务(集成、内部语言的自定义解析器、针对你真实工作负载的基准测试),不是锁起来的产品档位。
8 月 19 日要么拿走你一周的三分之一,要么不拿——而下个季度的天气还会把墙挪来挪去。不再关心这些的团队,是修好了燃烧率的团队。用入门指南生成你的第一张图,在代码图页面看看里面有什么,或者如果想在天气预报变化之前把额度度量起来,聊聊 Coograph Pro。基准已提交。19 号之前,自己复跑一遍。
削减你的 AI 编程账单 67–78%。Coograph 采用 MIT 许可、永久免费。Pro 提供定制服务。