· Paul Lukic · 1 分鐘閱讀 · ai-costsclaude-codecontext-windowcode-graph

你的 Claude Code 一週,馬上要短三分之一

+50% 每週限額加成計劃於 8 月 19 日到期。限額是天氣——由算力驅動,一年變了五次。每任務 token 數是你唯一能控制的天氣預報。

本文目錄

這個月,每個 Claude Code 團隊的日曆上都圈著一個日期——無論他們自己知不知道:8 月 19 日。那天,自 5 月 13 日起作為促銷運行、已經延期三次的 +50% 每週用量加成,按計劃到期(截至發稿)。一旦到期,每週的牆會比你團隊整個夏天校準的那堵提前大約三分之一到來。5 月 6 日的 5 小時限額翻倍是永久的——你的會話還是那麼長。縮水的是那一週

也許 Anthropic 會第四次延期。也許不會。這種不確定性恰恰是本文的重點。

2025 年 8 月至 2026 年 8 月 Claude 用量限額變化時間線:引入每週上限、非高峰翻倍促銷、5 小時限額永久翻倍、+50% 每週加成三次延期、8 月 19 日計劃回落

限額天氣的一年

看看記錄。2025 年 8 月 28 日:在滾動 5 小時視窗之上引入每週上限,針對 724 自動化和帳號轉售。2026 年 3 月 13–28 日:為期兩週的非高峰翻倍促銷,然後消失。2026 年 5 月 6 日:5 小時限額永久翻倍、取消高峰限流——搭上 Colossus 1 協議帶來的 300 多兆瓦新算力2026 年 5 月 13 日:每週限額「臨時」+50%——7 月延一次,再延一次,第三次延到 8 月 19 日。而自 7 月 20 日起,Fable 5 就住在同一個每週池子裡,上限為其中 50%,且單任務燒限額比其他模型更快。

十二個月五次變動,背後的規律不是秘密:算力。新算力上線,限額放鬆;需求跑贏供給,限額收緊。你的每週額度是資料中心協議和需求曲線的下游——那些你永遠看不到的東西——而且它會繼續動:好季度向上,緊季度向下。

換句話說,限額是天氣。你控制不了天空。你控制的是每公里燒多少油。

官方建議本身就說明問題

翻任何一篇「如何撐過 Claude Code 限額」的指南——包括呼應 Anthropic 自家建議的——清單永遠一樣:任務之間跑 /clear,任務中途 /compactCLAUDE.md 保持精簡,預設用 Sonnet,還有最大的一條——「給 Claude 指檔案路徑,而不是把整個檔案貼進去。」

清單上每一條都是上下文衛生。整套應對限額天氣的官方劇本就是少餵模型。這就引出一個顯而易見的問題:如果槓桿最大的一招是少載入上下文,它為什麼是一份手工清單,而不是基礎設施?

清單追著打的浪費是可測量的。你的代理靠關鍵字搜尋或向量相似度找程式碼——為召回率最佳化的工具,把一切沾邊的都返回。在程式碼裡,重要的是依賴邊:OrderService.place_order() 呼叫一個 repository,後者用到一個快取策略。四個檔案構成鏈。關鍵字消防水管返回二十個。(完整入門在這。)

Coograph 在倉庫裡附帶一個已提交的基準測試——單個固定任務(「給 OrderService.place_order() 加快取」)跑在單個已提交的 fixturebench/fixtures/sample-app/)上,都在版本庫裡,任何人都能重跑。在這個任務上:

  • 樸素 grep + 讀取所有匹配檔案: 20 個檔案,約 4,764 輸入 token,21 次工具呼叫。
  • 圖最小上下文查詢: 4 個檔案,約 969 輸入 token,5 次工具呼叫。

約 80% 的輸入 token 是暴露在天氣裡的燃燒——什麼都沒買到的消耗,在一個有代表性的任務上。

回落的算術

把兩個數字放在一起。回落把每週罐子從基準的 150% 縮到 100%——牆提前三分之一到來。圖把單任務燃燒縮小約 4.9 倍(4,764 ÷ 969——示意性,僅計輸入 token)。

兩個變化的對比:8 月 19 日的回落把每週罐子從基準的 150% 縮到 100%,而依賴圖上下文把單任務燃燒縮小約 4.9 倍

現在數一數每週任務量,基準 = 回落後限額上的樸素代理:

  • 樸素代理,加成限額(今天): 約 1.5 倍基準任務量。
  • 樸素代理,8 月 19 日之後: 1 倍——你團隊失去的那三分之一。
  • 圖上下文,8 月 19 日之後: 約 4.9 倍——比樸素方案帶著加成還多出三倍以上。
長條圖:每週任務量,回落後樸素代理 1 倍,加成限額上的樸素代理 1.5 倍,回落後依賴圖上下文約 4.9 倍

把每任務上下文砍掉約 5 倍,8 月 19 日就隱形了。不是緩和——是隱形,還有餘量。修好燃燒率的團隊不會在週三刷用量儀表板,不關心加成會不會第四次延期,也不用每次天氣變化就重談一遍工作流。示意性算術僅計輸入;真實數字由你的倉庫和任務構成決定。但無論你打幾折,方向不變。

而且因為每週池子是所有模型共享的——Fable 5 封頂在其中一半、單任務燒得更快——同樣的削減能拉長你的 Fable 份額、Sonnet 批量活,以及下個季度池子裡裝的隨便什麼。這是我們六月以來寫的第五種電錶形態:配額美元上限包含,現在是回落。電錶一直在變。槓桿從沒變。

把清單變成基礎設施

Coograph 是開源、MIT 授權的解析器和圖引擎。它用 tree-sitter 解析你的程式碼庫(Python、TypeScript、JavaScript、Go、Rust、Java、C#、Ruby 等,另有正則兜底),產出一個本地 SQLite 檔案——.code-graph/graph.db——永遠不離開你的機器。你的代理透過 MCP 工具(get_minimal_contextquery_graph)查詢它而不是 grep,一次拿到依賴鏈——那 4 個檔案,而不是 20 個。git 鉤子在每次提交時只重新解析變更的檔案。

安裝只要幾分鐘:把 Coograph 克隆為同級目錄,在 Claude Code(或 Copilot、Cursor、Windsurf、Codex CLI、OpenCode、Aider、Cline)裡執行 /coograph-init,建構圖。它就是「指路徑、別貼整個檔案」這條建議的結構化版本:代理不需要自律,因為圖直接把正確的路徑遞給它。

8 月 19 日到底會變什麼?

截至發稿,+50% 每週用量加成(5 月 13 日起的促銷,已延期三次)計劃到期。每週限額回到基準——每週的牆提前大約三分之一到來。5 月 6 日永久翻倍的 5 小時會話限額不受影響。Anthropic 可能再延期;三次延期之前,時間表也是這麼寫的。

Anthropic 不會又延期嗎?

有可能——已經發生三次了。但記錄顯示限額十二個月裡動了五次,兩個方向都有,由算力驅動。把團隊吞吐量押在下一次延期上,等於押在天氣上。砍每任務 token 數在任何天氣預報下都成立。

圖到底能抵消多少?

在已提交基準上,依賴圖上下文把輸入 token 減少約 80%(4,764 → 969,約 4.9 倍)、工具呼叫減少約 4 倍(21 → 5)。套到回落上,示意性且僅計輸入:加成限額上的樸素代理完成約 1.5 倍基準任務;回落限額上的圖上下文代理完成約 4.9 倍——是帶加成樸素方案的 3 倍以上。真實數字由你的倉庫和任務構成決定。

/clear 和 /compact 不是已經解決了嗎?

有幫助——要用。但它們修剪的是會話狀態,不是檢索浪費:在有東西可壓縮之前,代理已經讀了 20 個檔案才改 4 個。圖砍的是一開始載入進來的東西。兩者是疊加的。

開源還是付費?

整個倉庫 MIT 授權、永久免費——沒有付費牆功能。Coograph Pro 是客製服務(整合、內部語言的自訂解析器、針對你真實工作負載的基準測試),不是鎖起來的產品檔位。

8 月 19 日要麼拿走你一週的三分之一,要麼不拿——而下個季度的天氣還會把牆挪來挪去。不再關心這些的團隊,是修好了燃燒率的團隊。用入門指南生成你的第一張圖,在程式碼圖頁面看看裡面有什麼,或者如果想在天氣預報變化之前把額度度量起來,聊聊 Coograph Pro。基準已提交。19 號之前,自己重跑一遍。

削減你的 AI 編程帳單 67–78%。Coograph 採用 MIT 授權、永久免費。Pro 提供客製服務。