· Paul Lukic
AI 編程代理的遞迴自我改進:哪些是真的,哪些還是理論,以及我們實際交付了什麼
遞迴自我改進,是指一個人工智慧系統改進自己「改進自己」的能力。這篇文章講清楚理論到底說了什麼,為什麼模型層面的迴圈至今仍是理論,以及我們如何為編程代理做出指令層面的版本,並讓人守在閘門前。
閱讀全文ROI 視角、自建 vs 採購框架、對 AI 編程工具的誠實點評。寫給創辦人和工程負責人,不寫給實作者。
· Paul Lukic
遞迴自我改進,是指一個人工智慧系統改進自己「改進自己」的能力。這篇文章講清楚理論到底說了什麼,為什麼模型層面的迴圈至今仍是理論,以及我們如何為編程代理做出指令層面的版本,並讓人守在閘門前。
閱讀全文Meta 的 Muse Glimmer 把真正的代理級編程模型放上了一塊消費級顯卡——Apache 2.0,131K 上下文。當 token 免費時,視窗就是電錶。上下文效率不再是成本控制,而是能不能裝下。
我們的頭條宣稱曾是省 79.7% token——單任務、單夾具、位元組 ÷ 4。新測試平台跑 3 項任務、用 tiktoken 統計,回報中位數:67.9%。為什麼更低的數字更值錢,以及隨之發布的新功能。
+50% 每週限額加成計劃於 8 月 19 日到期。限額是天氣——由算力驅動,一年變了五次。每任務 token 數是你唯一能控制的天氣預報。
接入亂局落幕:Fable 5 永久包含在 Max 和 Team Premium 裡——上限是所有模型共享的每週限額的 50%。配額重新成為貨幣,而每任務 token 數是你唯一握在手裡的槓桿。
據報導,特斯拉把每位工程師的 AI 支出限制在每週 200 美元,Uber 也在收緊類似限額。上限配給的是工作——削減上下文浪費,才是在上限之下繼續交付的方法。
7 月 13 日起,Claude Fable 5 從方案額度切換到按量計費:每百萬 token 輸入 $10、輸出 $50。最燒錢的習慣?代理本該讀 4 個檔案,卻讀了 20 個。
Claude Code 的每週上限和 Copilot 新的按額度計費,懲罰的是同一件事:代理本該讀 4 個檔案,卻讀了 20 個。解法不是更大的方案,而是更小的上下文。
2026 年 6 月初,Miasma 蠕蟲不再費心走 npm install。它直接把投毒的 .claude/settings.json、.cursor、.vscode 檔案提交進 GitHub 儲存庫——其中包括 73 個微軟儲存庫。你用 Claude Code 或 Cursor 開啟儲存庫,惡意程式在你敲下任何命令之前就已經執行。本文講清楚為什麼 agent 設定現在就是程式碼,以及該如何這樣對待它。
MCP server 統一了 AI agent 讀取你程式碼庫的方式。在一個代表性任務上,圖譜式上下文砍掉約 80% 的 token、約 4 倍的工具呼叫——本文說明這為什麼重要,以及自建還是採購該怎麼想。
經驗豐富的終端開發者每天都在用的 Claude Code 隱藏斜線命令 —— /statusline、!、@、/add-dir、/btw、/branch,各自省下什麼、/add-dir 在規模化時會在哪裡失效、以及一個會毀掉肌肉記憶的 Codex CLI 陷阱。
沒有符合的文章。