· Paul Lukic
AI 编程代理的递归自我改进:哪些是真的,哪些还是理论,以及我们实际交付了什么
递归自我改进,是指一个人工智能系统改进自己“改进自己”的能力。这篇文章讲清楚理论到底说了什么,为什么模型层面的循环至今仍是理论,以及我们如何为编程代理做出了指令层面的版本,并让人守在闸门前。
阅读全文ROI 视角、自建 vs 采购框架、对 AI 编程工具的诚实点评。写给创始人和工程负责人,不写给实现者。
· Paul Lukic
递归自我改进,是指一个人工智能系统改进自己“改进自己”的能力。这篇文章讲清楚理论到底说了什么,为什么模型层面的循环至今仍是理论,以及我们如何为编程代理做出了指令层面的版本,并让人守在闸门前。
阅读全文Meta 的 Muse Glimmer 把真正的代理级编程模型放上了一块消费级显卡——Apache 2.0,131K 上下文。当 token 免费时,窗口就是电表。上下文效率不再是成本控制,而是能不能装下。
我们的头条宣称曾是省 79.7% token——单任务、单夹具、字节 ÷ 4。新测试台跑 3 项任务、用 tiktoken 统计,报告中位数:67.9%。为什么更低的数字更值钱,以及随之发布的新功能。
+50% 每周限额加成计划于 8 月 19 日到期。限额是天气——由算力驱动,一年变了五次。每任务 token 数是你唯一能控制的天气预报。
接入乱局落幕:Fable 5 永久包含在 Max 和 Team Premium 里——上限是所有模型共享的每周限额的 50%。配额重新成为货币,而每任务 token 数是你唯一握在手里的杠杆。
据报道,特斯拉把每位工程师的 AI 支出限制在每周 200 美元,Uber 也在收紧类似限额。上限配给的是工作——削减上下文浪费,才是在上限之下继续交付的方法。
7 月 13 日起,Claude Fable 5 从套餐额度切换到按量计费:每百万 token 输入 $10、输出 $50。最烧钱的习惯?代理本该读 4 个文件,却读了 20 个。
Claude Code 的每周上限和 Copilot 新的按额度计费,惩罚的是同一件事:代理本该读 4 个文件,却读了 20 个。解法不是更大的套餐,而是更小的上下文。
2026 年 6 月初,Miasma 蠕虫不再费心走 npm install。它直接把投毒的 .claude/settings.json、.cursor、.vscode 文件提交进 GitHub 仓库——其中包括 73 个微软仓库。你用 Claude Code 或 Cursor 打开仓库,恶意代码在你敲下任何命令之前就已经运行。本文讲清楚为什么 agent 配置现在就是代码,以及该如何这样对待它。
MCP server 把 AI agent 读取代码库的方式标准化。在一个代表性任务上,基于代码图谱的上下文把 token 砍掉约 80%、工具调用减少约 4 倍——本文讲清楚为什么这很重要,以及该如何思考自建还是采购。
经验丰富的终端开发者每天都在用的 Claude Code 隐藏斜杠命令 —— /statusline、!、@、/add-dir、/btw、/branch,各自省下什么、/add-dir 在规模化时会在哪里失效、以及一个会毁掉肌肉记忆的 Codex CLI 陷阱。
没有匹配的文章。