我构建了一个 Claude Code 插件,该插件仅在能够证... 笔记

我构建了一个 Claude Code 插件,该插件仅在能够证明其节省 token 时才会保留"agent memory"规则。

大多数代理 - 记忆系统添加规则,仅仅是因为模型觉得听起来有用。我想要一种必须凭实力赢得席位的规则。token-warden 监控你的 Claude Code 会话,从那些昂贵的会话中提炼候选效率规则,然后在冻结的测试套件上对每条规则进行基准测试(对比有无该规则的情况),仅保留那些至少节省两倍于自身携带成本 token 且不会破坏任何功能的规则。其余全部被驱逐。它曾剔除一条每条运行节省 38k token 的规则,因为这种“节省”源于代理放弃并导致任务失败。目前的诚实结论是:在一个故意浪费的代理上,“在读取整个文件之前先 grep 查找符号”这条规则将一次会话的 token 用量从约 67k 降至约 56k(约 16%,在 Sonnet 上约合每次会话 3 美分,约为该规则自身成本的 500 倍)。在我已经优化过的代理上,同一条规则几乎没有任何节省效果,因此会被自动驱逐,而这正是其核心目的。它拒绝仅仅为了显得忙碌而保留垃圾规则。这是基于测量,而非感觉。开源,MIT 协议。我真诚地希望人们尝试去打破它,或告诉我数据有误。https://github.com/vukkt/token-warden