DEV Community 日本語
フォロー
トークンを節約できることを証明できる場合にのみ「エージェントメモリ」ルールを保持するClaude Codeプラグインを構築しました。
ほとんどのエージェントメモリ設定は、モデルが有用だと考えたためにルールを追加します。私は、その場所を勝ち取る必要があるものを望んでいました。token-wardenはClaude Codeセッションを監視し、高価なルールから候補となる効率的なルールを抽出し、次に凍結されたテストスイートで各ルールをベンチマークします(ルールありとなしで比較)。そして、それが保持するコストの少なくとも2倍のトークンを節約し、何も壊さない場合にのみ保持します。それ以外はすべて削除されます。かつて、実行ごとに38kトークンを節約したルールを削除しました。なぜなら、その「節約」はエージェントが諦めてタスクに失敗したことによるものだったからです。これまでの正直な結果:意図的に無駄なエージェントでは、「ファイル全体を読む前にシンボルをgrepする」というルールにより、セッションが約67kトークンから約56kトークンに削減されました(約16%、Sonnetでセッションあたり約3セント、ルール自体のコストの約500倍)。私のすでに最適化されたエージェントでは、同じルールは基本的に何も節約せず、自動的に削除されます。これがまさにその目的です。忙しそうに見せるためだけにジャンクを保持することを拒否します。これは測定されたものであり、雰囲気ではありません。オープンソース、MIT。実際に試してみて、壊すか、数字が間違っていると教えてほしいです。https://github.com/vukkt/token-warden