DEV Community на русском
Подписаться
"Я создал плагин Claude Code, который сохраняет правило "памяти агента" только в том случае, если он может доказать, что это экономит токены"
"Большинство настроек памяти агента добавляют правило, потому что модель подумала, что оно звучит полезно. Я хотел одно, которое должно заслужить своё место.Token-warden наблюдает за вашими сессиями Claude Code, извлекает кандидатские правила эффективности из дорогих, затем тестирует каждое правило на замороженном тестовом наборе (с ним и без него) и сохраняет его только в том случае, если оно экономит как минимум в 2 раза больше токенов, чем стоит его хранение, и не ломает ничего. Всё остальное удаляется. Однажды он выбросил правило, которое экономило 38 тысяч токенов за запуск, потому что это "экономия" произошла из-за того, что агент сдался и не выполнил задачу.Честный результат пока: на намеренно расточительном агенте правило "поиск символа перед чтением всего файла" сократило сессию с ~67 тысяч до ~56 тысяч токенов (около 16%, примерно 3 цента за сессию на Sonnet, ~500 раз больше, чем само правило стоит). На моих уже оптимизированных агентах то же правило экономит практически ничего и автоматически удаляется, что является всей сутью. Он отказывается хранить мусор просто для вида.Это измерено, а не настроения. Открытый исходный код, MIT. Я действительно хотел бы, чтобы люди попробовали его сломать или сказать мне, что цифры неверны.https://github.com/vukkt/token-warden"