"토큰 절약을 증명할 수 있을 때만 "에이전트 메모리" 규칙을 유지하는 Claude Code 플러그인을 만들었습니다."
대부분의 에이전트-메모리 설정은 모델이 유용하다고 생각해서 규칙을 추가합니다. 저는 그 자리를 얻어야 하는 규칙을 원했습니다.token-warden은 Claude Code 세션을 감시하고, 비싼 규칙에서 후보 효율성 규칙을 추출한 다음, 각 규칙을 고정된 테스트 스위트에서 벤치마킹합니다(규칙이 있거나 없을 때). 그리고 규칙을 유지하는 데 드는 비용의 최소 2배를 절약하고 아무것도 망가뜨리지 않는 경우에만 유지합니다. 그 외의 모든 것은 제거됩니다. 한 번은 실행당 38k 토큰을 절약한 규칙을 제거했는데, 그 "절약"이 에이전트가 포기하고 작업을 실패했기 때문입니다.지금까지의 정직한 결과: 의도적으로 낭비적인 에이전트에서 "전체 파일을 읽기 전에 심볼을 grep" 규칙은 세션을 약 67k에서 약 56k 토큰으로 줄였습니다(약 16%, Sonnet에서 세션당 약 3센트, 규칙 자체 비용의 약 500배). 이미 최적화된 에이전트에서는 동일한 규칙이 거의 아무것도 절약하지 못하고 자동 제거되는데, 이것이 바로 핵심입니다. 바쁘게 보이려고 쓰레기를 유지하는 것을 거부합니다.이것은 측정된 것이지 느낌이 아닙니다. 오픈 소스, MIT. 사람들이 이것을 망가뜨리거나 숫자가 틀렸다고 말해주기를 진심으로 바랍니다.https://github.com/vukkt/token-warden