Я дал Claude Code мозг. На это... Заметка
DEV Community на русском

Я дал Claude Code мозг. На этот раз я позволил тестам судить его.

В этом эксперименте проверялась способность Claude Code выполнять реальные задачи в репозитории с использованием слоя памяти. В отличие от предыдущих тестов, сосредоточенных на правильности ответов, этот эксперимент требовал от агента модификации файлов и прохождения детерминированных проверок. Claude Code с системой памяти RE-call достиг 58,3% успешных результатов, значительно превзойдя обычный Claude Code (50,0%) и собственный базовый уровень CLAUDE.md (36,1%). Улучшение системы RE-call было наиболее выраженным в задачах, чувствительных к памяти, специфичной для проекта. Интересно, что статический файл CLAUDE.md показал худшие результаты, чем базовая конфигурация, что предполагает, что статические инструкции могут вносить шум. RE-call продемонстрировал свою полезность, извлекая релевантный контекст только при необходимости, а не просто добавляя больше токенов. Слой памяти использовался в большинстве подходящих сессий и предоставлял полезный контекст. Хотя RE-call увеличил использование токенов и затраты, он был направлен на предотвращение дорогостоящих сбоев из-за устаревшей информации. Эксперимент также столкнулся с операционными ограничениями GPT-5.3 Codex, что не позволило провести окончательное сравнение. В конечном итоге, это подтвердило, что производственные слои памяти могут повысить успешность агентов в реальных задачах в репозитории, извлекая критически важный контекст, специфичный для проекта. Будущая работа будет сосредоточена на оптимизации извлечения памяти для повышения эффективности и точности.