실행보다 계획: 157번의 에이전트 실행과 오르카 스타... 노트

실행보다 계획: 157번의 에이전트 실행과 오르카 스타일 에이전트 플릿의 부상에서 얻은 교훈

157개의 AI 에이전트 배포에 대한 중요한 연구에 따르면, 성공의 주요 결정 요인은 실행 속도나 모델 크기가 아니라 계획의 품질인 것으로 나타났습니다. 이러한 관찰은 계층적이며 계획을 우선시하는 "Orca 스타일" 에이전트의 개발로 이어졌습니다. 이 연구는 다양한 사용 사례에 걸쳐 에이전트 아키텍처, 계획 깊이 및 실행 모델을 다양하게 변경하는 것을 포함했습니다. 계획에 더 많은 토큰을 할당한 에이전트는 작업 완료율이 훨씬 높았고 롤백 횟수가 적었습니다.이것의 이면에는 경제적 원리가 있는데, 계획은 실행 중에 발생하는 실수를 바로잡는 높은 비용에 비해 저렴하다는 것입니다. Orca 스타일 에이전트는 계획과 실행을 분리하며, 전략적 플래너가 복잡한 추론을 처리하고 전문화된 실행자가 정의된 작업을 수행합니다. 전문가들은 자신의 능력을 설명하는 "스킬 카드"를 가지고 있으며, 공유 메모리 계층이 상태를 유지합니다.핵심적인 효과적인 구현 패턴에는 검증 게이트를 포함한 재귀적 분해, 전문가 라우팅 및 상태 기반 컨텍스트 전파가 포함됩니다. 피해야 할 함정은 과도한 계획, 지나친 전문가 파편화, 조용한 재계획 및 컨텍스트 창 독점입니다. Orca 스타일 플릿은 다단계 워크플로우 및 고위험 작업에 권장됩니다.비용 모델은 복잡한 작업에 대해 Orca 스타일 아키텍처를 선호하며, 재시도 및 에스컬레이션 감소로 인해 총 토큰 비용이 감소하는 것으로 나타났습니다. AI 에이전트의 미래는 전용 도구 및 라이브러리를 사용하여 계획 기능을 강화하는 데 초점을 맞출 가능성이 높습니다. 핵심 통찰력은 신중한 계획이 에이전트 작업의 가장 중요한 측면이라는 것입니다. Orca 스타일 계획을 구현하는 것은 목표를 분해하고 각 단계를 검증하는 단일 플래너 함수로 시작할 수 있습니다.