Agent Governance Toolkit: AI 에이전트에게 도로 규칙을 부여하다
조직들은 점점 더 광범위한 프로덕션 시스템 및 민감한 데이터에 대한 접근 권한을 가진 자율 AI 에이전트를 배포하고 있습니다. 이러한 에이전트들은 효율적이지만, 프롬프트 주입 및 LLM 비결정성과 같은 잠재적인 취약점으로 인해 상당한 보안 위험을 초래합니다. 시스템 프롬프트에만 의존하는 것은 불충분하며, 이는 소프트 경계만을 제공하고 결정론적 강제성이 부족합니다. 이를 해결하기 위해 Microsoft는 프로덕션 등급 에이전트 거버넌스를 위한 오픈 소스 솔루션인 Agent Governance Toolkit(AGT)을 도입했습니다.AGT는 AI 에이전트의 의사 결정과 실제 도구 실행 사이에 개입 계층 역할을 합니다. 이는 결정론적 정책을 강제하여 무단 또는 파괴적인 작업을 발생 전에 방지합니다. 다운스트림 의도를 검사하지 못하는 기존 보안 조치와 달리, AGT는 에이전트의 행동을 검사하고 제어합니다. 이러한 접근 방식은 Agentic AI 취약점에 대한 OWASP Top 10 및 EU AI Act와 같은 규제 명령을 포함한 진화하는 위협 환경을 고려할 때 중요합니다.Agent Governance Toolkit은 Policy Enforcement Engine, Cryptographic Identity 계층, Runtime Isolation 및 Tamper-Evident Logging을 포함한 여러 구성 요소로 구성됩니다. 이는 모듈식 제어 평면으로 작동하여 정책 강제를 에이전트 프레임워크와 분리합니다. AGT는 여러 SDK를 지원하며 인기 있는 에이전트 프레임워크와 통합되어 기존 시스템의 개조를 가능하게 합니다.실습 데모는 Python에서 AGT의 실시간 정책 강제를 보여줍니다. 간단한 YAML로 규칙을 정의함으로써 개발자는 도구 함수를 래핑하여 금지된 작업을 자동으로 가로채고 거부할 수 있습니다. 이를 통해 "삭제"와 같은 작업은 LLM의 논리와 독립적으로 적절한 권한 없이는 구조적으로 실행 불가능하게 됩니다. AGT는 또한 검증 명령을 제공하여 규정 준수 보고서 및 배지를 생성하고 검토를 위한 보안 상태 증거를 제공합니다.