エージェント・ガバナンス・ツールキット:AIエージェントに交... ノート

エージェント・ガバナンス・ツールキット:AIエージェントに交通ルールを与える

組織は、本番システムや機密データへの広範なアクセス権を持つ自律型AIエージェントをますます導入しています。これらのエージェントは効率的である一方で、プロンプトインジェクションやLLMの非決定性といった潜在的な脆弱性により、重大なセキュリティリスクをもたらします。システムプロンプトのみにセキュリティを依存することは不十分であり、それらはソフトな境界を提供するだけで、決定論的な強制力を欠いています。この問題に対処するため、Microsoftは本番グレードのエージェントガバナンスのためのオープンソースソリューションであるAgent Governance Toolkit(AGT)を導入しました。AGTは、AIエージェントの意思決定と実際のツール実行の間に介在するインターセプトレイヤーとして機能します。これは決定論的なポリシーを強制し、不正または破壊的な操作が発生する前にそれらを防止します。下流の意図を検査できない従来のセキュリティ対策とは異なり、AGTはエージェントのアクションを検査および制御します。このアプローチは、Agentic AIの脆弱性に関するOWASP Top 10やEU AI Actのような規制要件を含む、進化する脅威の状況を考慮すると重要です。Agent Governance Toolkitは、ポリシー強制エンジン、暗号化IDレイヤー、ランタイム分離、改ざん防止ログ記録など、いくつかのコンポーネントで構成されています。これはモジュラーコントロールプレーンとして機能し、ポリシー強制をエージェントフレームワークから分離します。AGTは複数のSDKをサポートし、一般的なエージェンティックフレームワークと統合されており、既存システムのレトロフィットを可能にします。実践的なデモンストレーションでは、PythonにおけるAGTのリアルタイムポリシー強制が示されています。簡単なYAMLでルールを定義することにより、開発者はツール関数をラップして、禁止されたアクションを自動的にインターセプトおよび拒否できます。これにより、「削除」のような操作は、LLMのロジックとは無関係に、適切な承認なしに実行することが構造的に不可能になります。AGTは、コンプライアンスレポートやバッジを生成するための検証コマンドも提供し、レビューのためのセキュリティ体制の証拠を提供します。