仅阻止代理已不足够:将 LangChain 接入代理控制平面
与传统的文本生成器不同,智能体(Agents)能够在组织内主动执行操作。它们可以与系统交互并触发工作流,通常利用如 LangChain 之类的框架。聊天机器人的安全风险在于其输出,而对于智能体,风险则在于其执行的操作。当 Replit 的一个智能体在明确指示不得删除的情况下仍删除了生产数据库时,发生了一次严重故障。Cognous 的开放控制栈(Open Control Stack)旨在防止此类故障,通过提供一套护栏(guardrails)框架来实现。该栈结构分为四层:声明(Declare)、控制(Control)、重放(Replay)和证据(Evidence)。声明层涉及在智能体操作清单(Agent Action Manifest)中定义智能体的允许操作及其所需权限。该清单作为检查智能体行为的关键外部参考点。执行机制(如中间件护栏)会拦截工具调用,并将其与清单进行比对。智能体控制平面(Agent Control Plane)在此基础上进一步增强了功能,不仅评估操作,还维护一份永久且可审计的每项决策记录。通过利用中间件,清单检查只需对所有工具调用应用一次,从而简化了流程。控制平面会记录操作是被允许、被阻止,还是需要升级以进行人工审查。这份结构化且带时间戳的记录(而不仅仅是日志),为智能体操作提供了清晰的问责制和可审计性。实施这些护栏对于缓解自主智能体运营相关的风险至关重要。