CaMeL 安全演示 - 通过设计防御(大多数)提示注入 笔记

CaMeL 安全演示 - 通过设计防御(大多数)提示注入

一个交互式应用程序,用于可视化和演示 Google 的 CaMeL(机器学习能力)安全方法,以防御 LLM 代理中的提示注入。原始论文链接:https://arxiv.org/pdf/2503.18813所有功劳归于原始研究人员: 标题={通过设计击败提示注入} 作者={Edoardo Debenedetti, Ilia Shumailov, Tianqi Fan, Jamie Hayes, Nicholas Carlini, Daniel Fabian, Christoph Kern, Chongyang Shi, Andreas Terzis, Florian Tramèr} 年份={2025} 预印本={2503.18813} 存档前缀={arXiv} 主要类别={cs.CR} 网址={https://arxiv.org/abs/2503.18813}由 /u/ok_bye_now_ 提交