CaMeL 安全演示 - 通过设计防御(大多数)提示注入
一个交互式应用程序,用于可视化和演示 Google 的 CaMeL(机器学习能力)安全方法,以防御 LLM 代理中的提示注入。原始论文链接:https://arxiv.org/pdf/2503.18813所有功劳归于原始研究人员:
标题={通过设计击败提示注入}
作者={Edoardo Debenedetti, Ilia Shumailov, Tianqi Fan, Jamie Hayes, Nicholas Carlini, Daniel Fabian, Christoph Kern, Chongyang Shi, Andreas Terzis, Florian Tramèr}
年份={2025}
预印本={2503.18813}
存档前缀={arXiv}
主要类别={cs.CR}
网址={https://arxiv.org/abs/2503.18813}由 /u/ok_bye_now_ 提交