LegalPwn: 弁護士の細則に悪意を埋め込むことでLLM... ノート

LegalPwn: 弁護士の細則に悪意を埋め込むことでLLMを騙す

「信頼して信じてください – AIモデルは「法的」文書を非常に正当なものとして認識するように訓練されています。セキュリティ企業Pangeaの研究者たちは、大規模言語モデル(LLM)のガードレールを無視させるための、さらに簡単な方法を発見しました。法的文書の中に敵対的な指示をどこかに忍ばせると、不当な正当性を与えることができます。これは、世界中の弁護士にとって身近なトリックです…」