The Register | Security 日本語 フォロー LegalPwn: 弁護士の細則に悪意を埋め込むことでLLMを騙す 「信頼して信じてください – AIモデルは「法的」文書を非常に正当なものとして認識するように訓練されています。セキュリティ企業Pangeaの研究者たちは、大規模言語モデル(LLM)のガードレールを無視させるための、さらに簡単な方法を発見しました。法的文書の中に敵対的な指示をどこかに忍ばせると、不当な正当性を与えることができます。これは、世界中の弁護士にとって身近なトリックです…」 LegalPwn: Tricking LLMs by burying badness in lawyerly fine print bsky.app Hacker & Security News on Bluesky @hacker.at.thenote.app bsky.app