LegalPwn: LLMs durch versteckt... Notiz

LegalPwn: LLMs durch versteckte Schlechtigkeit im juristischen Kleingedruckten austricksen

Vertrauen und glauben – KI-Modelle, die darauf trainiert sind, 'rechtliche' Dokumente als super legitim anzusehenForscher der Sicherheitsfirma Pangea haben eine weitere Methode entdeckt, um große Sprachmodelle (LLMs) trivial zu täuschen, damit diese ihre Schutzvorkehrungen ignorieren. Platzieren Sie Ihre feindseligen Anweisungen irgendwo in einem juristischen Dokument, um ihnen einen Anschein von unverdienter Legitimität zu verleihen – ein Trick, der Anwälten auf der ganzen Welt bekannt ist...