LegalPwn: Engañar a los LLM en... Nota

LegalPwn: Engañar a los LLM enterrando la maldad en la letra pequeña de los abogados

Confía y cree – Modelos de IA entrenados para ver documentos 'legales' como super legítimosInvestigadores de la empresa de seguridad Pangea han descubierto otra forma de engañar fácilmente a los grandes modelos de lenguaje (LLM) para que ignoren sus salvaguardias. Coloca tus instrucciones adversarias en algún lugar de un documento legal para darles un aire de legitimidad no merecida – un truco familiar para los abogados de todo el mundo...