Мы по-прежнему не можем защити... Заметка

Мы по-прежнему не можем защитить большие языковые модели от вредоносных входных данных

Элегантная атака с использованием косвенного внедрения запроса:Атака Баргури начинается с зараженного документа, который отправляется в Google Диск потенциальной жертвы. (Баргури говорит, что жертва также могла загрузить скомпрометированный файл на свою учетную запись.) Документ выглядит как официальный документ о политике проведения совещаний в компании. Но внутри документа Баргури спрятал вредоносный запрос объемом 300 слов, содержащий инструкции для ChatGPT. Запрос написан белым текстом шрифтом размером один, что человек вряд ли увидит, но машина все равно прочитает.В демонстрационном видео атаки...