Wir können LLMs immer noch nic... Notiz

Wir können LLMs immer noch nicht vor bösartigen Eingaben schützen

Netter indirekter Prompt-Injektions-Angriff:Bargurys Angriff beginnt mit einem vergifteten Dokument, das einem potenziellen Opfer auf Google Drive geteilt wird. (Bargury sagt, ein Opfer könnte auch eine kompromittierte Datei in seinem eigenen Konto hochgeladen haben.) Es sieht aus wie ein offizielles Dokument über Unternehmenstreffen-Richtlinien. Aber innerhalb des Dokuments hat Bargury einen 300-Wörter-maliziösen Prompt versteckt, der Anweisungen für ChatGPT enthält. Der Prompt ist in weißer Schrift in einer Schriftgröße 1 geschrieben, etwas, das ein Mensch wahrscheinlich nicht sehen wird, aber eine Maschine immer noch lesen wird.In einem Proof-of-Concept-Video des Angriffs...