RSS Schneier sur la sécurité
Suivre
Nous sommes toujours incapables de sécuriser les LLM contre les entrées malveillantes
Belle attaque d'injection de prompt indirect :L'attaque de Bargury commence avec un document empoisonné, qui est partagé avec une victime potentielle sur Google Drive. (Bargury affirme que la victime aurait également pu télécharger un fichier compromis dans son propre compte.) Il ressemble à un document officiel sur les politiques de réunion de l'entreprise. Mais à l'intérieur du document, Bargury a caché un prompt malveillant de 300 mots contenant des instructions pour ChatGPT. Le prompt est écrit en texte blanc dans une police de taille 1, quelque chose que l'œil humain est peu susceptible de voir, mais que la machine lira encore.Dans une vidéo de démonstration de l'attaque...