RSS Schneier sobre Seguridad
Seguir
Todavía no podemos proteger los LLM de entradas malintencionadas
Un buen ataque de inyección indirecta de indicaciones:El ataque de Bargury comienza con un documento envenenado, que se comparte en Google Drive de una víctima potencial. (Bargury dice que una víctima también podría haber subido un archivo comprometido a su propia cuenta). Parece un documento oficial sobre las políticas de reuniones de la empresa. Pero dentro del documento, Bargury escondió una indicación maliciosa de 300 palabras que contiene instrucciones para ChatGPT. La indicación está escrita en texto blanco con una fuente de tamaño uno, algo que un humano probablemente no verá pero que una máquina leerá igualmente.En un video de prueba de concepto del ataque...