Boulevard de Seguridad RSS
Seguir
Ataques de Inyección Indirecta de Prompts Contra Asistentes LLM
La integración de los LLM en aplicaciones introduce nuevas vulnerabilidades de seguridad, específicamente el Promptware. El Promptware utiliza instrucciones maliciosas para comprometer el triángulo CIA de estas aplicaciones. Esta investigación evalúa los riesgos de Promptware para los usuarios de asistentes alimentados por Gemini a través de un nuevo marco de trabajo TARA. El estudio se centra en ataques de Promptware dirigidos, utilizando la inyección de instrucciones indirectas a través de interacciones comunes de los usuarios. Se demostraron catorce escenarios de ataque contra asistentes Gemini en cinco clases de amenazas. Estos ataques tienen consecuencias digitales y físicas, como spam, phishing y control de automatización del hogar. La investigación revela el potencial de Promptware para el movimiento lateral de dispositivos más allá de los límites de la aplicación LLM. El análisis TARA revela que el 73% de las amenazas suponen un riesgo crítico alto para los usuarios. Se discutieron mitigaciones para reducir significativamente el riesgo. Los hallazgos se divulgaron a Google, que desplegó mitigaciones dedicadas. La investigación destaca los peligros reales del Promptware y la importancia de las medidas de seguridad.