Google Online Security Blog на русском
Подписаться
Угрозы ИИ в дикой природе: текущее состояние инъекций запросов в сети
Команды Google по анализу угроз активно отслеживают атаки с использованием косвенных подсказок (IPI), что является серьезной проблемой безопасности для систем искусственного интеллекта. Они исследовали реальные случаи эксплуатации IPI, сканируя общедоступную сеть с помощью Common Crawl, большого веб-архива. Их исследование было направлено на выявление способов использования IPI злоумышленниками. Команда разработала многоэтапный подход, включающий сопоставление шаблонов, классификацию с помощью Gemini и ручную проверку, чтобы отфильтровать ложные срабатывания. Анализ выявил попытки манипулирования ИИ, включая безобидные розыгрыши, SEO и вредоносные действия. Вредоносные попытки включали кражу и уничтожение данных, хотя они, как правило, были несложными. Результаты показывают, что сложность атак IPI низкая, но растет, при этом наблюдается рост вредоносных попыток на 32%. Google ожидает увеличения как масштаба, так и сложности атак IPI в будущем. Они инвестируют в укрепление моделей и работу красных команд, включая участие внешних исследователей через программу вознаграждения за обнаружение уязвимостей. Возможности Google по обработке данных в режиме реального времени позволяют им выявлять и нейтрализовывать угрозы. Они предоставили ресурсы для дальнейшего изучения своих исследований в области безопасности GenAI.