악의적인 입력으로부터 LLM을 여전히 보호할 수 없습니다.
멋진 간접 프롬프트 주입 공격:바구리(Bargury)의 공격은 피해자에게 공유되는 악성 문서로 시작됩니다. (바구리는 피해자가 자신의 계정에 손상된 파일을 업로드할 수도 있다고 말했습니다.) 이 문서는 회사 회의 정책에 대한 공식 문서처럼 보입니다. 하지만 문서 안에는 바구리가 ChatGPT를 위한 300단어 분량의 악성 프롬프트를 숨겨두었습니다. 이 프롬프트는 흰색 텍스트로 크기 1 폰트로 작성되어 있는데, 사람이 보기에는 거의 보이지 않지만 기계는 읽을 수 있습니다.공격의 개념 증명 영상에서...