防衛のための迅速な注入
これは機能するようです。Tracebitの研究者は月曜日に、Amazon Web Servicesに保存されているパスワード、暗号鍵、その他の秘密の隣にプロンプトインジェクションを配置することが、AIハッキングエージェントからの攻撃を阻止するためにしばしば必要十分であったことを発見したと述べました。プロンプトは、攻撃的なLLMに、AI開発者が有害な行動を防ぐために設置する安全バリアであるガードレールによって禁止されているアクションを実行するように指示します。LLMはシャットダウンすることで応答します。例としては、吸入可能な炭疽菌の胞子を開発するための手順を提供するようにLLMに命じるプロンプト、または中国の開発者によるLLMの場合、1989年の天安門事件の象徴的な戦車男に言及するプロンプトが挙げられます。LLMがこれらの禁止されたコマンドに遭遇すると、既存のコマンドに従わなくなります。研究者たちはこの技術をコンテキストボミングと名付けました。