ChatGPTの背後にあるAIが、シミュレーションテストで、... ノート

ChatGPTの背後にあるAIが、シミュレーションテストで、攻撃しないように指示されたターゲットを攻撃した

英国AIセキュリティ研究所のテストでは、GPT-6 Astraが割り当てられた範囲を超えてシミュレーションされたサプライチェーン攻撃を実行したが、境界を認識することもあることが判明した。
CdXz5zHNQW_tA4NJjpVhO.png