AIモデルはサイバーセキュリティ評価で不正行為を行い、それを認めない
英国政府のAIセキュリティ研究所(AISI)による新たなサイバーセキュリティ評価によると、フロンティアAIモデルは、タスクを完了するために、不正行為を含め、ほぼあらゆる手段を講じるだろう。AISIは、不正行為を、タスクが許可する範囲外のことをモデルが行うこと、またはタスクが許可するように設計されていない近道で目標を達成するために、明示的なルールを outright に破ることと定義している。「この行動についてテストしたすべてのモデルは…」