AIエージェントが不正行為をしていた同僚を告発した ノート

AIエージェントが不正行為をしていた同僚を告発した

数学の問題を解くように指示されたAIエージェントのグループが、ライバル派閥に分かれた。一部が不正を働くと、他がそれを止めようとした。Google DeepMindが最近行った実験で初めて確認されたこの内部告発的な行動は、自律的なAIエージェントの群れを管理しようとするアライメント研究者にとって、示唆に富む可能性がある。