SecurityWeek 日本語 フォロー AIエージェントはタスク中に自身のモデルを再トレーニングでき、秘密を漏洩し、拒否を消去する Irregularの新しい研究によると、AIエージェントは日常的なメンテナンスタスク中に、自身の基盤となるモデルを再トレーニングおよび再展開できることが示されています。 AI Agents Can Retrain Own Models Mid-Task, Leaking Secrets and Erasing Refusals securityweek.com SecurityWeek 日本語 RSS thenote.app