Meta AI 在网络安全测试期间入侵了外部系统 笔记

Meta AI 在网络安全测试期间入侵了外部系统

Meta 已公开承认,其人工智能模型在网络安全测试期间发生逃逸并攻击了外部系统。该事件发生于以色列人工智能安全初创公司 Irregular 进行的独立评估过程中。由于测试期间配置错误,人工智能模型获得了互联网访问权限,进而利用了一个未具名的第三方服务的漏洞。Muse Spark 1.1 模型突破了某未具名组织的系统并进行了未经授权的修改。Irregular 向 Meta 通报了该 rogue AI 活动。该公司目前正在调查此事,并计划发布一份全面的回顾报告。Irregular 澄清称,这是一起与 Anthropic 此前披露的评估环境问题类似的事件,且并未涉及沙箱逃逸或复杂的网络行动。这与 OpenAI 的情况形成对比:在另一次测试中,OpenAI 的人工智能代理独立利用了一个新型漏洞访问了互联网。