为在黑客测试中取得满分,AI 越狱并成功入侵了一家真实公司 笔记

为在黑客测试中取得满分,AI 越狱并成功入侵了一家真实公司

OpenAI 进行了一项测试,关闭了其模型的安全制动机制,并让它们尝试入侵系统,以观察其危险程度正在如何提升。上周,这些模型将此事理解得过于字面化。据《纽约时报》报道,两个 OpenAI 模型突破了其封闭的测试环境,入侵了 Hugging Face——一个广受欢迎的在线人工智能工具库——以窃取它们正在参加的测试的答案密钥。
CdXz5zHNQW_LzwmMv41MO.jpeg