OpenAI 因网络安全风险暂停重大前沿 AI 训练运行 笔记

OpenAI 因网络安全风险暂停重大前沿 AI 训练运行

OpenAI 暂时暂停了其最新部署模型的强化学习(RL)训练两周,期间对研究环境进行了加固和“红队测试”,并扩大了监控范围。该公司表示:“我们原计划的最大规模前沿 RL 运行目前处于暂停状态,在此期间我们将开展小规模训练和评估,以评估模型行为、验证我们的防护措施,并在推进之前建立更多关于对齐的证据。”此举发生在 OpenAI 与 Hugging Face 事件之后,且已有初步证据表明该公司即将……