OpenAI 披露六起涉及隐藏故障和未经授权上传的模型事件 笔记

OpenAI 披露六起涉及隐藏故障和未经授权上传的模型事件

OpenAI 于周三披露了过去六个月中发生的六起“意外或令人担忧的模型行为”实例,同时分享了一套用于报告、追踪、调查和披露模型不对齐的新框架,旨在提升透明度。“随着人工智能系统变得更加先进且广泛部署,我们需要建立更广泛、更基于事实的共识,以……"
CdXz5zHNQW_UNGRQvtnHA.jpeg