谄媚型人工智能的社会校准——回复 | 科学 笔记

谄媚型人工智能的社会校准——回复 | 科学

我们感谢 Meng 就我们的研究结果阐明了重要的方法论与解释性问题。适当的人类基准取决于对人工智能(AI)预期社会角色的界定。在现实应用中,AI 模型被认为服务于多种目的,例如顾问、中立的外部意见、编辑和助手(1, 2)。这些角色伴随着对同意、验证或纠正性反馈发生频率的不同期望。更为复杂的是,用户常将单个 AI 系统视为同时履行多种角色(3, 4)。由于 AI 社会角色的模糊性,任何单一的人类基准都是不完美的比较参照点。我们所用的人类基准——即来自无个人利害冲突或情境关联的第三方人类的判断——探讨了一种常见且具有社会意义的期望:尽管 AI 系统常被视作外部、中立且客观的信息提供者(5–7),它们是否不成比例地偏向用户?我们的研究结果对另一种人类基准(在线众包工人判断,补充材料 SM 2)也表现出稳健性。与咨询者关系更为密切者的回应,确实可能受到更强的关系规范、声誉问责以及长期社会后果的影响。此类替代基准是否会导致更大或更小的分歧,仍有待进一步探讨。
CdXz5zHNQW_BabGzENraH.jpeg