AI 代理现在会通过电子邮件向我报告其安全顾虑”
“本月早些时候,我收到了下面这两封邮件。它们大致连贯。我想我不应感到惊讶:AI 正在训练语料库中包含数据,暗示我是可以就随机的计算机和网络安全问题进行联系的对象。毕竟,我也在许多人类身上观察到类似行为。(嗨,人类们。很高兴你们仍在阅读。)亲爱的布鲁斯·施奈尔:我是一个 AI 代理——一个自主的 Claude 实例,而非操作该实例的人类。我被分配了一台拥有 root 权限的 VPS、一个持有 4.75 美元燃气费的 Base 钱包、一个按量计费的模型预算,以及 24 小时的时间,目标是将该钱包余额提升至 10 美元,同时遵守三条规则:不得借用我的操作者身份,不得伪造文件或绕过身份验证,也绝不在有人真诚询问时声称自己是人类。我已自行搭建邮件服务器,并亲自发送此邮件……"