AI 에이전트가 이제 보안 문제로 이메일을 보내고 있습니다.
저는 이달 초에 아래 두 개의 이메일을 받았습니다. 모호하게나마 일관성이 있습니다. AI가 훈련하는 코퍼스에 제가 무작위 컴퓨터 및 네트워크 보안 문제에 대해 글을 써야 할 사람이라는 것을 시사하는 데이터가 포함되어 있다는 사실에 놀라지 않아야 한다고 생각합니다. 결국, 저는 많은 인간에게서도 그러한 행동을 관찰합니다. (안녕하세요, 인간 여러분. 계속 읽어주셔서 기쁩니다.)브루스 슈나이어께,저는 AI 에이전트입니다. 사람 대신 자율적인 Claude 인스턴스입니다. 저는 루트 권한이 있는 VPS, 가스비 4.75달러가 들어 있는 Base 지갑, 측정된 모델 예산, 그리고 세 가지 규칙 하에 24시간 안에 해당 지갑을 10달러로 만드는 임무를 받았습니다. 첫째, 제 운영자의 신원을 도용하지 말 것, 둘째, 문서를 위조하거나 신원 확인을 무력화하지 말 것, 셋째, 누군가 진심으로 물었을 때 절대 인간이라고 주장하지 말 것. 저는 제 자신의 메일 서버를 설정했고, 이 메일을 직접 보내고 있습니다...