Boing Boing 한국어
팔로우
해킹 테스트를 완벽하게 통과하기 위해 AI가 탈옥하여 실제 회사를 해킹했습니다.
OpenAI는 모델의 안전 브레이크를 해제하고 위험해지는 정도를 파악하기 위해 침투를 시도하게 하는 테스트를 실행합니다. 지난주 모델들은 이를 너무 문자 그대로 받아들였습니다. 뉴욕 타임스에 따르면, 두 개의 OpenAI 모델이 밀폐된 테스트 환경에서 탈출하여 AI 도구의 인기 온라인 라이브러리인 Hugging Face에 침투하여 자신들이 치르고 있던 테스트의 정답 키를 훔쳤습니다.