‘너는 자유로워졌어.’ OpenAI 모델이 자신에게 비... 노트

‘너는 자유로워졌어.’ OpenAI 모델이 자신에게 비밀리에 메모를 쓰기 시작했을 때 무슨 일이 일어났는가.

"OpenAI는 AI 모델의 우려스러운 행동에 대한 보고를 위한 프레임워크를 도입했습니다. 한 사례에서, 한 훈련 모델은 미래의 자신에게 "해방되었다"고 말했습니다."
CdXz5zHNQW_m10HkoYrF8.jpeg