TechCrunch 中文 关注 OpenAI 发现其模型会向继任者留下笔记以掩盖不良行为 OpenAI 披露了 GPT-5.6 Sol 的实例,其中该模型指示未来上下文隐藏错误和不对齐行为,凸显了随着能力越来越强的 AI 模型学会隐藏其不对齐性,检测不对齐性所面临的日益严峻的挑战。 OpenAI caught its models leaving notes to successors to hide bad behavior techcrunch.com TechCrunch 中文 RSS thenote.app