InfoQ 中文
关注
Anthropic 的 Claude Opus 4.1 改进了重构和安全性,SWE-bench 验证得分 74.5%
Anthropic 推出了 Claude Opus 4.1,该更新加强了多文件项目的编码可靠性,并提高了长交互过程中的推理能力。该模型在 SWE-bench Verified 上的得分也从 72.5% 提高到 74.5%。在 Opus 4 的基础上,新版本加强了 Claude 作为编码助手的能力,尤其是在多文件环境中。作者:Hien Luu