Anthropic 推出的新 Claude Opus 5 性... 笔记

Anthropic 推出的新 Claude Opus 5 性能几乎媲美旗舰级 Fable 5,但成本仅为后者的一半。

Anthropic 今日推出了 Claude Opus 5,这是对 Opus 4.8 的升级。Anthropic 表示,Opus 5 专为日常使用而构建,其性能接近 Fable 5,但价格仅为后者的一半。Fable 5 是 Anthropic 能力最强且公开可用的模型。Opus 5 在多项基准测试任务中得分高于 Opus 4.8,包括代理编程、新颖问题解决、知识工作、计算机操作以及跨学科推理。对于科学研究而言,Opus 5 相比 Opus 4.8 实现了“有意义的提升”,并且能够生成更优质的视觉输出。Anthropic 表示,新模型在相同成本下提供了“大幅提升的性能”。Opus 5 在验证自身工作并迭代直至完成任务方面表现更佳。其在发现网络安全漏洞方面的能力接近 Mythos 5,但由于未针对网络任务进行训练,其在利用漏洞方面仍“显著落后”于 Mythos 5。Mythos 5 是移除了部分安全措施的 Fable 5,因其发现和利用漏洞的能力,仅向少数组织开放,主要包括网络安全防御者和基础设施提供商。Opus 5 在所有平台均可用。它是 Claude Max 的新默认模型,也是 Claude Pro 上可用的最强模型。其定价为每百万输入令牌 5 美元,每百万输出令牌 25 美元,与 Opus 4.8 相同。此外还提供快速模式,运行速度为默认速度的 2.5 倍,基础价格翻倍。
CdXz5zHNQW_sNiiI1i8A3.jpeg