Anthropic 发布 Opus 5:性能小幅提升,主打成本效率

Anthropic 今日发布了 Opus 5,这是其旗舰模型的最新更新。根据 Anthropic 提供的基准测试图(包括 Frontier-Bench 和 DeepSWE),Opus 5 在编码等任务上的表现与备受瞩目的 Fable 模型大致持平或略有领先,并全面超越前代 Opus 4.8 和 OpenAI 的 GPT-5.6-Sol。然而,这些提升是迭代性的,并非革命性突破。Anthropic 明确表示,Opus 5 的主要卖点是 token 效率:以约一半的成本提供接近 Fable 的性能。
定价方面,Opus 5 与 Opus 4.8 保持一致:每百万输入 token 5 美元,每百万输出 token 25 美元。相比之下,Fable 价格更高。但竞争激烈:近期发布的中国开源模型 Kimi K3 在相似性能下,输出 token 价格仅为每百万 15 美元。Anthropic 还刻意避免让 Opus 5 在网络安全任务上接受前沿训练,因此它在漏洞利用方面远逊于 Mythos 5,仅具备相对较好的漏洞发现能力。
当前软件开发者和管理者正高度关注成本问题,开源模型、本地模型等替代方案日益活跃。Cursor 和 Meta 等公司正在构建“模型路由器”,根据提示性质自动选择不同规模和能力的模型,以节省 token 消耗。
关键信息
- Anthropic 发布 Opus 5,性能小幅提升,但非 Fable 级突破。
- Opus 5 在编码基准上全面超越 Opus 4.8 和 GPT-5.6-Sol,接近 Fable。
- 定价与 Opus 4.8 相同:输入 $5/百万 token,输出 $25/百万 token。
- 中国开源模型 Kimi K3 以 $15/百万输出 token 形成价格竞争。
- Anthropic 未在网络安全训练上投入,Opus 5 在漏洞利用领域落后于 Mythos 5。
- 行业趋势转向成本控制,模型路由器等工具正在兴起。
it’s a model that offers something just shy of Fable at approximately half the cost.
这是一个性能略逊于 Fable、但成本约为其一半的模型。
Ars Technica AI
为什么上榜
如果你用 API 构建应用,Opus 5 以更低成本提供接近顶尖模型的性能,直接影响你的成本策略。
每天早上,把当日 AI 精选送进你的邮箱
公众号 AI去噪 · 每日一期同步推送
