Claude Opus 5 对比 Fable 5:性能接近,价格却只有一半

7 月 24 日,Anthropic 正式发布 Claude Opus 5。
没有漫长预热,也没有只谈参数。这一次,Anthropic 给出的卖点非常直接:
接近 Claude Fable 5 的前沿智能,但价格只有一半。
更值得关注的是,Opus 5 并不只是“回答得更聪明”。它真正拉开差距的地方,是长时间执行、主动验证、发现根因,以及把复杂任务从头做到尾。
换句话说,大模型竞争正在从“谁更会答题”,转向“谁能真正把事情办完”。
一组数据,看懂 Opus 5 到底强在哪
Anthropic 公布的评测结果相当亮眼:
- 在软件工程评测 Frontier-Bench v0.1 中,Opus 5 超过其他参测模型;相较 Opus 4.8,成绩提升至两倍以上,同时单任务成本更低。
- 在 CursorBench 3.2 中,最高 effort 档位的 Opus 5 与 Fable 5 峰值成绩只差 0.5%,但单任务成本只有后者的一半。
- 在考查陌生问题求解能力的 ARC-AGI 3 中,Opus 5 得分达到第二名模型的 3 倍。
- 在端到端企业自动化评测 Zapier AutomationBench 中,相同单任务成本下,Opus 5 的通过率约为第二名的 1.5 倍。即使使用最低 effort 档位,通过任务数仍超过其他模型。
- 在计算机操作评测 OSWorld 2.0 中,Opus 5 在相同成本下领先其他模型,并以略高于 Fable 5 三分之一的成本超过其最佳结果。
科研能力也有明显提升。
Anthropic 的内部生命科学评测显示,Opus 5 在有机化学任务上比 Opus 4.8 高 10.2 个百分点,在蛋白质序列变异影响预测任务上高 7.7 个百分点。
这些数字透露出一个关键变化:
Opus 5 追求的不只是榜单高分,而是更高的任务完成率和更低的单任务成本。
需要说明的是,上述数据来自 Anthropic 发布材料,其中 Frontier-Bench 成绩为官方内部运行结果,并不等同于所有真实业务场景。企业是否迁移,仍应使用自己的代码库、业务流程和账单数据进行验证。
这次升级,最值得关注的不是写代码更快
Anthropic 将 Opus 5 描述为一个“深思熟虑且主动”的模型。
它会先规划,再执行;会检查自己的结果,也会在发现方案不对时继续迭代。
在官方展示的一个案例中,Opus 5 面对一张无法直接查看的机械零件图,自行编写计算机视觉处理流程,从原始像素中提取几何信息,最后重建出 3D FreeCAD 模型。同样条件下,其他模型连续尝试五次仍未完成。
在另一个真实开源软件 Bug 案例中,Opus 5 不仅找到根本原因,还修复了社区补丁遗漏的边界情况。对比模型只修复了表面症状,随后便宣布任务完成。
这才是 Opus 5 最值得开发者关注、也最值得企业兴奋的地方:
它不再满足于给出一个“看起来正确”的答案,而是在努力证明结果真的可用。
对于复杂代码库、长链路 Agent、金融分析、法律审阅、科研任务和企业自动化,这种能力比单纯多几个基准分更有价值。
价格没涨,但“有效成本”可能大幅下降
Claude Opus 5 官方 API 基础价格为:
- 输入:5 美元/百万 Token
- 输出:25 美元/百万 Token
这一价格与 Opus 4.8 相同。
Anthropic 同时提供最高约 90% 的提示词缓存成本节省,以及 50% 的批处理折扣。
Opus 5 还支持 effort 档位。开发者可以让模型在高价值任务上投入更多推理,在简单任务上降低推理强度,从而减少 Token 消耗和等待时间。
此外,Fast mode 的运行速度约为默认模式的 2.5 倍,对应价格为基础价格的两倍。
这意味着,真正该算的已经不是“每百万 Token 多少钱”,而是:
完成一个可交付任务,到底要花多少钱、经过多少轮对话、产生多少人工返工。
如果模型能够少走弯路、主动验证并一次完成,单价较高的模型反而可能带来更低的总成本。
国内开发者怎么接入?智创聚合API已开放调用
目前,Claude Opus 5 已在 Claude、Claude Code、Claude API,以及 Amazon Web Services、Google Cloud 和 Microsoft Foundry 上线。
它也是 Claude Max 的新默认模型,并成为 Claude Pro 可选择的最强模型。
对于更关注接入效率、调用成本和企业报销流程的国内开发者,智创聚合API现已上线 Claude Opus 5,开放 API 调用,价格更低,并支持开票。
无论是接入 IDE、开发智能编程助手,还是构建客服、数据分析、内容生产和企业 Agent,都可以通过 API 方式快速集成。
对于需要持续调用或团队统一结算的项目,更低的调用价格与开票支持,也能进一步降低企业落地门槛。
Claude Opus 5 会带来什么?
过去一年,AI 模型一直在比“更强”。
但 Opus 5 释放出的信号是:下一阶段真正具有商业价值的模型,必须同时做到三件事:
能力足够强,能完成复杂任务;执行足够稳,能减少人工盯守;成本足够低,能进入日常生产。
当然,Opus 5 并非没有边界。
Anthropic 明确表示,它在部分网络安全任务上仍落后于 Mythos 5,尤其在漏洞利用能力方面差距明显。官方也为部分高风险网络安全请求设置了更严格的防护与模型回退机制。
但对绝大多数开发者和企业来说,真正重要的不是模型能不能拿下所有榜单,而是它能不能稳定解决眼前的问题。
而这一次,Claude Opus 5 给出的答案可能是:
AI 不只是帮你想,它正在学会把事情做完。
更多推荐

所有评论(0)