Claude Opus 5发布:半价追平Fable 5,ARC-AGI 3得分是GPT-5.6 Sol近4倍 — AI模型的“降本增效“跑进了高端市场
Anthropic在7月24日发布了Claude Opus 5。
这不是一次常规的旗舰迭代。新模型在多项核心任务上逼近、甚至部分超越公司最强的Fable 5,但API定价(输入$5/百万Token,输出$25/百万Token)与上一代Opus 4.8保持一致——恰好是Fable 5的一半。

Opus 5已经是Claude Max的默认模型,也是Claude Pro上最强选择。
先看数据。
软件工程测试Frontier-Bench v0.1中,Opus 5得分43.3%,是Opus 4.8(21.1%)的两倍以上,超过GPT-5.6 Sol(34.4%)和Fable 5(33.7%)。CursorBench 3.2编程测试中,Opus 5最高推理档成绩距离Fable 5峰值仅差不到0.5%,但单次任务成本只有一半。
最引人关注的是ARC-AGI 3——考察模型处理训练中从未见过的新任务的能力。Opus 5得分30.2%,是GPT-5.6 Sol(7.8%)的近四倍,Opus 4.8(1.5%)的二十倍。Anthropic称这是"第二名模型得分的三倍"。
企业自动化场景中,Zapier AutomationBench测试显示,Opus 5即使使用最低推理档位,完成的任务数量也超过其他参测模型——成本仅有竞品的2/3。

但这不意味着Fable 5被自家兄弟取代了。
沃顿商学院教授Ethan Mollick提前体验后评价:短任务中Opus 5确实可以追平甚至超过Fable级模型,但在长时间、高复杂度任务中,"少了一点雄心"。Fable 5仍是面向长周期智能体和最高难度研究的顶级选项。
从行业趋势来看,AI模型的竞争正在从"谁能训练出最强模型"转向"谁能以最低成本交付足够强的能力"。当中国模型以低价持续冲击市场、企业客户重新审视AI投入产出比,Anthropic率先把"降本增效"的旗帜插到了高端模型战场。
而这轮竞赛的下一阶段,可能不取决于谁能训练出更强的模型,而取决于谁能把"够强"的模型成本做到更低。

更多推荐

所有评论(0)