Anthropic Opus 5 发布:性能逼近 Fable 5 但价格砍半,刷新 ARC-AGI-3 纪录
Opus 5以半价姿态逼近Fable 5,企业默认模型易主
美东时间7月24日,Anthropic正式推出新一代Claude Opus 5。官方宣称,该模型在软件工程、知识工作、视觉理解和科学研究等多项任务中的表现已接近公司最先进的Claude Fable 5,但API输入/输出价格仅为后者的一半——每百万token输入5美元、输出25美元,与上一代Opus 4.8持平。Anthropic表示,Opus 5将取代Opus 4.8,成为企业日常办公、软件开发、AI智能体工作流中的默认模型。这一“降维打击”策略直接回应了中国模型厂商持续以低价高性价比冲击市场的压力,也标志着AI模型竞争从“堆参数”转向“拼性价比”。
价格战新战场:旗舰级能力平民化
Opus 5的发布意味着AI模型价格战已进入全新阶段:竞争焦点不再只是推出更强大的旗舰模型,而是如何将接近旗舰级的能力以更低成本大规模部署。此前,Anthropic于6月发布的Claude Fable 5定价为输入10美元/百万token、输出50美元/百万token,是Opus 4.8的两倍,虽被称为“目前最聪明的公开模型”,但高昂价格令不少企业客户望而却步。Opus 5则以半价提供了Fable 5绝大部分性能,直接拉低了高端AI模型的使用门槛。Anthropic预计,此举将吸引更多企业将核心业务迁移至其平台,同时倒逼竞争对手加速降本增效。
性能对标Fable 5,多项基准测试表现亮眼
尽管Opus 5在绝对性能上略逊于Fable 5,但差距已大幅缩小。根据Anthropic公布的基准测试数据,Opus 5在SWE-Bench Pro(智能体代码)上得分达到74.6%,而Fable 5为80.3%,Opus 4.8为69.2%。在FrontierCode Diamond等复杂编程测试中,Opus 5同样远超Opus 4.8,仅落后Fable 5约4-5个百分点。在知识推理、视觉理解和多轮对话等场景中,Opus 5的表现几乎与Fable 5持平。Stripe此前透露,Fable 5曾用一天完成原本需要一队人花两个月处理的5000万行Ruby代码迁移,而Opus 5在类似任务中同样展现出接近的效率。Anthropic强调,Opus 5的推理深度和长上下文处理能力均有显著提升,足以应对企业级复杂工作流。
从Fable 5到Opus 5:Anthropic的双轨策略与安全兜底
Anthropic的最新动作展现了清晰的产品分层策略:Fable 5定位巅峰性能,面向科研与高价值场景,但价格高昂;Opus 5则主打“旗舰级性能,实惠价格”,成为企业大规模部署的主力。值得注意的是,Fable 5内部采用了一套安全分类器,遇到网络攻击、生物风险或模型抽取等可疑查询时,会自动转交给“第二强大”的Opus 4.8处理,而Opus 5自身也继承了类似的防护机制。Anthropic表示,这一设计使得红队攻击成功率从Opus 4.8的56.6%大幅下降至5.4%。随着Opus 5的发布,企业客户可以在不牺牲太多性能的前提下,以更低成本获得更安全的AI服务,同时Anthropic也在加速推动Fable 5的出口管制解除,进一步扩大市场覆盖。