Anthropic发布Claude Opus 5:FrontierBench登顶,价格只有Fable 5的一半
Anthropic在两个月内发布了第四款旗舰模型——7月24日上线的Claude Opus 5,在多项基准测试中拿下第一,而定价和上一代Opus 4.8完全相同。
三个关键信息
基准测试全面领先。 在FrontierBench v0.1(智能体编码基准)上,Opus 5以最高努力模式拿到43.3%,超过OpenAI GPT-5.6 Sol的37.5%。在ARC-AGI-3(新颖推理测试)上得分30.2%,约为第二名的三倍。在知识工作评估GDPval-AA v2中,Opus 5的Elo达到1861,同样是当前最高水平。在CursorBench 3.2编码基准上,Opus 5的表现与Fable 5峰值仅差0.5%,但每任务成本只有后者的一半。
定价策略精准。 Opus 5的API价格为每百万token输入$5、输出$25——与Opus 4.8持平,恰好是Fable 5($10/$50)的一半。模型支持100万token上下文窗口和最多128K输出token,并提供低、中、高三档努力模式切换,让用户在成本和能力之间自行平衡。
两个月四款旗舰。 从Mythos 5、Fable 5、Sonnet 5到Opus 5,Anthropic在不到两个月内连续发布四款旗舰模型。Opus 5首日即在Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、claude.ai、Claude Code和Cowork全平台上线。
王斗视角
两个月四款旗舰,Anthropic的发版节奏已经不像一家AI实验室,更像一条流水线。但数字不骗人:Opus 5在FrontierBench上43.3%对GPT-5.6 Sol的37.5%,领先近六个百分点;在ARC-AGI-3上是第二名的三倍——这不是小数点级别的改进,是代差。更狠的是定价:和Fable 5几乎一样强,但价格砍半。这招直接把选择题简化了:除非你有非Fable不可的理由,否则没人会花双倍的钱买那0.5%的差距。Anthropic现在打的是「性能天花板附近,价格地板」的组合拳,这对OpenAI和Google的定价体系都是压力。
