
一张标错最优值的图表,揭开了大模型定价逻辑的重塑
2026年7月24日,Anthropic发布新一代Claude Opus 5。值得玩味的是,官方在发布前公布的对比图表中出现了细微标注差异——Frontier Code v1.1测试项下,Opus 5的53.4%被标记为最优成绩,而相邻格子中Fable 5的成绩为53.5%。
这一事件迅速在社交平台引发讨论。毕竟,Anthropic为新模型主打的宣传卖点之一,正是"具备自主核验结果的能力"。制图环节出现的疏漏,某种程度上成为了外界观察这家公司产品策略的一个切口。
抛开插曲,数据本身传递的信号更为明确:Opus 5与旗舰Fable 5的性能差距已经微小到需要仔细分辨,但它的定价,仅为后者的一半。
定价持平,性能实现跨代提升
Opus 5的输入单价为5美元/百万令牌,输出25美元/百万令牌,与上一代Opus 4.8完全一致。作为对照,Fable 5的定价为输入10美元、输出50美元。
这意味着,用户以Opus 4.8的预算,获得了接近Fable 5的智能水平。
从官方公布的评测数据看,性能提升幅度显著:
编程能力。在Frontier-Bench v0.1软件工程基准上,Opus 5的成绩是Opus 4.8的两倍以上,且单任务成本更低。在CursorBench 3.2最高努力档位下,Fable 5得分70.5%,单任务成本17.32美元;Opus 5得分70.0%,单任务成本仅8.23美元——分差不足0.5个百分点,价格不到一半,令牌消耗量减少40%。
流体智能。在专门检验模型解决"从未见过的新问题"能力的ARC-AGI 3基准上,Opus 5取得次优模型三倍的得分。
计算机操作与业务自动化。在OSWorld 2.0上,Opus 5以约Fable 5三分之一的成本超越后者最高成绩;在Zapier AutomationBench上,相同成本下任务通过率约为次优模型的1.5倍。
💡 多项核心评测的数据显示,Opus 5在Frontier-Bench、GDPval-AA、OSWorld 2.0等基准中取得领先。Anthropic官方措辞为"以一半价格提供接近Fable 5的前沿智能",但官方图表中Opus 5在多项评测里实现了领先。
产品层级重构:Opus 5走向前台
Opus 5发布后,Claude Max的默认模型已切换为Opus 5,它也是Claude Pro用户能够调用的最强模型。Fable 5则主要面向API与企业大客户,个人订阅用户的调用额度受到严格限制。
这一产品分层传递出清晰信号:面向日常高频使用场景,Opus 5的智能水平已经"够用";Fable 5保留给少数需要"神话级"算力的特殊任务。
为配合这一策略,Anthropic引入了可调节的"努力程度"(Effort)设置,用户可在low、medium、high、xhigh、max五档之间自主取舍——需要更强的推理能力,就把档位调高;更在意速度、价格和令牌消耗,就降低档位。官方公布的大部分成绩,都是在不同Effort设置下测出的。追求更快响应速度的用户还可以开启Fast模式,推理速度约为默认模式的2.5倍,价格则提高至两倍。
这种多维度的弹性定价设计,把算力预算的选择权交给了客户:想要Fable级别的智能?可以,但愿意等多久、花多少钱,由用户决定。
此外,Anthropic同步上线两项仍处于测试阶段的更新:对话中途无缝更换工具,不让之前的提示词缓存失效;API请求触发安全分类器后不再直接报错,而是自动回退至Opus 4.8继续处理,应用不会卡死。这些细节优化,进一步降低了开发者的使用门槛。
外部竞争与商业策略调整
Opus 5的发布,发生在全球大模型市场竞争加剧的背景下。
一方面,今年6月Fable 5上线之后,市场反响不及预期。高昂定价与巨大的令牌消耗,再加上Anthropic频繁以安全为由对模型能力进行限制,这款性能最强的旗舰收获了最多的用户反馈。另一方面,开源阵营的性价比攻势迅猛——业内重磅开源模型Kimi K3拥有2.8万亿参数,性能对标Fable 5与GPT-5.6 Sol,定价却大幅更低。马斯克评价Kimi K3"令人惊艳",随后又用相同评价形容Opus 5。
多重压力下,Anthropic用Opus 5明确了自身结构性市场策略的调整:从"性能天花板"叙事,转向"高性价比"叙事。
重新定义"够用"的标准
Opus 5真正值得关注的,不在于低价策略本身,而是它重新定义了何为"够用"。
过去,大模型定价逻辑依托"性能天花板"这套叙事:想要最强性能,就必须承担最高溢价。Opus 5的出现改写了这一逻辑——当一款次旗舰模型以半价在绝大多数基准测试中追平乃至超越旗舰,顶尖性能附带的溢价空间必然受到挤压。
AI竞赛也从"参数军备"转向"性价比之战"。当行业从"谁能跑分最高"变成"谁更值得买单",Anthropic用Opus 5给出了一个务实的答案:别追顶配,够强够省才是王道。
📌 产业视角:对于希望第一时间接入Claude Opus 5及其他全球主流大模型的开发者与企业,UseAIAPI提供Gemini、Claude、ChatGPT、DeepSeek等最新模型的稳定接入服务,优惠折扣最低可达官方价格的50%,并提供企业级定制化接入方案。在高强度内容生成与智能体编排场景下,这一权益能够有效降低令牌消耗压力,让开发团队更专注于业务本身,而不必在"调用最强模型"与"控制成本"之间反复权衡。
从Opus 4.8到Opus 5,Anthropic用一次"定价不变、性能翻倍"的升级,回答了业界关于"次旗舰是否值得选用"的疑问。而对于整个行业来说,当半价模型能够在多数测试中追平旗舰,所有厂商都需要重新核算自己的商业账本。
这或许才是Opus 5发布最深远的意义——它不是一场简单的价格战,而是一次定价哲学的宣告:在模型性能差距持续收敛的时代,真正的竞争力,在于让用户每投入一美元,都能买到与之匹配的智能。