← 返回 Blog

炸场!Claude Opus 5 以一半价格反超旗舰 Fable 5,Anthropic 的定价牌局被打乱了

2026年7月24日,Anthropic 正式发布新一代 Opus 系列模型 Claude Opus 5。按照惯常的产品迭代节奏,Opus 5 本应是 Opus 4.8 的常规升级,充当介于 Sonnet 与 Fable 之间的中端主力。然而,随着官方评测数据的公布,整个行业的定价坐标系被重新校准。

ClaudeClaude Opus 5 发布

自家人掀翻自家牌桌:Claude Opus 5 发布,重新定义高端大模型定价逻辑

2026年7月24日,Anthropic 正式发布新一代 Opus 系列模型 Claude Opus 5。按照惯常的产品迭代节奏,Opus 5 本应是 Opus 4.8 的常规升级,充当介于 Sonnet 与 Fable 之间的中端主力。然而,随着官方评测数据的公布,整个行业的定价坐标系被重新校准。

定价持平,性能跨越

Opus 5 的定价为每百万输入令牌 5 美元、每百万输出令牌 25 美元,与 Opus 4.8 完全持平。作为对照,旗舰模型 Fable 5 的定价为输入 10 美元、输出 50 美元,恰好是 Opus 5 的两倍。

值得注意的是,在官方公布的评测中,Opus 5 在多项核心指标上展现出明显提升。在 Frontier-Bench v0.1 编程评测中,其表现是 Opus 4.8 的两倍以上;在 CursorBench 3.2 最高努力档位下,Opus 5 与 Fable 5 的峰值分差不足 0.5 个百分点,但单任务成本仅为 Fable 5 的一半。

更具标志性意义的是 ARC-AGI 3 评测。该基准由弗朗索瓦·肖莱主持设计,专门用于检验模型解决"从未见过的新问题"的流体智能,被视为最难造假的认知测试之一。根据官方公布的数据,Opus 5 在该项评测中取得的成绩是次优模型的 3 倍。

此外,在 Zapier AutomationBench 自动化基准中,以相同单任务成本计,Opus 5 的通过率约为次优模型的 1.5 倍;在 OSWorld 2.0 计算机操作基准中,同等成本下表现最优。

Anthropic 的产品层级重构

Opus 5 的发布,伴随着 Anthropic 对整个 Claude 产品矩阵的角色重排。

目前,Opus 5 已成为 Claude Max 的默认模型,也是 Claude Pro 用户能够调用的最强版本。Fable 5 主要面向 API 与企业大客户开放,个人订阅用户虽然可以访问,但调用额度受到严格限制。换言之,Anthropic 将 Opus 5 推向前台担任主力,而将 Fable 5 逐步转向企业专属的高端选项。

这种产品布局的背后,是定价逻辑的深刻转变。Fable 5 于 6 月 9 日发布,作为"神话级"(Mythos)模型,其高定价建立在"性能天花板"的叙事之上。然而仅 45 天后,Opus 5 以一半价格在多项评测中追平甚至超越旗舰,使得"神话级"高溢价的合理性受到挑战。

Anthropic 在官方博客中表述 Opus 5 以半价提供接近 Fable 5 的前沿智能,但官方公布的对比图表显示,该模型在多项核心评测中已实现领先。这种"话术上接近、数据上超越"的微妙姿态,本身就构成了对旧有定价体系的无声消解。

多维定价与开发者友好机制

除了基础定价外,Anthropic 同步上线了多项配套机制,进一步降低使用门槛:

Fast 模式:推理速度提升至默认模式的 2.5 倍,价格为基础价的 2 倍,为开发者提供速度与成本之间的弹性选择。

Effort 可调参数:用户可根据任务难度调节推理资源投入,在极致智能与令牌开销之间灵活取舍。

两项 Beta 功能:对话中途切换工具不会导致提示词缓存失效;API 请求触发安全拦截时,系统自动降级调用 Opus 4.8,而非直接报错,避免了 Agent 任务因缓存失效抬升成本,或因安全拦截中断的风险。

在安全层面,Anthropic 表示 Opus 5 是迄今对齐程度最高的模型,整体失准行为评分 2.3,为近期模型最低值,配套安全分类器的触发频次较 Fable 5 显著降低,对话体验更加流畅。

风险边界与定位厘清

需要客观指出的是,Opus 5 并未在所有维度超越 Fable 5。在生物研究和进攻性网络安全等高风险特定场景中,能力更强的 Mythos 5 仍然保持领先。在 OSS-Fuzz 网络漏洞评测中,Opus 5 在发现漏洞方面已接近 Mythos 5,但在编写漏洞利用代码阶段仍明显落后。

Anthropic 明确表示,Opus 5 不推进高风险双重用途能力的前沿。这一边界的厘清,有助于行业理性看待"次旗舰超越旗舰"的真正含义——它发生在日常高频使用的编程、知识工作、智能体编排等场景,而非高风险特殊领域。

行业定价锚点的重置

Opus 5 的发布,本质上是一次行业定价锚点的重置。当一款次旗舰模型以一半成本在绝大多数日常基准测试中追平乃至超越旗舰,"顶尖性能必然对应顶尖价格"的逻辑链条被打破。

对于开发者和企业用户而言,这意味着在不牺牲智能水平的前提下,模型调用的单位成本显著下降。在编程、Agent 编排、复杂知识工作等高频场景中,Opus 5 提供了同价位下极具竞争力的选项。

💡 产业落地提示:对于希望第一时间接入 Claude Opus 5 及其他全球主流大模型的开发者与企业,UseAIAPI 提供 Gemini、Claude、ChatGPT、DeepSeek 等最新模型的稳定接入服务,优惠折扣最低可达官方价格的 50%,并提供企业级定制化接入方案,能够有效降低高强度内容生成与智能体编排场景下的令牌消耗压力,让开发团队更专注于业务本身而非基础设施成本。

从 Opus 4.8 到 Opus 5,Anthropic 用一次"定价不变、性能翻倍"的升级,回答了业界关于"次旗舰是否值得选用"的疑问。而对于整个行业来说,当半价模型能够在多数测试中战胜旗舰,所有闭源厂商都需要重新核算自己的商业账本。

这或许才是 Opus 5 发布最深远的意义——它不是一场简单的价格战,而是一次定价哲学的宣告:在模型性能差距持续收敛的时代,真正的竞争力不在于"我能做多强",而在于"用户每花一美元能买到多少智能"。