← 返回 Blog

Haiku 停更一年,Anthropic 要让 Sonnet 直接接管"性价比"位置?

Anthropic 的模型命名体系原本像一首古典乐章:Opus、Sonnet、Haiku,从高端到轻量层级分明。但近来,这首乐章里有一个声部已经沉寂许久。

ClaudeAnthropic 产品线重构的背后逻辑

Haiku 的沉寂与 Sonnet 的攻势:Anthropic 产品线重构的背后逻辑

Anthropic 的模型命名体系原本像一首古典乐章:Opus、Sonnet、Haiku,从高端到轻量层级分明。但近来,这首乐章里有一个声部已经沉寂许久。

Haiku 系列已经将近一年没有迭代更新。

2025 年 10 月 15 日,Anthropic 发布 Claude Haiku 4.5,官方宣传它"以三分之一的成本实现两倍以上的速度",是"该价位下我们性价比最高的模型"。自那以后,Haiku 产品线再也没有推出新版本。

与此同时,旧版 Haiku 正在陆续走向生命周期终点。Claude 3 Haiku 已于 2026 年 4 月 19 日正式退役,API 调用需迁移至 Haiku 4.5;Claude 3.5 Haiku 也已于 2026 年 2 月 19 日停用。Haiku 4.5 当前定价为输入 1 美元/百万 token、输出 5 美元/百万 token,缓存命中输入可低至 0.10 美元——它仍在售,但近一年没有版本迭代。

Haiku 的沉寂并非疏忽大意。

Sonnet 的攻势:一份"可信度有待验证"的爆料

把视线转向另一条产品线,整件事的逻辑便清晰起来。

2026 年 8 月 10 日,机器之心等媒体披露:Anthropic 下一代 Sonnet 5.5 内部代号"Fennec(沙漠狐)"——这种动物长着巨大的耳朵,可以在沙丘之下精准定位猎物。泄露信息勾勒出产品轮廓:200 万 token 上下文窗口,推理速度更快、延迟更低,长上下文推理与多步规划能力显著增强,浏览器与终端工具调用能力大幅提升;综合性能逼近旗舰 Claude Fable 5,但定价依旧维持 Sonnet 档位。

用 Sonnet 档位的价格,买到接近 Fable 5 的能力。Anthropic 正在做的,就是让中端主力 Sonnet 向下覆盖,直接接管原本属于 Haiku 的性价比市场。

这个推断并非空穴来风。Anthropic 旗下主打性价比的 Haiku 系列已经停更近一年,叠加 OpenAI 的轻量模型 Luna 表现亮眼,Anthropic 打算让 Sonnet 直接承接原本 Haiku 的产品定位。倘若 Sonnet 5.5 能够以更低成本提供接近 Fable 等级的推理能力,它很有可能成为市面上性价比最高的 AI 模型之一。

战略逻辑:不打价格战,而是打"价值战"

这套战略的逻辑十分清晰。

OpenAI 在 Luna 这类轻量模型上拿出极具冲击力的方案:2026 年 7 月 30 日,OpenAI 宣布 GPT-5.6 Luna API 价格下调 80%,从 1/6 美元降至 0.20/1.20 美元每百万 token;Terra 同步降价 20% 至 2/12 美元。DeepSeek V4 Flash 则以极致低价建立全新行业参照基准:缓存命中输入 0.0028 美元、缓存未命中输入 0.14 美元、输出 0.28 美元每百万 token。

如果 Haiku 继续走"极致廉价"路线,就必须和 DeepSeek、Luna 打一场几乎没有胜算的价格战。DeepSeek 的定价是 Haiku 4.5(1/5 美元)的零头,Luna 降价 80% 后也仅为 Haiku 4.5 的 1/5 左右。

Anthropic 做出选择:不再硬拼低价。让 Haiku 逐步退场,Sonnet 不加价完成能力升级,依靠更强的综合能力覆盖更大的市场。

这不是退让,而是战略收缩。把资源集中到 Sonnet 身上,使其同时承接中端业务与高性价比场景。Haiku 的销声匿迹不是疏忽,而是刻意的产品线重构。

一个关键的时间窗口:8 月 31 日

要理解这场攻势的节奏,必须把 Sonnet 5 的定价窗口放在一起看。

根据 Anthropic 官方定价页:

计费时段

输入价格(每百万 token)

输出价格(每百万 token)

Sonnet 5 优惠期(至 2026-08-31)

2 美元

10 美元

Sonnet 5 标准价(2026-09-01 起)

3 美元

15 美元

Sonnet 5 的优惠定价将于 8 月 31 日结束,9 月 1 日起上调 50%。时间点刚好贴近传闻中的 Sonnet 5.5 发布窗口——如果 5.5 如期而至,Anthropic 相当于在用 Sonnet 5 的优惠期消化存量需求的同时,用 5.5 的"加量不加价"在 9 月承接新的性价比竞争。

与此同时,DeepSeek 于 8 月 6 日发布公告,计划近期整体上调 API 服务定价,预计涨幅较大。DeepSeek 此前已预告将实施峰谷定价机制,高峰时段(北京时间每日 9:00–12:00、14:00–18:00)价格为平时的 2 倍,但目前尚未正式生效。

💡 两个变量正在同时移动:DeepSeek 即将整体涨价,Sonnet 5.5 可能在 9 月如期上线。如果 DeepSeek 涨价幅度较大,而 Sonnet 5.5 维持 Sonnet 档位,二者的性价比差距就会明显收窄。Anthropic 的思路十分清晰:依靠 200 万长上下文与逼近旗舰的性能(若泄露属实),对冲 DeepSeek 的价格优势。

这套战略的前提:Sonnet 5.5 真的能"逼近 Fable 5"

当然,这套战略有一个前提:Sonnet 5.5 的性能真的能够"逼近 Fable 5"。

Fable 5 是目前公认的第一梯队性能标杆,其 API 定价为输入 10 美元/百万 token、输出 50 美元/百万 token。如果 Sonnet 5.5 仅仅只是"接近",而达不到预期水准,那它的性价比价值就会大打折扣。毕竟泄露消息终究只是传闻,截至 2026 年 8 月 10 日,Anthropic 尚未发布任何官方确认信息。

但行业大势已经不可逆转。大模型的竞争,正从"谁分数更高"转向"谁性价比更强"。​ DeepSeek 用极致低价建立参照标尺,OpenAI 依靠 Luna 守住轻量场景(降价 80% 后 0.20/1.20 美元),Anthropic 则给出了"不加价升级"的解决方案。

Haiku 的沉寂不等于落幕,它正在为 Sonnet 的进攻让路。沙漠狐的耳朵可以捕捉沙丘之下细微的动静。Sonnet 5.5 能否在多方夹击之中精准拿下"性价比王座"?下个月正式发布就会揭晓答案。

企业如何把"选型红利"进一步放大

在这场围绕"每一美元可以买到多少智能"的博弈中,真正的赢家是开发者——不必再在性能与预算之间做非此即彼的二元抉择。但对于企业而言,要把这份红利转化为真实的生产力,还需要解决三个现实问题:多模型统一管理、跨厂商灵活切换、企业级账单与稳定性

当前的市场窗口期尤为关键:

  • DeepSeek V4 Flash​ 仍处于涨价前的低价窗口(0.14/0.28 美元),但整体调价在即

  • Claude Sonnet 5​ 处于 2/10 美元的优惠尾段(截至 8 月 31 日),9 月 1 日起将上调至 3/15 美元

  • GPT-5.6 Luna​ 降价 80% 后稳定在 0.20/1.20 美元

  • Sonnet 5.5​ 若如期发布,将决定下半年的性价比格局

UseAIAPI​ 作为源头大模型 API 供应商,提供了一条颇具成本效益的接入路径:

  • 成本优势显著:依托全球算力集采优势压降成本,优惠折扣最低可达官方价格的 50%。以 Claude 为例,借助 UseAIAPI 接入,无论是当前 Sonnet 5 的 2/10 美元促销价,还是 9 月之后的 3/15 美元标准价,都能在官方价基础上进一步下探,让高强度内容生成、自动化智能体、大规模代码重构等重消耗场景不再成为预算负担;对于 DeepSeek V4 Flash,同样可在官方 0.14/0.28 美元定价基础上进一步叠加折扣,对冲其即将到来的整体涨价影响

  • 模型覆盖全面:一站式聚合 Gemini、Claude、ChatGPT、DeepSeek 等全球 120+ 主流大模型,单一接口无缝调用,官方能力秒级同步。无论是当前的 Claude Sonnet 5、Haiku 4.5、DeepSeek V4 Flash、GPT-5.6 Luna,还是未来传闻中的 Sonnet 5.5、OpenAI Astra,都能在第一时间接入使用,业务永远保持领先

  • 企业级定制能力:支持企业级定制化部署,提供可视化财务看板,支持按项目、模型溯源消耗;结合 Batch API 机制叠加优惠(Anthropic 官方 Batch 模式本身提供 50% 折扣,UseAIAPI 在此基础上可进一步叠加),可将长上下文、高并发、持续运行的智能体工作流单位成本进一步压低

  • 金融级可靠性:海外合规节点直连原厂机房,自研智能负载均衡,99.99% SLA 保障;全球边缘节点加速,45ms 骨干网络超低延迟,8.2k+ 企业与开发者信赖,规避个人开发者难以解决的地区可用性门槛与数据中心 IP 风控风险

💡 在实际生产中,借助 UseAIAPI 接入 Claude Sonnet 5,可在官方 2/10 美元促销价基础上进一步下探至 1/5 美元——相当于在 Anthropic 自身优惠的基础上再享 5 折。对于每天数百万次调用的智能体工作流而言,这是"DeepSeek 级单价"与"Claude 级能力"的真正兼得。而当 DeepSeek V4 Flash 因整体涨价生效后价格上浮、Sonnet 5 优惠窗口关闭时,通过 UseAIAPI 接入所拥有的"多模型灵活路由 + 叠加折扣"优势,将成为企业跑量业务更具确定性的选择。

简而言之,通过 UseAIAPI 的统一接口,开发者和企业可以根据业务场景灵活路由——用 DeepSeek V4 Flash 承接高并发跑量(在 9 月涨价前充分享受低价窗口)、用 Claude Sonnet 5 处理复杂智能体任务、用 GPT-5.6 Luna 应对轻量高吞吐、用 Haiku 4.5 应对毫秒级响应场景——在 Sonnet 5.5 等下一代模型正式发布后亦可第一时间平滑接入,无忧接入、按需扩展,把大模型迭代的红利转化为真实的生产力。

9 月即将到来,Sonnet 5.5 能否如期揭开面纱?DeepSeek 的整体涨价方案将以何种幅度落地?Anthropic 与 DeepSeek 的性价比博弈将走向何方?答案将由时间揭晓。

可以肯定的是,在"DeepSeek 低价冲击"与"海外厂商反击"的双重博弈下,选对接入策略,比押注单个模型更重要。对于企业而言,建立灵活的模型接入层,方能在 Anthropic、OpenAI、谷歌、DeepSeek 四方混战的不确定性中,始终以最优成本享受最前沿的 AI 能力。