
旗舰模型"卖太火"也是一种错?Fable 5 三调权限背后:算力供给跟不上需求
Anthropic 日前在社交平台 X 发布公告:"自 7 月 20 日起,Claude Fable 5 将保留在所有 Max 套餐与企业尊享套餐内,但可用额度缩减至原有 50%。"
这段话表面像利好,深究更像一份自白——公司造出了顶尖模型,却扛不住配套算力成本。
6 月初 Fable 5 上线时,Anthropic 姿态还很强:API 定价每百万输入词元 10 美元、输出词元 50 美元,是 Opus 4.8 的两倍,旗舰定位鲜明。可短短六周,这款模型的订阅政策连调三次,每一次都是 Anthropic 在"算力不足"四个字面前被迫退让。
第一次调整:7 月 7 日,计划彻底移出订阅
Fable 5 的坎坷从发布第三天就开始了。6 月 12 日,美国政府出口管制令要求暂停境外用户访问 Fable 5 与 Mythos 5,Anthropic 全球下架两款模型,断服 19 天。
7 月 1 日恢复上线,Anthropic 最初定的方案是:7 月 7 日前,所有付费用户最多拿 50% 周额度调 Fable 5;7 月 7 日后,该模型彻底从全部订阅套餐移除,统一改 API 按量计费。
官方说辞直白得近乎残酷:"Fable 5 市场需求暴涨且不可预估,现有算力承压。"翻译过来——用户调得太多,算力扛不住了。
第二次调整:7 月 12 日,延期一周
7 月 7 日到期,Anthropic 没执行,改到 7 月 12 日。
转折点在外围:7 月 9 日 OpenAI 推 GPT-5.6 Sol,性能对标 Fable 5,定价仅约后者三分之一。如果 Anthropic 这时把 Fable 5 踢出订阅,等于把高端用户亲手推给 OpenAI。
行业评论人 Simon Willison 点过这层矛盾:"如果订阅不含自家最强模型,用户凭什么每月付 100–200 美元?" Anthropic 算清了账——留 Fable 5,才能留 Max 现金流;下架,等于自断一臂。
于是延一周。
第三次调整:7 月 19 日,再延一周
7 月 12 日又到,Anthropic 再推迟,顺到 7 月 19 日。
新一轮冲击来了:7 月 16 日月之暗面发 2.8 万亿参数 K3,API 单价同样不到 Fable 5 三分之一。Axios 的问很直接:"美国 AI 厂商靠前沿旗舰收高服务费的模式,还能持续多久?"
Anthropic 彻底两难——Fable 5 需求继续爆,算力缺口没缓解,竞品却以三分之一价抢市场。下架是死路,保留也举步维艰。
最终落地:额度减半,换喘息
7 月 18 日出折中方案:
Max、企业尊享:订阅内可继续调 Fable 5,额度砍半;
Pro、企业标准:订阅内权限取消,仅发 100 美元一次性 API 额度补偿。
100 美元能用多久?按 Fable 5 的 API 价,开发者实测一趟挂大量子智能体的复杂任务,单次成本就近 90 美元,重度用户半天烧完。
Anthropic 在推文里承认:"Fable 系列的用户需求始终难以预估。"潜台词——模型造出来了,配套算力我们自己也供不起。
旗舰模型的宿命枷锁
Fable 5 的困境不是个案,是行业结构性矛盾的产物。
模型采用自适应推理架构,单词元算力消耗明显高于 Opus 4.8,耗订阅额度的速度也快于 Claude 旗下其他模型。行业测算,其 GPU 需求量已突破 Anthropic 自有基础设施承载上限。据披露,Anthropic 当前算力支出是人力薪资的 2.3 倍,折算平均每名工程师对应年度算力开销约 51.5 万美元。
大环境也在加压。华泰证券研报指出,2026 年上半年全球算力短缺有明确诱因——软件开发赛道迎来 PMF 拐点,需求集中爆发。Fable 5 在 AI 综合能力榜单居首,性能越强,算力消耗越高,供需缺口越拉越大。
Anthropic 已在扩:据行业报道,博通联合阿波罗全球管理、黑石搭 AI XPV 算力平台,首期 350 亿美元,帮 Anthropic 新增超 1 吉瓦;同时与 SpaceX 合作,全盘租 Colossus 1 数据中心——22 万块英伟达 GPU、功耗超 300 兆瓦;此外还在和 Meta 谈百亿美元级算力租赁。但远水解不了近渴,大集群落地还得等。
"产品大卖"怎么反倒成了麻烦
Fable 5 的遭遇,揭了 AI 行业一个有点荒诞的现实——旗舰模型太火,本身会变成厂商的负担。恶性循环的链很清楚:
用户争调用 → 算力负载爆 → 厂商限流、砍额度、分层清人 → 体验下滑,用户流向低价竞品 → 厂商被迫再收紧。
Anthropic 三次调权,始终困在这圈里。本想靠 Fable 5 的性能筑护城河,结果河挖太深,快把自己淹了。
法国科技媒体 Korben 的标题说得准:《Fable 5 人气爆棚,Anthropic 算力跟不上》。一家 AI 公司被自家最成功的产品拖累——大概是这行最甜蜜、也最残酷的那类黑色幽默。
额度荒的这几个月,国内团队还能怎么接
对真把 Fable 5、Opus 4.8、GPT-5.6 Sol 这类旗舰铺到生产链路里的团队来说,7/20 之后订阅这条路基本被砍了两刀——Max 额度减半、Pro 直接踢去 API 按量。按 Anthropic 官方价,每百万输出 50 美元,一趟子智能体复杂任务近 90 美元,月度账单很容易超过 Max 月费本身。
Anthropic 自己在租 Colossus 1、在和 Meta 谈百亿美元算力租赁救火,可大集群落地要周期——这 3–6 个月额度荒,国内团队等不起。
这也是最近一批 Claude 重度用户换接法的起因:模型还用 Anthropic 的,接入层不走官方那条紧绷的路。比如 UseAIAPI 这类聚合接入,把 Gemini、Claude、ChatGPT、DeepSeek 等最新模型打成同一套接口,团队按量走官方源,不用被"先砍 33%、再取 50%"那套减量游戏绑住;价格能做到官方定价的 5 折左右——对应前文那趟 90 美元的任务,走这边大约 45 美元,相当于在 Anthropic 扩容完工前,把购买力悄悄拉回原位。
📌 对中小团队更务实的点:不用逐家去海外开卡、过合规、配额度告警,国内直充 + 企业级定制接入,同一套 key 在 Claude / Gemini / DeepSeek 之间切,Fable 5 跑不顺就切 Opus 或 Gemini 接着干,比死等 Anthropic 算力集群落地从容。
法国人那句"人气爆棚却算力跟不上",说的是 Anthropic 的窘境;但对用模型的人来讲,窘境的解法不一定非得绑在厂商的扩容时间表上。