← 返回 Blog

Fable5 需求爆表超出预期,Anthropic 承认:我们在加速扩容

7 月 18 日,Anthropic 在社交平台 X 发布一则公告,语气平实:"自 7 月 20 日起,Claude Fable 5 将继续保留在 Max 与企业尊享套餐内,但用户可用额度减半。" 这份平静措辞的背后,是过去三周 Anthropic 被 Fable 5 的需求洪峰推到算力墙边的真实窘境。

ClaudeClaude Fable 5

Fable 5 需求爆发,Anthropic 公开承认:正在全速扩容算力

7 月 18 日,Anthropic 在社交平台 X 发布一则公告,语气平实:"自 7 月 20 日起,Claude Fable 5 将继续保留在 Max 与企业尊享套餐内,但用户可用额度减半。"

这份平静措辞的背后,是过去三周 Anthropic 被 Fable 5 的需求洪峰推到算力墙边的真实窘境。

"需求难以预估":官方话术下的算力缺口

Anthropic 在公告里写:"Fable 系列的用户需求始终无法预判,这也是我们分阶段管控订阅调用权限、每次新增算力就延长使用窗口期的原因。"

翻译过来意思清楚——造出了一款性能顶尖的模型,却没料到需求爆成这样,服务器已经满载

法国科技媒体 Korben 的标题说得更直:"Fable 5 太火爆,Anthropic 算力跟不上。"自 7 月 1 日 Fable 5 解禁重上线,Anthropic 就陷入一个循环:设截止日 → 需求涨 → 被迫延期。原定 7 月 7 日收回权限,推迟到 7 月 12 日;7 月 12 日再延到 7 月 19 日。每一次延期,都在印证同一件事:算力缺口比预想的大

预测交易平台 Polymarket 上,交易员一度给出 77% 的概率,押 Anthropic 会第四次推迟限流。

Fable 5 的算力消耗为何格外高

这不是一次普通迭代。Fable 5 是 Anthropic 2026 年 6 月推出的 Mythos 超旗舰层级模型,定位高于 Opus 旗舰档,核心优势不在闲聊,而在处理更长、更复杂、可异步执行的重型任务。官方表述是:任务越复杂、执行链路越长,Fable 5 相对其他模型的领先越明显。

强悍能力的代价是算力。Fable 5 采用自适应推理架构,每个词元消耗的算力都明显高于 Opus 4.8。行业测算显示,其 GPU 需求量已超出 Anthropic 自有基础设施的承载上限。

API 定价也佐证了这点:每百万输入词元 10 美元、输出词元 50 美元,为 Opus 4.8 的两倍,是 Anthropic 目前在售最贵档位。

扩容已在路上,但来不及马上交付

Anthropic 发言人 Rim Ateyeh 7 月 9 日表态:只要算力允许,Fable 5 会留在订阅套餐内,公司会"尽快"恢复完整额度。

这不是空话。据行业披露:

  • 博通联合阿波罗全球管理、黑石搭建 AI XPV 算力平台,首期投入 350 亿美元,支撑 Anthropic 扩建超 1 吉瓦算力集群;三方规划到 2028 年,为前沿 AI 实验室累计部署超 20 吉瓦

  • Anthropic 与 SpaceX 达成独家合作,全盘租用 Colossus 1​ 超算数据中心,集群规模超 300 兆瓦,搭载 22 万块英伟达 GPU

但算力基建不是签约即交付。扩容完工前,Anthropic 唯一能做的,是先收紧调用权限、把需求压下来

"全速扩容"与"额度减半"的悖论

于是一个反差现实的画面出现了:同一份公告里,Anthropic 一边说"持续投入扩充算力",一边承认 Fable 5 实际可用额度已被压到调整后总配额的一半。

意大利科技媒体 Digital Today 点破本质:限流是为了管住激增需求,算力到位后再逐步放开,二者是同一件事的两个阶段——先限流止损,再算力输血

行业观察人士指出,这件事折射出 AI 规模化落地阶段的共性矛盾:模型需求增速、算力供给能力、商业化定价体系三者失衡。模型越强,单次推理成本和 GPU 负载越高,头部厂商未来大概率会普遍采用"限量供给高端旗舰"的模式。

Fable 5 爆发不是偶然,是全行业信号

Anthropic 称需求"难以预判",但回头看情理之中:一款在几乎所有权威评测都居首、软件工程和深度知识工作表现断层领先的模型,用户必然会大规模复用。

真正"预判失误"的,是公司低估了自家产品的吸引力,同时高估了自有算力储备。Fable 5 井喷不是个例,而是全行业结构性痛点——大模型智能迭代速度快于算力基建,用户需求增长快于底层扩容节奏

Anthropic 在推文末尾写:"感谢大家过去几周的耐心,我们持续加码新算力,有新进展第一时间同步。"

潜台词很直白:请先别走,我们在加急建算力"工厂"。

但摆在面前的问题是——那些排队等完整额度的用户,能撑到集群全部落地的那天吗?

额度减半的窗口里,国内团队还有另一条接法

对真把 Fable 5、Opus 4.8、GPT-5.6 Sol 这类旗舰跑在生产链路里的团队来说,7/20 之后订阅这条路基本被砍了两刀——Max 额度减半、Pro 直接踢去 API 按量。按 Anthropic 官方价,每百万输出 50 美元,一趟挂子智能体的复杂任务近 90 美元,月度账单比 Max 月费本身还高。

这也是最近一批 Claude 重度用户换接法的原因——模型还用 Anthropic 的,接入层不走官方那条紧绷的路。比如 UseAIAPI 这类聚合接入,把 Gemini、Claude、ChatGPT、DeepSeek 等最新模型打成同一套接口,团队按量走官方源,不用被"先砍 33%、再取 50%"那套减量游戏绑住;价格能做到官方定价的 5 折左右,对应前述那趟 90 美元的任务,走这边大约 45 美元——相当于在 Anthropic "额度减半"的周期里,把购买力悄悄拉回原位。

📌 对中小团队更务实的一点:不用逐家去海外开卡、过合规、配额度告警,国内直充 + 企业级定制接入,同一套 key 在 Claude / Gemini / DeepSeek 之间切,Fable 5 跑不顺就切 Opus 或 Gemini 接着干,比死等 Anthropic 扩容完工从容。

Anthropic 在加急建"工厂"。但对国内用户来说,不用把所有希望押在那座工厂的完工日——接入层灵活一点,这 3–6 个月的额度荒,就能过得不那么狼狈。