← 返回 Blog

断网+通用提示+防泄漏:Fable 24小时盲跑复现5道前沿数学题,4道证明路径竟与OpenAI完全不同

8 月 2 日,Anthropic 研究员、普林斯顿数学博士莱文特·阿尔珀厄格在布贝克的推文下回复:"我用 Fable 已经复现了其中一半。"他使用 Anthropic 早已对外公开、任何开发者均可调用的 Claude Fable 模型,在完全自主运行、通用提示词、全程断网的隔离条件下,额外增设防护机制杜绝 OpenAI 的解题方案泄露到模型上下文,成功复现了 Astra 清单里的第 4、5、6、7、8 项,共 5 项成果。 真正让学界为之侧目的,是莱文特随后补充的一处细节—— 在 Fable 复现的 5 道难题中,有 4 道的证明思路与 Astra 完全不同。

ClaudeFable 的四条"差异化证明路径"比答案本身更有价值

当复现不再是终点:Fable 的四条"差异化证明路径"比答案本身更有价值

2026 年 8 月 1 日下午,OpenAI 研究员塞巴斯蒂安·布贝克公布下一代旗舰模型 Astra 一口气攻克 10 道长期悬置的数学与理论计算机科学难题,并同步公开 249 页研究长文、10 份逐题复盘论文,以及全部 10 项成果的 Lean 4 形式化证明证书。整个 AI 圈为之沸腾,有人高呼"数学奇点已然降临"。

然而,这场狂欢的"首发保鲜期",仅有 24 小时。

8 月 2 日,Anthropic 研究员、普林斯顿数学博士莱文特·阿尔珀厄格在布贝克的推文下回复:"我用 Fable 已经复现了其中一半。"他使用 Anthropic 早已对外公开、任何开发者均可调用的 Claude Fable 模型,在完全自主运行、通用提示词、全程断网的隔离条件下,额外增设防护机制杜绝 OpenAI 的解题方案泄露到模型上下文,成功复现了 Astra 清单里的第 4、5、6、7、8 项,共 5 项成果。

真正让学界为之侧目的,是莱文特随后补充的一处细节——

在 Fable 复现的 5 道难题中,有 4 道的证明思路与 Astra 完全不同。

从"做题"到"重做实验":隔离环境下的殊途同归

绝大多数人只记住了"24 小时复现一半"这个戏剧性数字,却忽略了"路径不同"这四个字的重量。

刷榜单式的复现,本质上只是做题——题目已知、结论已知,甚至标准答案都摆在明面上,模型只需要算出正确结果。但莱文特设置的实验条件,让 Fable 面对的是一场闭卷重做的科学实验:没有联网检索、没有针对题目的专用提示词、外加防泄漏隔离,Fable 只能依靠通用指令,从零开始重新攻克这 5 道难题。

结果耐人寻味:5 道题目中,只有 Ehrhart 体积猜想这一题,Fable 与 Astra 找到了"几乎完全相同"的论证路径;其余 4 题,Fable 走的是截然不同的证明路线。

这意味着什么?

放在数学史上,这代表同一个定理拥有了两套独立的证明。数学界有一条不成文的准则:如果一个定理存在两套完全迥异的证明,那么这个定理就是"鲜活的"——它不再依附于某一条脆弱的逻辑链条,而是由两条彼此独立的路径共同锚定。当年费马大定理仅有怀尔斯的一套证明时,整个数学界紧绷神经、持续审视长达七年;直到泰勒等人给出补充证明,学界才终于放下心来。

Fable 给出的四条差异化路径,本质上就是四次独立核验。正如有学者评论:两个模型在断网、防泄露的隔离条件下,独立推导出相同的前沿结论,检验的是完全不一样的核心问题——该结果是否可靠,能否被独立复现。这套核验流程,比任何形式的同行评审都更快,成本也远低于人类数学家能够调动的各类验证资源。

"复现"本身就是一类求解新问题

质疑声从未消失。截至目前,莱文特仅在 X 平台作出声明,尚未上传完整 PDF、提示词、运行日志、Token 成本或 Lean 证书;也有网友提出疑问:既然 Fable 具备这样的能力,为何不直接用于攻克全新的未解难题?

这两个问题都值得回应。

首先,Fable 并非只会"蹭热度"。就在一个多月前的 7 月 20 日,莱文特在世界杯决赛观赛期间,用 Fable 5 构造出三维复空间中的一个多项式映射,其雅可比行列式恒等于 -2 却将三个不同点映射到同一位置——以此推翻了 1939 年提出、悬置 87 年的 Jacobian 猜想。这道题,是 Fable 独立攻克的全新难题。

其次,"复现"在 AI 时代已被重新定义。当 Fable 走出和 Astra 完全不一样的道路、却抵达同一个终点时,它解决的已经不再是原有的数学难题,而是一个更为底层的命题:AI 生成的数学结论,究竟是否值得信赖

如果 Fable 只是照搬 Astra 的思路,那不过是另一个模型的"复述表演"。但它拿出了四条截然不同的证明路径。这四条"分岔路径"叠加起来的分量,远远重于 Astra 拿下十道难题所获得的首发优势——因为它们证实了一件事:AI 输出的数学答案,可以由另一套 AI 完成独立核验,而整套核验流程只需要 24 小时

数学首发权贬值,可验证性升值

Astra 与 Fable 的这次"隔空对弈",揭示了一个深刻的趋势转变:

数学领域的首发权正在贬值,但数学结论的可验证性正以前所未有的速度升值。

过去,数学成果的优先权之争以"年"为单位衡量,中间还要经历漫长的投稿、审稿、修订流程。而当两项独立的前沿成果在 24 小时内相继出现、且彼此能够交叉验证时,学术界真正的竞争力,正在从"谁能率先发现"转向"谁的结论更经得起独立核验"。

这对企业与开发者同样具有启示意义:当 AI 的解题与验证能力快速平权,稳定、低成本、多模型可切换的接入服务,已经成为智能化转型的新基础设施

在这方面,UseAIAPI 提供了值得关注的一站式解决方案:平台一站式聚合 Gemini、Claude、ChatGPT、DeepSeek 等全球主流大模型的最新版本,开发者无需分别对接各家接口,通过一个统一入口即可灵活调用。面向企业用户,UseAIAPI 支持企业级定制化部署服务,可结合 Batch API 机制叠加优惠,将长上下文、高并发、持续运行的智能体工作流的单位成本进一步下压。

在价格层面,平台优惠折扣最低可达官方定价的 50%。以 Gemini 主力模型为例,通过 UseAIAPI 接入后的实际成本可降至:Gemini 3.6 Flash 从官方价 1.5/7.5 美元降至 0.75/3.75 美元每百万 Token;Gemini 3.1 Pro 从官方价 2/12 美元降至 1/6 美元每百万 Token。这意味着高强度内容生成、自动化智能体、大规模代码重构等重消耗场景,不再成为预算负担,真正实现"无忧接入、按需扩展"。

💡 Fable 的四条差异化证明路径,是 AI 数学"可验证性升值"时代的第一座里程碑。而对于每一个希望拥抱 AI 的开发者与企业而言,选对接入通道,往往比追逐单个模型的"首发"更为重要。