← 返回 Blog

67.25% 意味着什么?Claude 未证黎曼猜想,却让数学推理下界飙升 25.6 个百分点

Claude并没有凭空创造全新数学理论。它完成的是另一件难事:在浩如烟海的已有研究成果中,找出一条被人遗忘的关联脉络。

ClaudeClaude Code

67.25%不是进度条

人们第一眼看到这个数字,下意识就会误解为"黎曼猜想已经完成67.25%"。事实并非如此。Anthropic在论文中专门用一句话杜绝这种误区:该结论无论正向、反向,都无法佐证黎曼猜想真伪。这项结果本身,不能为黎曼猜想给出任何倾向性判断。

67.25%描述的是另一重事实:至少有这么多非平凡零点落在临界线上。那剩下32.75%如何?Claude没有给出论断,也无力判定。这个数值是一个下界——一条"保底比例",数学家通过严格证明确定:临界线上至少存在占比这么多的零点。

将下界从41.6%推进至67.25%,意味着人类对黎曼ζ函数零点分布的精确认知范围,一下子拓宽了25.6个百分点。在此以前的37年里,数学家仅仅往前推进了0.8个百分点。

37年,对比3100万词元

回顾人类推进这一下界的漫漫征途:

  • 1914年,哈代证明临界线上存在无穷多个零点;

  • 1942年,塞尔伯格证明有一定比例的零点位于临界线上;

  • 1974年,莱文森把这一比例推进至三分之一;

  • 1989年,康瑞将比例提升至五分之二以上;

  • 2020年,这个数值定格在5/12,大约41.66%。

随后研究陷入停滞,整整37年。

Claude耗费了多久?两轮Claude Code运算会话,一共消耗3100万输出词元。在找到可行方案之前,它先后生成了650条失效思路。整整650次尝试,每一次失败都被记录、舍弃,而后重新探索。

这不能简单归结为"计算速度快"。如果仅仅比拼算力,人类早就可以动用超级计算机暴力枚举。真正的关键在于计算方式——也就是方法论的取舍。

Claude真正突破的关键点

Claude采取了一条在数学领域相当反直觉的路径。

它借助韦尔诱导二次型构造函数空间:落在临界线上的零点构成正定子空间,临界线以外的零点构成负定子空间。过去的主流思路习惯拆分正定、负定两部分,分开运算,最后合并结果。

Claude没有这么做。它把整个空间视作统一整体,并且允许二次型采用非对角形式。随后依托一阶矩、二阶矩信息,建立关于二次型秩的不等式。

这套一体化处理方案,绕开了传统莱文森方法固有的局限。

从技术脉络来讲,Claude融合了1973年蒙哥马利提出的思路——这套技术原本需要预先假定黎曼猜想成立才能使用;结合巴卢约特、戈德斯通、苏里亚贾亚、特内奇-巴特博等人近年移除该前置条件的相关工作,再吸纳邦别里2000年论文中的成果。

换言之,Claude并没有凭空创造全新数学理论。它完成的是另一件难事:在浩如烟海的已有研究成果中,找出一条被人遗忘的关联脉络

60个智能体,两条核心思路

整套实验的架构同样值得关注。Claude在Claude Code环境下调度大约60个子智能体协同工作。这些智能体一共执行2400条Shell指令,编写数百份Python脚本,针对已知ζ零点开展数千次数值测试;彼此交叉复核推导,从arXiv下载54篇论文,核验相关结论是否早已被前人发表。

但最终,只有两个智能体产出了核心思路。

其余58个智能体在承担什么工作?验证推演、寻找证伪途径、搜寻反例、审核证明过程。这正是分布式智力劳动的雏形:不再依靠单一"天才模型"孤军奋战,而是由承担不同职能的主体组成研究团队协同攻坚。有人负责构思,有人负责文献调研,还有人专门负责挑错审视。

来自Anthropic的两位数学家莱文特·阿尔珀格、拉尔夫·弗曼完成论文核验,外部数论学者布莱恩·康雷、丹·戈德斯通参与同行评审。Claude还生成了一份能够在Lean定理证明器中完成形式化核验的完整证明。

这并非孤例,一条清晰的发展轨迹正在成型

2026年,数学界正发生一些微妙转变。

今年5月,OpenAI内部展示了AI独立推导出的厄多斯距离猜想证明,菲尔兹奖得主蒂莫西·高尔斯评价其为"AI独立产出的最亮眼数学成果"。7月,新晋菲尔兹奖得主雅各布·茨默曼在颁奖典礼上宣布加入OpenAI;同月,任职于Anthropic的数学家莱文特·阿尔珀格借助Claude,找到了困扰代数几何界百余年的雅可比猜想的反例。8月,OpenAI宣布面向十万名科学家与数学家开放免费ChatGPT使用权限。

串联这些事件,可以得到同一个信号:AI正在转型,从"求解已知问题的工具",演变为发掘未知结论的研究者

Anthropic首席执行官达里奥·阿莫迪对此作出判断:"不要只将AI视作数据分析工具,应当把它看作能够端到端完成科研人员全部工作的智能主体。"

再回到67.25%

这个数字真正的意义,不在于距离100%还有多远。它证明了另一件事:面对答案未知、路径不明、研究空间完全开放的难题,AI能够推导出前人从未得到的全新结论。

人类耗费37年仅推进0.8个百分点;Claude只用数日,实现25.6个百分点的跨越。二者的差距不在于算力——倘若只是比拼运算能力,超级计算机早就取得突破。鸿沟存在于思维范式的迁移:从"人类主导数学研究、AI辅助",转向"AI开展探索推演、人类负责核验"。

💡 值得关注的是,这次实验本身消耗了3100万输出词元、调动60个子智能体连续运转一天半——这类高强度、长周期、多智能体并行的研究工作流,正是当下AI能力落地的一个缩影。无论是前沿数学探索,还是企业级内容生成、代码重构、大规模文档处理,背后都需要稳定、合规、可负担的模型接入能力作为支撑。

在这方面,UseAIAPI提供了一条清晰的路径:平台一站式聚合Gemini(含3.6 Flash、3.5 Flash、3.1 Pro等最新模型)、Claude、ChatGPT、DeepSeek等全球主流大模型的最新版本,无需为每个大模型分别注册海外账号、配置支付方式,一套API Key即可打通全球主流模型。

更为实在的是其成本优势——平台优惠折扣最低可达官方价格的50%。对于企业用户,UseAIAPI还支持企业级定制化部署,可根据业务需求灵活配置并发、配额与路由策略,结合Batch 5折机制与缓存机制,将长上下文、高并发、持续运行的智能体工作流的单位成本压到更低。平台通过海外合规节点接入官方API,提供企业级SLA保障,规避地区可用性门槛与数据中心IP风控风险。

黎曼猜想依旧矗立,历经167年岁月,不会被短短数日的尝试撼动。但Claude撞开的那扇侧门——将整个函数空间作为统一对象分析、接纳非对角二次型的研究思路,值得被长久记住。

67.25%只是一个数字。数字背后的问题更为重要:当AI开始以人类不曾预想的方式串联现有知识,接下来将会诞生什么?而对于需要长期、大规模调用全球主流大模型的团队而言,Claude这3100万词元的实验或许是一个启示:当AI真正走入研究范式,一套"无忧接入、按需扩展"的模型接入基础设施,与模型能力本身同样重要。