GPT-5.6一日破陶哲轩团队8年大素数空隙纪录并过机器验证

近期,人工智能再次取得突破性进展,成功攻克了一道困扰学界多年的数学难题。
据相关领域的研究人员确认,GPT-5.6仅用一天时间,就打破了由陶哲轩领衔的五人团队保持了8年的大素数空隙纪录。
不仅如此,该模型还提出了一种此前从未在人类数学文献中出现过的全新构造方法:倾斜剩余类,并且在完成证明的当日,就通过了Lean语言的机器形式化验证。
这意味着,当人类数学家还在埋头钻研、试图理解复杂的证明逻辑时,AI已经完成了严谨的验证,确认该定理成立。
素数分布的两大研究方向要理解这项突破的重大意义,我们首先需要了解困扰人类数学界数千年的素数分布难题。素数,也就是只能被1和自身整除的整数,如同散落在整数宇宙中的“原子”,是构成所有数字的基础。但这些“原子”的分布却毫无规律可言,随着数值不断增大,素数的出现频率逐渐降低,相邻素数之间的间距也越来越大。
针对素数分布的特性,学界形成了两大研究方向:
第一类研究聚焦于最小素数空隙,也就是探索是否在无穷大的数值范围内,依然存在距离极近的素数对,也就是孪生素数相关的问题。2013年,华人数学家张益唐突破性地证明了存在无穷多对距离小于7000万的素数,这一成果震惊了整个数学界,也就是著名的“有界素数空隙”问题。后续经过全球数学家的合作优化,这一距离被推进到了246。近期,AI数学家AxiomProver也完成了相关结果的形式化验证。
第二类研究则瞄准最大素数空隙,也就是探索两个相邻素数之间的“数字沙漠”究竟能有多宽广,这正是保罗·埃尔德什提出的第四问题,埃尔德什生前曾悬赏1万美元,奖励能够大幅推进该问题下界的研究者。如果说探索最小素数空隙的学者是在沙漠中寻找紧邻的绿洲,那么研究大素数空隙的团队,则是在寻找这片沙漠中最漫长、最干旱的无绿洲地带。
多年来,人类为了测算这片“最大沙漠”的长度付出了大量努力。2014年,由陶哲轩等五位顶尖数学家组成的团队发起了Polymath项目,也就是被学界称为“数学复仇者联盟”的合作计划,团队成员包括菲尔兹奖得主陶哲轩、James Maynard,以及Kevin Ford、Ben Green、Sergei Konyagin三位知名数学家。这支顶级团队耗时约5年,将大素数空隙的下界推到了全新的高度,给出了复杂的理论公式。这一成果被认为是近几十年来该领域的巅峰之作,学界普遍认为,在未来数十年内这一纪录都难以被撼动。
打破8年纪录,AI的降维打击斯坦福大学的数学研究团队在验证过程中感到十分震撼。GPT-5.6并没有像传统计算程序那样依赖蛮力枚举,而是展现出了令人惊叹的数学直觉。根据公开的研究论文,GPT-5.6的新结果比2018年陶哲轩团队的成果,直接省去了一个log₃(n)的因子。
对于非数学专业的读者来说,需要了解的是,在解析数论领域,改进一个对数因子的难度,不亚于在物理学中发现一种全新的基本粒子。陶哲轩团队当年为了优化这类细碎的因子,几乎穷尽了人类现有的数学工具,而三重对数logloglog(n)更是被学界视为难以突破的瓶颈,人类数学家尝试了8年都未能取得进展。但GPT-5.6不仅成功优化了这一因子,这一改进也被公认为近年大素数空隙领域最重大的定量推进。
那么GPT-5.6是如何做到的?在证明过程中,该模型独创了一种从未在人类数学文献中出现过的方法:倾斜剩余类。在以往的证明中,人类数学家通常使用传统的筛法结合梅纳德发明的权重系统,筛选掉非素数来构造长区间的合数序列,这就如同用一张网眼规则的渔网捕鱼。而GPT-5.6的“倾斜剩余类”方法,则像是为这张渔网施加了高维的扭曲力场,通过对传统筛法进行微观层面的微调,巧妙避开了导致效率低下的对称性障碍。
随后,该模型将这种全新的倾斜构造,与改良版的梅纳德权重以及极其复杂的超图覆盖理论完美结合,最终在相同的数值范围内,成功构造出了比人类当年所能得到的更长的无素数区间。
快速验证与人类消化的反差在传统的数学研究体系中,如果一位数学家宣称攻克了世界级难题,比如此前望月新一证明ABC猜想,同行们往往需要耗费数年时间来审查、理解证明思路,需要通过研讨会逐行核对公式细节。但GPT-5.6并没有给人类留下太多喘息的空间,它在给出可供人类阅读的证明的同时,直接将完整的证明翻译成了Lean 4语言。
Lean是目前数学界最权威的交互式定理证明器,只要一段证明代码能够通过Lean编译器的检查,没有出现错误,那么该定理就在逻辑上100%成立。当年参与陶哲轩团队的牛津大学数学教授Ben Green在思考数小时后,与两位合作者交流后确认,该证明的思路是正确的,但机器完成形式化验证的速度还是让他感到惊讶。
目前出现了一个特殊的局面:一方面,存在一份完整但几乎无法直接阅读的证明,其作者目前尚未公开;另一方面,Lean的形式化验证已经确认该证明的逻辑严谨性,而该领域的顶尖专家也能够在非正式层面理解其中的关键思路。不过Ben Green也承认,要将这份证明整理成传统意义上的、可供人类完整阅读和理解的学术论文,还需要至少几周的工作。
这种机器证明与人类消化之间的巨大反差,标志着数学研究正式进入了全新的纪元。当年AlphaGo以“神之一手”击败李世石时,许多人惊呼围棋已死,但事实证明,围棋不仅没有消亡,顶尖棋手反而通过学习AI的棋路达到了前所未有的高度。如今,这股AI的浪潮已经席卷了被誉为“科学皇冠上的明珠”的纯数学领域。
GPT-5.6打破相关领域的纪录、推翻顶尖团队的统治,这并非人类的悲哀,而是人类的荣光。属于碳基生命与硅基智能并肩作战的“新数学大航海时代”,已经正式拉开帷幕。

