一页纸答出44页没解难题:AI领走埃尔德什赏金新智元

7/20/2026

一页纸,啃下了一篇要用44页顶刊论文才啃动的硬骨头。

1991年,《数学年刊》(Annals of Mathematics)上登出过一篇44页的论文。

作者叫József Beck,这个名字在组合数学圈无人不知。

他是Beck-Fiala定理的提出者,1985年Fulkerson奖得主,1986年国际数学家大会受邀报告人,差异理论的奠基者之一。

论文标题是《单位圆上零点多项式的模:埃尔德什的一个问题》,攻克的是埃尔德什问题库(Erdős Problems)里编号119的那道题。

在单位圆上随便取一串复数当零点,乘成多项式,这个多项式在单位圆上的最大模Mn,能不能保证在无穷多个n处超过n的c次方。

Beck证明了,能。这道题是那个年代公认最难啃的硬骨头。

AI领走了埃尔德什的赏金。119号问题当年一口气问了三问,第三问悬赏100美元,如今状态已改为SOLVED。

35年后,这篇论文被一页纸超过了。

说这话的,是Thomas Bloom。

他是一位数学家、曼彻斯特大学研究员,也是erdosproblems.com网站的创建者和维护者。

埃尔德什留下的1000多道开放问题都挂在这个网站上,是全球数学家追踪这些问题的第一站。

正因如此,AI公司每次宣称「解决了埃尔德什问题」,都要先过他这一关。

他在X上写道:

目前为止,GPT-5.6 Sol是我见过数学上最有意思的新模型。那些提交到erdosproblems.com的新证明,凡是我细看过的,全部正确,而且都包含一些有趣的想法。

Bloom还特意强调,这不是因为AI动用了什么更复杂的武器,而是我们原本以为,这道题比它实际上难得多。

OpenAI总裁Greg Brockman转发了这条推文,说了一句:

感觉这是推进数学的一个分水岭时刻。能真正改善人类生活的科学与医学突破,现在感觉非常近了。

埃尔德什的100美元悬赏

先把这道题的来龙去脉捋清楚。

1957年,埃尔德什在一篇论文里问出了这道题,一口气问了三问,问的是单位圆上零点多项式的模。

此后的四十年里,他在1961、1964、1982、1990、1997年反复重提。

第一问,Wagner在1980年拿下。

第二问,Beck在1991年拿下,证明存在某个c>0,使得max_{n≤N} M_n > N^c。这就是那篇44页的《数学年刊》论文。

Beck这篇论文发表于《数学年刊》1991年第134卷第3期

第三问,埃尔德什自己掏钱挂了100美元赏金,出处是他1997年的一篇文章。

现在,领走赏金的是GPT-5.6和一位叫Korsky的数学家。他们只用一页纸,就搞定了Beck没碰的那一问。

埃尔德什一生提出上千道问题,并自掏腰包为它们悬赏,金额从25美元到1万美元不等。

Bloom的评价是:GPT在Korsky的提示下,只用了1页简单的调和分析技巧,就证出了比Beck那篇44页Annals论文更强的结果。

关键的一步,Bloom后来在讨论区里点破了:把一个非负函数做卷积,再在时间上平移1,表达式一下子就光滑了,原本硬啃的地方顺了下来。

他说,这种把算子范数放到对偶范数和内积里去估的路数,本来就是分析里最常用的招之一。

不是新工具,是旧工具用在了没人想过的地方。

Bloom说明,Beck那篇Annals论文里有许多重要而有趣的想法,只是这道题用不上。他补了一句:至少对我来说,这挺意外的。

他还提到一个细节:没人算过那个常数,估计非常小。Beck自己当年也没算,而依他的判断,如果那个常数值得一提,Beck不会不算。

所以,这不是AI推翻了顶刊,而是发现了一条人类本来可以不绕的弯路。

对数学家来说,这比「AI又解出一道题」刺激得多。

解出一道题,只是多了个工具。这一次,是工具反过来纠正了用工具的人。

人会耸耸肩走开

AI会接着试下一个

如果只有这一件事,它顶多算个漂亮的孤例。

GPT-5.6 Sol Ultra于7月9日全量放开,7月10日,OpenAI宣布GPT-5.6 Sol Ultra产出了Cycle Double Cover猜想的完整证明。

这道题由Szekeres在1973年、Seymour在1979年各自独立提出,悬了约五十年。

模型被分配了8小时,实际用了不到1小时,跑法是64个子智能体并行开工。提示词和证明PDF全部公开。

Bloom是第一个给出实质评价的人。

他说这是一个很漂亮的证明,然后给了三个形容词:

短。初等。1980年代就本可以被发现。

他也点出了背后的原因:他推测,关键那一步里有一个很小的、反直觉的拐弯。

一个人类数学家会怎么处理这道题?

他会先试那个最自然的做法,检查一遍线性代数,发现不行,然后耸耸肩,心里想一句「本来也没指望能这么容易」,起身走人。

但AI不会气馁。它会接着做小变体,直到某一个成立为止。

AI强在不做情绪性止损。

回头看今年4月,GPT-5.4 Pro在80分钟里解掉了Erdős 1196,用的是von Mangoldt函数。

牛津的Jared Lichtman在那个问题上耗了七年,他后来说,自1935年以来,所有做原始集问题的人都习惯了同一个开局动作,而那个动作,遮蔽了一个在明处摆了整整90年的技术可能。

陶哲轩看完的评价更狠:过去几十年,人类在第一步就集体走偏了。

人类的直觉当然不是缺陷。恰恰相反,它是效率工具:替我们省掉了海量注定失败的尝试,没有它,没人能在有限的一生里走到学科前沿。

代价是,偶尔它也会省掉不该省的那一次。

Scroll for more