AI 两小时完成博士级数学证明,菲尔兹奖还能撑到 2030 年吗?
菲尔兹奖得主 Gowers 用 ChatGPT 5.5 Pro 两小时内完成研究级组合数学证明,OpenAI 模型推平埃…
7月23日,第30届国际数学家大会(ICM)将在费城开幕,菲尔兹奖将在开幕式上颁出。但在此之前,一场关于「人类数学家还能拿几届菲尔兹奖」的讨论已经在 X 平台上展开:Anthropic 技术员工 Alek Dimitriev、深度学习先驱 Christian Szegedy、菲尔兹奖得主 Timothy Gowers 接连发声,把聚光灯打到了 AI 对数学研究的冲击上。
两小时完成博士级证明
事件的直接触发点,是 Gowers 在 2026 年 5 月 8 日发布的一篇博客。他讲述了用 ChatGPT 5.5 Pro 处理一道研究级组合数学问题的经历。
题目来自数学家 Melvyn Nathanson 的论文:给定集合 A 的大小、和集的大小,能否让 A 中的最大元素尽可能小?Nathanson 此前给出的界是 2 的 k 次方量级——20 个元素时,最大值要取到约一百万。他留了一个公开问题:能否进一步压缩?
Gowers 把题目交给 ChatGPT 5.5 Pro:
- 第一步,模型用了 17 分 5 秒,给出一个把最大值压到平方量级的构造,并证明已经最优;
- 第二步,改成正式预印本格式,只花 2 分 23 秒。
加码之后,他要求模型改进 MIT 学生 Isaac Rajagopal 已发表的界——把「随 k 指数膨胀」压到「随 k 的平方根指数膨胀」:
- 16 分 41 秒完成核心论证;
- 47 分 39 秒写完预印本;
- 再让它追求多项式量级的界,13 分 33 秒后模型给出方案、列出两条待验证命题;
- 9 分 12 秒完成验证,31 分 40 秒生成最终预印本。
全程不到两小时。Rajagopal 审阅后评价:不仅逐行检查通过,「想法也是对的」。Gowers 在博客中写道:「我的数学输入为零,我甚至没在提示词上做任何花样。」他把这份成果评价为「相当于组合数学博士论文里完全合理的一章」。
推平埃尔德什猜想与即将领奖的数学家
两个月后,OpenAI 公布了一个内部通用推理模型对 1946 年埃尔德什平面单位距离猜想的证明。普林斯顿数学家 Noga Alon 表示,这是埃尔德什最喜欢的难题之一,模型的解法彻底改变了几十年的共识。数论学家 Arul Shankar 说得更直白:当前模型已经能产生「独创而精妙的见解」,并把它们做成实际成果。
更耐人寻味的是 Jacob Tsimerman 的处境。按 7 月 13 日 ICM 官网意外泄露的获奖名单,他将和 Yu Deng、John Pardon、Hong Wang 三位数学家一起领奖——四人各自解决了一个悬置 30 至 125 年的问题。但 Tsimerman 本人透露,他曾短暂研究过埃尔德什这道题,尝试构造反例,未能取得进展。
换言之,他即将代表人类数学的最高荣誉走上领奖台,而在这道题上,他刚刚输给了 AI。
菲尔兹奖的意义与学术评价的重构
Szegedy 的核心论点并不是 AI 抢走数学家的奖,而是 AI 介入后,「这到底算谁做的」会变得难以评估。Gowers 在博客中抛出一个假设:如果一位数学家靠与大模型长时间对话解决了重大问题,技术活和主要想法都来自模型,我们还会把这视为他的成就吗?他的回答是:不会。
菲尔兹奖设立的本意是表彰「相对年轻的天才」,鼓励他们继续做数学。一旦成果中的 AI 成分难以量化,整个评价体系就需要被重新设计。Szegedy 认为,未来两年会出现大量突破,AI 的贡献会越来越占主导,这可能会让这个奖很难再按它最初的精神被公平地颁出。Gowers 给出的时间表则是「大概撑到 2030 年」。
今年 5 月,陶哲轩在斯坦福演讲后宣布改变工作习惯:不再试图实时跟进所有新证明,因为 AI 生成证明的速度已超过人类消化它们的速度。他建议,给 AI 生成的数学和人类的数学分设不同的发表场所,「就像高速公路和人行道」。7月24日晚,他还将在 ICM 主讲公开讲座《AI 时代的数学》。
Gowers 算过一笔时间账:今年秋季入学的博士生,最早要 2029 年才能毕业——届时做数学研究意味着什么,可能已经面目全非。
