协和医生借 ChatGPT 5.6 自主运行 16 小时,破解 22 年数学悬案
北京协和神经外科医生金山木用 ChatGPT 5.6 自主运行 16 小时,证明了困扰数值线性代数界 22 年的 Cro…
2026 年 7 月 30 日,一个困扰数值线性代数界整整 22 年的核心猜想——Crouzeix 猜想——被正式证明。证明者并非职业数学家,而是北京协和医院神经外科住院医师金山木(Shanmu Jin),他的唯一助手是 ChatGPT 5.6。论文经由猜想提出者 Michel Crouzeix 本人及康奈尔大学教授 Alex Townsend、Anne Greenbaum 审阅并确认正确。
猜想到底有多难
Crouzeix 猜想由法国数学家 Michel Crouzeix 于 2004 年提出,是数值线性代数中关于「数值域」的核心问题。其形式化表述为:对于任意多项式 p 与任意矩阵 A,谱范数总可被其在数值域 W(A) 上的最大值所约束,最优常数为 2。
这一猜想对分析矩阵函数、GMRES 迭代法及 Krylov 子空间方法具有决定性意义。然而:
- 2007 年,Crouzeix 本人仅能将常数压至 11.08。
- 2017 年,美国数学研究所(AIM)召开专题研讨会后,Crouzeix 与合作者 Palencia 将常数进一步降至 2.414。
- 此后 8 年,常数「2」再无突破。
协和医生的解法:把 AI 变成虚拟数学研究院
金山木本科读地质学,后取得医学博士,所有高等数学知识均为自学。他在研究经颅超声时接触矩阵分析,进而对 Crouzeix 猜想产生兴趣。
他并未将 ChatGPT 当作问答工具,而是基于 OpenAI 攻克 Cycle Double Cover 猜想时使用的提示词进行了深度改造,搭建了一个「虚拟数学研究院」:
- 物理断网:切断系统对外网的访问,逼迫 AI 从公理出发进行原创推导,杜绝「抄」人类历史失败思路。
- 多分支发散:启动大量子智能体沿不同路径并行探索,命令禁止过早收敛。
- 对抗性审计:候选证明策略须反复接受其他智能体攻击,仅当反例无法构造时才保留。
- 死磕到底:在拿到能经受极端逻辑检验的完整证明前不得放弃。
设定完成后,他按下了回车键,随后去忙临床工作,全程未干预。ChatGPT 5.6 在 Work 模式下连续自主运行约 16 小时,经历数万次假设、推翻、重建,最终完成证明。Townsend 评价称,AI 并未使用人类预想的繁杂硬估计,而是通过一种巧妙的「采样策略」,将问题化简为一个出人意料的「正性条件」。
验证与开源
金医生已将全部过程开源,包括:
- 最终论文预印本
- 完整提示词
- 历次迭代手稿
- Lean 4 形式化证明代码
- 公理审计报告
GitHub 仓库与预印本均已公开,接受全社区检验。Crouzeix 本人逐行审查了证明后予以认可。
八天后的第二份独立证明
8 月 4 日,数学家 Emiel Lorist 与 Felix Schwenninger 发布了一份仅 5 页的独立证明,思路与金医生完全不同,采用经典双层势表示法与 2-扩张扰动引理。他们同样在探索中使用了 ChatGPT 5.6。一道 22 年悬案在 AI 加持下 8 天内涌现两份截然不同的证明,震动数学界。
一扇门被推开
这是数学史上首例由未受过系统数学训练的医生借助 AI 彻底解决长期悬而未决猜想的事件。它意味着 AI 已能在重大猜想中贡献「决定性证明思路」,不再仅是辅助计算或文献检索的工具。正如天文学从手算轨道走向伽利略望远镜,AI 正在成为科学发现的加速器,同时也在重塑「数学家」与「科学家」的身份定义。
