桃子桃子快讯
返回首页
研究论文

协和医生借 ChatGPT 5.6 自主运行 16 小时,破解 22 年数学悬案

北京协和神经外科医生金山木用 ChatGPT 5.6 自主运行 16 小时,证明了困扰数值线性代数界 22 年的 Cro…

2026.08.13 · 周四4 分钟阅读

2026 年 7 月 30 日,一个困扰数值线性代数界整整 22 年的核心猜想——Crouzeix 猜想——被正式证明。证明者并非职业数学家,而是北京协和医院神经外科住院医师金山木(Shanmu Jin),他的唯一助手是 ChatGPT 5.6。论文经由猜想提出者 Michel Crouzeix 本人及康奈尔大学教授 Alex Townsend、Anne Greenbaum 审阅并确认正确。

猜想到底有多难

Crouzeix 猜想由法国数学家 Michel Crouzeix 于 2004 年提出,是数值线性代数中关于「数值域」的核心问题。其形式化表述为:对于任意多项式 p 与任意矩阵 A,谱范数总可被其在数值域 W(A) 上的最大值所约束,最优常数为 2。

这一猜想对分析矩阵函数、GMRES 迭代法及 Krylov 子空间方法具有决定性意义。然而:

  • 2007 年,Crouzeix 本人仅能将常数压至 11.08。
  • 2017 年,美国数学研究所(AIM)召开专题研讨会后,Crouzeix 与合作者 Palencia 将常数进一步降至 2.414。
  • 此后 8 年,常数「2」再无突破。

协和医生的解法:把 AI 变成虚拟数学研究院

金山木本科读地质学,后取得医学博士,所有高等数学知识均为自学。他在研究经颅超声时接触矩阵分析,进而对 Crouzeix 猜想产生兴趣。

他并未将 ChatGPT 当作问答工具,而是基于 OpenAI 攻克 Cycle Double Cover 猜想时使用的提示词进行了深度改造,搭建了一个「虚拟数学研究院」:

  • 物理断网:切断系统对外网的访问,逼迫 AI 从公理出发进行原创推导,杜绝「抄」人类历史失败思路。
  • 多分支发散:启动大量子智能体沿不同路径并行探索,命令禁止过早收敛。
  • 对抗性审计:候选证明策略须反复接受其他智能体攻击,仅当反例无法构造时才保留。
  • 死磕到底:在拿到能经受极端逻辑检验的完整证明前不得放弃。

设定完成后,他按下了回车键,随后去忙临床工作,全程未干预。ChatGPT 5.6 在 Work 模式下连续自主运行约 16 小时,经历数万次假设、推翻、重建,最终完成证明。Townsend 评价称,AI 并未使用人类预想的繁杂硬估计,而是通过一种巧妙的「采样策略」,将问题化简为一个出人意料的「正性条件」。

验证与开源

金医生已将全部过程开源,包括:

  • 最终论文预印本
  • 完整提示词
  • 历次迭代手稿
  • Lean 4 形式化证明代码
  • 公理审计报告

GitHub 仓库与预印本均已公开,接受全社区检验。Crouzeix 本人逐行审查了证明后予以认可。

八天后的第二份独立证明

8 月 4 日,数学家 Emiel Lorist 与 Felix Schwenninger 发布了一份仅 5 页的独立证明,思路与金医生完全不同,采用经典双层势表示法与 2-扩张扰动引理。他们同样在探索中使用了 ChatGPT 5.6。一道 22 年悬案在 AI 加持下 8 天内涌现两份截然不同的证明,震动数学界。

一扇门被推开

这是数学史上首例由未受过系统数学训练的医生借助 AI 彻底解决长期悬而未决猜想的事件。它意味着 AI 已能在重大猜想中贡献「决定性证明思路」,不再仅是辅助计算或文献检索的工具。正如天文学从手算轨道走向伽利略望远镜,AI 正在成为科学发现的加速器,同时也在重塑「数学家」与「科学家」的身份定义。

信源