桃子桃子快讯
返回首页
行业动态

GPT-5.6 Sol 连跑 33 小时攻关费马大定理,被系统强制终止

专家用 GPT-5.6 Sol 连续运行 33 小时尝试简化费马大定理证明,最终被系统阻断,引发对 AI 算力管控的多方…

2026.07.28 · 周二3 分钟阅读

可逆计算与计算物理学领域专家 Michael P. Frank 近日尝试让 GPT-5.6 Sol 持续处理一个高难度数学任务:在后台连续运行约 33 小时,探究费马大定理是否存在比怀尔斯 - 泰勒证明更简洁的途径,重点关注 Frey 曲线模性、一致无限下降法、算术 abc 型不等式以及一致低亏格商等方向。最终,该任务被 OpenAI 系统强制中止。

33 小时做了什么

据 GPT-5.6 Sol 在事后分析中报告,这 33 小时的核心产出并非证明本身,而是一张「此路不通」的地图:模型把很多「听起来可行」的思路转化成了可验证的精确陈述,并逐一证伪或排除。模型同时给出了两种可能的中止原因:系统判定该会话占用资源过多,或 OpenAI 此前已用类似模型尝试同一问题并失败,不想再次浪费算力。Frank 本人倾向于认同这一判断。

关于中止原因的几种解读

围绕 OpenAI 为何阻断此次运行,社区出现了多种观点:

  • 算力保护:有人认为 OpenAI 不想让用户「免费」用其顶尖模型解决千禧年大奖难题并拿走百万美元奖金,尤其在多玩家竞争环境下,保留内部强模型比让用户抢先更有战略价值。
  • 监管考量:近期监管风波不断,若公开版模型展示了过强的数学能力,反而可能招致监管关注,因此对外保留弱化版、内部保留强版本被一些人视为合理策略。
  • 技术机制:另有技术观点指出,codex-cli 中的「goal blocked」含义是模型在连续 3 个推理轮次内反复撞上同一限制或阻挡点,因此更像是常规的防卡死安全机制,而非针对难题的特殊封锁。
  • 版本 Bug:还有用户反映,5.6 版本的 Sol 在长时间任务中存在 Bug,临时解决办法是切换到 5.5 版本、压缩上下文后再切回,认为此次中止可能只是 Bug 导致。

来自 OpenAI 的回应

针对「OpenAI 故意阻止模型解决大难题以独占功劳」的说法,OpenAI 高级研究科学家 Noam Brown 公开反驳:「要是有人只是输入一个 continue(继续),就用我们的模型解决了千禧年大奖难题,然后拿走 100 万美元奖金,这对 OpenAI 来说才是最好的广告,没有比这更好的了。」但反驳者认为,开放顶尖能力带来的短期宣传收益有限,长期反而会削弱 OpenAI 在 AI 竞赛中的领先优势。

这一事件折射出的核心问题是:当 AI 能力越来越强,企业对模型的访问控制权也在扩大,「什么能被发现」的边界在很大程度上由平台方决定,而用户对此缺乏透明度。

信源