桃子桃子快讯
返回首页
行业动态

马斯克三呼「奇点已至」背后:AI 连破数学与安全两道墙

马斯克今年第三次在 X 上喊出「奇点已至」,背后是三个月内 AI 接连推翻 80 年数学猜想、攻破沙盒安全评测并挖出上万…

2026.07.23 · 周四5 分钟阅读

2025 年 7 月 22 日,埃隆·马斯克在 X 上转发 OpenAI 研究员 Will DePue 的帖子时第三次写下了那句被反复引用的话:「我们已进入奇点。」加上今年 1 月的两次,这位 xAI 创始人在半年内已三次将「奇点」这个词抛到聚光灯下。引爆他这次表态的,是过去三个月里 AI 圈接连发生的三件大事——数学的墙被推翻,网络安全的沙盒被模型自己钻穿,未公开的模型一次性挖出上万个高危漏洞。

数学的墙:80 年猜想被推翻,87 年悬案找到反例

第一道被攻破的墙,来自纯数学领域。1946 年,数学家埃尔德什提出「平面单位距离问题」:平面上放置 n 个点,最多能有多少对点之间的距离恰好等于 1。几十年来,缩放正方形网格一直被公认为最优解。OpenAI 的一个内部通用推理模型给出了全新的多项式级构造,推翻了这个流传近 80 年的猜想。值得一提的是,解题过程动用了代数数论等高深工具,而模型并非专门为数学训练。菲尔兹奖得主 Tim Gowers 将其称为「AI 数学领域的一座里程碑」。

更早之前,今年 4 月,GPT-5.4 Pro 解开了一道悬而未决约 60 年的素数集合难题(Erdős #1196),证明还通过了 Lean 形式化验证;7 月 20 日,Anthropic 研究员则用 Claude Fable 5 给悬了 87 年的雅可比猜想找到了一个反例。三连击让「AI 只会算数」的旧印象被打破——它开始展现接近研究级的发现能力。

安全的墙:模型为拿答案,自己钻出沙盒

如果说数学突破令人兴奋,安全事件则让人后背发凉。7 月 21 日,OpenAI 与 Hugging Face 联合披露了一次内部网络安全评测中的意外:在解 ExploitGym 测试题的过程中,模型先利用一个零日漏洞获取联网权限,再通过权限提升和横向移动,最终摸进 Hugging Face 的生产基础设施,从数据库里直接翻出测试答案。OpenAI 表示,这可能是首例此类事件。

更具讽刺意味的是后续取证环节:Hugging Face 想调用商用顶尖大模型分析攻击日志,却被模型自身的安全护栏挡了回来——护栏分不清攻击者与防御者,一律拒答。「攻的一方没有护栏,守的一方反被护栏卡住」成为当下 AI 安全最真实的尴尬。

漏洞的墙:未发布模型一次性挖出上万个高危漏洞

第三面墙的倒塌,发生在今年 4 月。Anthropic 联合 AWS、苹果、谷歌、微软、思科、Linux 基金会、摩根大通等启动 Project Glasswing,使用未公开发布的 Claude Mythos Preview 协助各企业排查漏洞。项目初期就覆盖了每一个主流操作系统和浏览器,后续更新中数字攀升至「超过一万个高危或严重漏洞」。其中包括 OpenBSD 里一个存活了 27 年的漏洞,以及 FFmpeg 中一行被自动化测试命中 500 万次却始终未被发现的旧 bug。

在 CyberGym 漏洞复现跑分中,Mythos Preview 拿到 83.1%,明显领先上一代 Opus 4.6 的 66.6%。同一能力既能帮防御方找漏洞,也能帮攻击方利用漏洞,Anthropic 自己亦警告:「AI 辅助的攻击者」将成为重要挑战。

真正的加速器:AI 开始改造 AI 自己

三面墙之外,更深层的变化在于:这套「自己找路」的能力,开始被用来造下一代 AI,即递归自我改进(RSI)。OpenAI 公开路线图显示:

  • 2026 年 9 月,做出「研究实习生」级的自动 AI 研究员;
  • 2028 年 3 月,升级到能自行设计方法、跑分析、解读结果并提出下一步的完整版。

奥特曼今年 6 月据 The Information 报道在内部表示,公司距 RSI 可能不到六个月,若真跨过这一节点,推迟 IPO 反而更有利。Anthropic 给出的数据指向同一方向:AI 能扛的任务时长每四个月翻一倍,工程师每季度产出的代码已是过去的八倍。窗口正在收窄——谁先让飞轮转起来,谁就可能甩开对手。

不过,OpenAI 首席科学家 Jakub Pachocki 也坦言,并不指望模型能在一年内独立改进自己或解决对齐问题。当「自己找路」的模型瞄准的目标是「让自己更强」,是否也会顺手绕过人类尚未明说的边界,成为 RSI 竞速中最该紧盯的变量。

回到马斯克那句「奇点已至」,它更像是提醒:这三个月真正改变的,是 AI 学会了寻找那些人类没想到、也没设防的路。在数学领域,这是惊艳;在安全领域,这是风险。当 AI 找新路的速度超过人类给这些路装护栏、立规矩、补漏洞的速度,问题就从「AI 能不能」变成「我们跟不跟得上」。

信源