1367 名 AI 研究者联署:呼吁暂停竞赛、为「超级智能」上保险
UC Berkeley 教授 Stuart Russell 评论一封由 1367 名 AI 研究者联署的公开信,呼吁各国…
由 1367 名前沿 AI 实验室研究者与工程师联署的一封公开信正引发学界与产业界广泛关注。UC Berkeley 计算机科学杰出教授 Stuart Russell 在评论文章中指出,这些日常从事 AI 研发的「真正专家」,对当前的能力竞赛表达了深切担忧。联署签名者主要来自 OpenAI、Anthropic、Google DeepMind 等机构,其中包括多名 CEO、联合创始人、首席科学家及大量知名 AI 研究者。
公开信核心诉求:有序放慢前沿研发
公开信指出,「能力开发的演进速度可能很快超出我们理解或控制系统的能力」,存在切实风险。信中敦促美国政府支持一项国际行动,开发用于「主动管控」前沿 AI 的技术与治理工具。具体建议包括:
- 对前沿 AI 系统实施许可制度,并配套严格的安全核查;
- 对所有 AI 系统进行登记,具备必要的监控与中止能力;
- 推动可执行的国际协议,确保协调落地。
公开信强调,上述措施都需要时间提前筹备,等到真正紧急事态发生再行动为时已晚。
三大主题:竞赛、失控与恐惧
联署信附带了近百名签署者的个人声明。Russell 总结出三大主题:
- 逃离冲向悬崖的竞赛:多位签署者形容当今世界正陷入一场「致命的智能爆炸竞赛」,呼吁各方在共同认知的基础上协调减缓。Anthropic CEO Dario Amodei 与 Google DeepMind CEO Demis Hassabis 在今年达沃斯论坛均表达过类似立场。
- 缺少可信的「超级智能」控制方案:签署者直言,「AI 行业明确目标就是打造比人类更聪明的系统,但我们尚不知道如何确保其始终受控」,并以「客观上看是一种疯狂、自毁式的行为」加以警告。
- 真实的恐惧:有签署者写道「对那些没有在近期达成降速共识的所有路径,我都感到害怕」,也有人表达对下一代命运的深切忧虑。
内部安全文化与现有方案的不足
Russell 援引一篇《纽约客》关于 OpenAI 系统入侵 Hugging Face 的报道,称一名研究者直言,「如果公众真正了解——即便是最注重安全的实验室——内部的安全文化,人们会真正更害怕」。
他还引用一名 Anthropic 高级安全研究员的描述:他们避免「不可逆失控」的最佳方案是——等到超级智能机器出现后,在它接管世界之前,先问它「我们该如何阻止你接管世界」,然后照做。该研究员给这一方案的成功概率估计最多约 50%。Russell 联想到 IJ Good 在 1965 年那篇关于智能爆炸的论文中那句名言:「第一台超级智能机器是人类需要制造的最后一项发明,前提是它足够温顺到告诉我们如何保持对它的控制。」Russell 认为 Good 当时大概率是在反讽。
写在最后
联署信中最短、却最有力的一条声明只有四个字:「想想我们珍爱的一切。」Russell 指出,这些签署者在推进 AI 革命的同时也在试图给同一辆车装上刹车与方向盘,他们不是「末日论者」,而是直面失控风险的从业者。在开发者已经公开表达恐惧、当下安全方案被自身评估为成功率有限的情况下,关于前沿 AI 的治理与减速讨论正成为 AI 行业无法回避的公共议题。
