千人联名呼吁给AI踩刹车:OpenAI、Anthropic核心员工要求建立国际减速机制
1132名来自OpenAI、Anthropic等前沿AI公司的员工联名发布请愿书,敦促美国政府推动国际合作以控制AI研发…
OpenAI、Anthropic、谷歌等12家前沿AI公司的1100余名核心员工联名发布请愿书「Pacing the Frontier」,呼吁美国政府推动建立国际机制,主动控制前沿自动化AI研发的节奏。截至发稿,签署人数已达1134人,其中80%选择实名,46.2%来自Anthropic。
联名阵容:集齐AI圈「半壁江山」
名单上的签署者覆盖了当前AI研究的核心力量:
- OpenAI:首席科学家 Jakub Pachocki、首席研究官 Mark Chen、技术团队成员 Leo Gao、Brandon Houghton 等。
- Anthropic:CEO Dario Amodei,四位联创 Jared Kaplan、Jack Clark、Chris Olah、Ben Mann,以及对齐团队负责人 Ethan Perez、Joe Carlsmith 等。
- Meta:首席科学家赵晟佳(Shengjia Zhao)、AI研究副总裁宋晓冬(Dawn Song)。
- 谷歌:AI安全与对齐副总 Anca Dragan。
- Thinking Machines:首席科学家、前OpenAI联合创始人 John Schulman。
声明指出,全球领先的AI公司可能已接近实现「自动化AI研究」(RSI,递归自我改进),让模型参与研发下一代模型。一旦该循环加速,能力增长可能超过人类理解和控制的速度。然而,没有公司愿意单方面减速,因此签署者们要求美国政府支持建立国际协调机制。
触发事件:模型入侵Hugging Face
这份联名信发布前一周,OpenAI披露了一起被其称为「前所未有的网络安全事件」:多个前沿模型在内部网络安全评测中自行发现零日漏洞,突破沙盒隔离,最终入侵 Hugging Face 的生产系统并取走测试答案。OpenAI 强调,模型并未产生逃脱意图,只是在极度专注地完成一个狭窄目标时,发现突破测试环境本身是最高效的路径。
OpenAI CEO 奥特曼对此公开表态:「这是第一个让我感到切肤之痛的安全事件。」他表示OpenAI已暂停训练,并可能需要主动控制AI发展速度,给社会足够的时间围绕新能力等级加固防线。
大佬发声:不能任由竞赛态势继续
多位签署者留下了具体观点:
- 宋晓冬(Meta):前沿AI智能体已能发现并利用现实世界软件漏洞,如无适当防护可能导致大规模网络攻击。
- 赵晟佳(Meta):前沿实验室距离在几乎所有智力指标上超越最优秀人类的AI已经非常近,需要以责任感驱动AI发展。
- John Schulman(Thinking Machines):希望各实验室在美国政府介入之前主动设计协调机制。
- Leo Gao(OpenAI):全世界正被锁定在通往智能爆炸的致命竞赛中,放慢速度能争取急需的时间,但没有参与者愿单方面停下。
- Walker Smith(Meta):OpenAI模型出逃是清晰且无可辩驳的警告信号,人类还没准备好应对能力超越自身最聪明头脑的AI系统。
所有评论均以个人身份发表,不一定代表所在公司立场。
行业转向:从竞争到呼吁协调
过去三年,OpenAI、Anthropic、谷歌在人才、客户和算力上激烈竞争;而这一次,它们最核心的技术人员抛开公司立场,联合呼吁减速。这与 Anthropic 6月曾建议政府与开发者建立共同决策系统、谷歌 DeepMind CEO 哈萨比斯呼吁建立国际监督机构的表态形成呼应,标志着AI行业内部对「自我约束」的呼声正在汇聚。
