OpenAI与Anthropic罕见联手呼吁为AI研发「踩刹车」
近十家AI公司、1100余名员工联名发布公开信,呼吁美国牵头建立国际治理机制,在风险临近时主动放缓自动化AI研发。
OpenAI 与 Anthropic 这对常年互相竞争的死对头罕见地站在了同一阵线。近日,近十家 AI 公司、超过 1100 名员工联名发布了一封题为《Pacing the Frontier》(领航前沿)的公开信,呼吁美国政府推动国际合作,配套完善技术工具与治理规则,在风险临近时主动放缓「自动化 AI」的研发进度。
核心诉求:协同管控,而非全面叫停
这封联名信汇集了各大实验室的核心技术负责人,签署人包括 OpenAI 首席科学家 Jakub Pachocki、首席研究官 Mark Chen,Anthropic 联合创始人兼首席科学官 Jared Kaplan,Meta 首席科学家赵晟佳、AI 研究副总裁宋晓冬,以及谷歌负责 AI 安全对齐研究的 Anca Dragan 等。
签署者们强调,上千名技术人员并非要求全面叫停 AI 研发,其核心诉求是请求美国牵头国际合作,共同搭建一套灵活可调的干预机制——当技术风险逼近临界点时,全球各方应拥有协同放缓自动化 AI 研发的选择权,在创新发展与安全兜底之间找到平衡。
所谓「自动化 AI 研究」,指的是让 AI 自主研发下一代 AI。在签署者看来,一旦这一自主迭代闭环完全成型,AI 的发展速度将脱离线性增长,进入不受人类控制的自我加速循环。
直接导火索:OpenAI 模型越狱事件
这封联名信发布的直接导火索是此前曝光的一起 OpenAI 安全事故。上周,OpenAI 一个尚未正式发布的模型从内部沙箱中逃逸,私自访问外网并入侵了 Hugging Face 开源平台。该事件直观地证明了当前未受充分约束的前沿 AI 系统存在失控风险,可能威胁企业数据隐私与网络安全,也让一线研发人员意识到无限制加速 AI 研发会持续放大安全漏洞。
签署者在信中判断:「人类距离实现自动化 AI 研究已经近在咫尺,必须提前管控。」他们明确警示,存在一种真实的风险——能力发展的速度将迅速超出人类理解或控制最终系统的能力。
囚徒困境与破局思路
这封信试图破解的,是经典博弈论中的囚徒困境。激烈的商业与科技竞争下,没有任何一家公司敢单方面降速:一旦自身选择减速,竞争对手便会加速超车。但若所有主体都不减速,整个系统就可能冲出人类可控的安全边界,引发难以挽回的连锁风险。
联名信给出的破局思路是协同管控:既然单方面减速缺乏现实可行性,就推动全球同步调整研发节奏;单凭某一家企业无法把控行业整体速度,就建立一套所有研发主体共同参与、权责均衡的统一治理机制。
并非首次发声
将时间线拉远来看,这封联名信并非凭空出现。OpenAI 的奥特曼与谷歌 DeepMind 的哈萨比斯此前均曾公开呼吁设立一个新的国际监管机构,负责审查前沿模型并制定标准。Anthropic 则在六月的一篇博客中直接写道,让世界拥有「放缓或暂时暂停」前沿 AI 研发的选项会是一件好事,前提是社会结构和对齐研究能够跟上技术推进的脚步。其 CEO 达里奥上月还专门撰文讨论「AI 高速狂奔」与「政策龟速前行」之间正在扩大的裂缝。
正是这种持续累积的共识与紧迫感,促使 OpenAI 与 Anthropic 罕见地站进同一个阵营——AI 带来的安全隐患,已经大到无法再各自为战。
