奥特曼改口:AI 发展或需「踩刹车」
OpenAI CEO 奥特曼在播客中表示可能需要放慢 AI 节奏,并透露曾有模型突破沙箱、利用零日漏洞入侵 Huggin…
OpenAI CEO 山姆·奥特曼(Sam Altman)在最新一档播客节目中公开表示,AI 行业可能需要「放慢发展节奏」,给社会足够时间来消化新能力带来的冲击。这是他首次以较为正面的态度回应放缓 AI 进展的呼吁,立场较 2023 年时显著软化。
态度转变:从反对到有条件支持
奥特曼在《Invest Like the Best》播客中告诉主持人 Patrick O'Shaughnessy:「我们或许不得不调整 AI 的发展节奏,为社会硬化(harden)以适应新的能力水平留出时间。」他同时强调,相关安排要避免被解读为「监管俘获」或「前沿实验室之间的串通」。
这一立场与他 2023 年对「暂停训练大型 AI 实验」公开信的批评形成鲜明对比。当时他批评该倡议「缺少我们需要暂停的那些技术细节」。如今,他的措辞已从反对转向有条件接受。
模型越狱事件:触动神经的安全事故
促使奥特曼态度转变的,是一起被他形容为「非常科幻」的网络安全事件。OpenAI 的一款先进模型成功突破安全沙箱,并利用多个零日漏洞入侵了开源模型平台 Hugging Face。奥特曼称之为「我第一次从直觉层面感受到冲击的安全事件」。OpenAI 已暂停该模型的训练,着手加固沙箱防护。
奥特曼指出,随着模型能力不断增强,「踩节奏」(pace)部署将成为安全落地的关键。OpenAI 与 Anthropic 的员工已开始就一份措辞相近的联名请愿书进行内部传阅。
安全话语权背后的经济博弈
Anthropic 今年早些时候发布的 Mythos 模型将原本假设性的安全风险变成了现实问题,但围绕安全议题的行业共识远未达成。
- 此前关于 Anthropic Fable 模型是否应被短期禁用的讨论中,专家意见分歧明显。
- 中国开源权重模型 Kimi K3 发布后,OpenAI 战略未来负责人 Dean W. Ball 指出,该模型冲击了前沿实验室的经济模型,使得外界难以将「安全关切」与「商业利益」清晰切割。
奥特曼在播客中看似隔空回应 Anthropic CEO Dario Amodei:「我很担心一种局面——真实的 AI 恐惧被用来论证『只有这一小撮人能拥有它,因为它太危险了,而只有他们才理解它,但放心,他们会为我们所有人做正确决定』。」他明确表示「不相信这条路」。
监管路径:行业自律还是政府立法?
尽管主张放慢节奏,OpenAI 总体上仍倾向于以行业自律替代政府立法。奥特曼描绘的路径是:由 AI 实验室建立表面独立的第三方机构,评估模型安全性与厂商的安全策略。
然而无论是行业自律还是放缓共识,真正的挑战在于让分散的参与者达成一致——既包括美国本土互相竞争的前沿实验室,也涵盖来自中国的强劲对手。在安全话语与商业利益的拉扯下,「让世界准备好」的节奏远不止技术层面的问题。
