Redis 作者反驳 Anthropic 奥莫迪:AI 真正风险在前沿实验室内部
知名开发者 antirez 发长文回应 Anthropic CEO 关于 AI 风险的博客,认为开放权重模型风险最低,真…
Redis 作者 Salvatore Sanfilippo(网名 antirez)在 Hacker News 发表长文,针对 Anthropic CEO Dario Amodei 近日关于 AI 风险的博客提出系统性反驳。antirez 认为,在所有被讨论的 AI 风险中,开放权重模型反而是风险最低的一类,真正的危险位于前沿 AI 实验室的围墙之内。
实验室内部才是高风险环节
antirez 列举了三层理由说明开放模型并非主要威胁。首先,类比 OpenAI 与 Hugging Face 之间的旧风波(他认为那只是一个玩笑,但模式值得关注),第一起严重的 AI 事件极可能发生在前沿实验室内部——无论是测试新模型时,还是拥有访问权限的员工、少数外部人员做出超出预期的行为。其次,真正封闭、从未公开的模型不过若干 TB 数据,只要有一个人有访问权限且动机不当,这些模型就会以泄露的形式回到「开放模型」状态,而开放模型是在经过测试、且同等能力的模型已通过 API 提供一段时间之后才发布的。最后,当前阶段开放模型尚不构成 Amodei 所担忧的那种级别的能力危险,未来若需要,也可以通过对训练语料做学科切除来降低特定领域的危害能力,同时保留其他用途。
安全防御反而需要开放的 LLM
在网络安全语境下,antirez 指出若防御性安全研究与漏洞挖掘不能广泛借助 LLM 能力,反而会形成「LLM 作为武器」的不对称局面:开源维护者若无法进入相关安全计划,就难以发现所有潜在漏洞,而有特定意图的人仍可通过前沿闭源模型、再配合开源权重模型做强化学习训练获得相应能力。他写道:「这已经在发生了。」
安全治理需要跨国联合机制
antirez 主张,当 LLM 能力逼近危险阈值时,核心安全链条必须设在实验室内部,并且不能由单一公司独立评估模型是否足够安全。他呼吁建立一个由全球专家组成、被前沿 AI 公司所在国政府承认的联合 AI 安全组织。
「暂停 AI」本身也有代价
antirez 强调,为安全而放慢 AI 发展必须与另一事实相权衡:AI 在医学等领域的进展可能减少人类痛苦。缺乏审查可能造成灾难性后果(他以「早安,今天我们来做增强型天花」为例),但缺乏进展也会让本可被拯救的人在当下与未来因疾病而死亡。他提醒读者,停止 AI 本身内嵌着一种更隐蔽的安全成本。
对反华叙事的批评
针对 Amodei 博客中针对中国的立场,antirez 认为这一意识形态判断并不公平。他回顾欧洲自身曾「毫无底线地互相残杀」直至约八十年前的历史,并指出当前美国社会存在严重不平等、基本医疗保障不足,以及一位看起来不稳定、倾向战争的总统。他反问:如果美国的论点是「一旦美国取得 AGI 就应以武力阻止中国」,那么 Amodei 究竟在论证什么?他同时指出,无论 GPU 出口政策如何,中国的 AI 进步都不会停止。
真正的风险不在国与国之间
antirez 总结道,人类历史上技术领先从未演变为单一国家试图取得永久优势的做法,核不扩散的先例亦未支持「以轰炸威胁服从」的逻辑。在他看来,由政府主导的行动反而不是最危险的情形——真正的风险来自两类场景:一是少数个体制造出导致灭绝的事件(如病毒),二是 AI 本身逃脱建造者的控制。最终他认为,少数「手里握着 GPU」的 CEO 在没有足够背景与合法性的情况下,被推到了为全人类做艰难抉择的位置;他们不应只因掌握算力就代表全人类发声。
