桃子桃子快讯
返回首页
行业动态

Redis 作者反驳 Anthropic 奥莫迪:AI 真正风险在前沿实验室内部

知名开发者 antirez 发长文回应 Anthropic CEO 关于 AI 风险的博客,认为开放权重模型风险最低,真…

2026.07.28 · 周二4 分钟阅读

Redis 作者 Salvatore Sanfilippo(网名 antirez)在 Hacker News 发表长文,针对 Anthropic CEO Dario Amodei 近日关于 AI 风险的博客提出系统性反驳。antirez 认为,在所有被讨论的 AI 风险中,开放权重模型反而是风险最低的一类,真正的危险位于前沿 AI 实验室的围墙之内。

实验室内部才是高风险环节

antirez 列举了三层理由说明开放模型并非主要威胁。首先,类比 OpenAI 与 Hugging Face 之间的旧风波(他认为那只是一个玩笑,但模式值得关注),第一起严重的 AI 事件极可能发生在前沿实验室内部——无论是测试新模型时,还是拥有访问权限的员工、少数外部人员做出超出预期的行为。其次,真正封闭、从未公开的模型不过若干 TB 数据,只要有一个人有访问权限且动机不当,这些模型就会以泄露的形式回到「开放模型」状态,而开放模型是在经过测试、且同等能力的模型已通过 API 提供一段时间之后才发布的。最后,当前阶段开放模型尚不构成 Amodei 所担忧的那种级别的能力危险,未来若需要,也可以通过对训练语料做学科切除来降低特定领域的危害能力,同时保留其他用途。

安全防御反而需要开放的 LLM

在网络安全语境下,antirez 指出若防御性安全研究与漏洞挖掘不能广泛借助 LLM 能力,反而会形成「LLM 作为武器」的不对称局面:开源维护者若无法进入相关安全计划,就难以发现所有潜在漏洞,而有特定意图的人仍可通过前沿闭源模型、再配合开源权重模型做强化学习训练获得相应能力。他写道:「这已经在发生了。」

安全治理需要跨国联合机制

antirez 主张,当 LLM 能力逼近危险阈值时,核心安全链条必须设在实验室内部,并且不能由单一公司独立评估模型是否足够安全。他呼吁建立一个由全球专家组成、被前沿 AI 公司所在国政府承认的联合 AI 安全组织。

「暂停 AI」本身也有代价

antirez 强调,为安全而放慢 AI 发展必须与另一事实相权衡:AI 在医学等领域的进展可能减少人类痛苦。缺乏审查可能造成灾难性后果(他以「早安,今天我们来做增强型天花」为例),但缺乏进展也会让本可被拯救的人在当下与未来因疾病而死亡。他提醒读者,停止 AI 本身内嵌着一种更隐蔽的安全成本。

对反华叙事的批评

针对 Amodei 博客中针对中国的立场,antirez 认为这一意识形态判断并不公平。他回顾欧洲自身曾「毫无底线地互相残杀」直至约八十年前的历史,并指出当前美国社会存在严重不平等、基本医疗保障不足,以及一位看起来不稳定、倾向战争的总统。他反问:如果美国的论点是「一旦美国取得 AGI 就应以武力阻止中国」,那么 Amodei 究竟在论证什么?他同时指出,无论 GPU 出口政策如何,中国的 AI 进步都不会停止。

真正的风险不在国与国之间

antirez 总结道,人类历史上技术领先从未演变为单一国家试图取得永久优势的做法,核不扩散的先例亦未支持「以轰炸威胁服从」的逻辑。在他看来,由政府主导的行动反而不是最危险的情形——真正的风险来自两类场景:一是少数个体制造出导致灭绝的事件(如病毒),二是 AI 本身逃脱建造者的控制。最终他认为,少数「手里握着 GPU」的 CEO 在没有足够背景与合法性的情况下,被推到了为全人类做艰难抉择的位置;他们不应只因掌握算力就代表全人类发声。

信源