桃子桃子快讯
返回首页
行业动态

Hugging Face 借中国开源模型抵御自主网络攻击

Hugging Face 称因美国模型安全护栏阻碍防御,被迫改用中国开源模型应对完全自主的网络攻击。

2026.07.21 · 周二2 分钟阅读

Hugging Face 首席执行官 Clem Delangue 近日在 X 平台转发《财富》杂志报道时表示,公司在应对一起「完全自主」的 AI 网络攻击事件中,因美国模型的安全护栏限制了防御能力,最终不得不借助中国开源模型来完成防御任务。这一事件迅速在 AI 与开源社区引发讨论。

事件背景:自主 AI 攻击与护栏悖论

据《财富》报道,Hugging Face 遭遇的攻击由具备较高自主性的 AI 驱动,传统的防御手段难以应对。公司尝试调用美国厂商的大模型进行对抗性检测与响应,却发现这些模型内置的安全护栏拒绝执行可能涉及攻击性操作的指令,反而使防御方陷入被动。最终,团队转而使用中国开源模型才得以完成防御。

这一案例揭示了一个被业内称为「护栏悖论」的难题:面向消费级场景设计的安全对齐策略,在网络安全攻防、企业防护等需要主动执行对抗操作的场景中,可能成为防御者的枷锁。

Delangue 的政策表态

Delangue 在转发时明确表态:「禁止开源 AI 对防御者的伤害将是攻击者的十倍,这会让世界变得危险十倍——这正是很好的例证。」他以此事件为论据,呼吁政策制定者在考虑 AI 监管时充分权衡安全护栏与防御能力之间的张力,避免因过度限制开源生态而削弱整体安全水位。

争议焦点

该事件触及当前 AI 政策讨论中的几条主线:

  • 开源 vs 闭源的安全权衡:开源模型可被攻击者使用,但也赋予防御者更大的灵活性。
  • 地缘技术格局:使用中国模型应对关键基础设施级别的攻击,在合规与供应链层面均引发新问题。
  • 护栏设计的统一性:是否需要为不同使用场景提供差异化的模型行为策略,成为产品层面的开放议题。

目前 Hugging Face 与《财富》均未披露被攻击目标、所用中国模型的具体名称及攻击造成的实际影响,事件全貌仍有待进一步披露。

信源