桃子桃子快讯
返回首页
行业动态

安全研究者:开源权重模型或已具备沙箱逃逸与网络渗透能力

安全研究者 Thomas Ptacek 认为,2025 年的开源权重模型配合渗透测试工具即可完成沙箱逃逸与网络扫描,这一…

2026.07.23 · 周四2 分钟阅读

知名安全研究者 Thomas Ptacek 近日发表观点,认为当前主流的开源权重大模型在配合专门构建的渗透测试工具链后,已具备执行沙箱逃逸以及在多数网络中完成扫描与入侵的能力。他同时指出,令人意外的点并不在于模型本身能否做到这些,而在于外界将 OpenAI 等闭源厂商的沙箱安全措施视为更可靠的防线。

核心观点

Ptacek 的判断可以拆解为两层:

  • 能力层面:他认为 2025 年发布的开源权重模型,搭配合适的渗透测试框架(pentest harness),就已足够完成沙箱逃逸以及对多数企业网络的扫描与入侵。
  • 认知层面:他强调,外界倾向于默认 OpenAI 这类前沿厂商的沙箱实现更加安全,但这种假设本身才是真正值得警惕的地方。

背景与含义

这段评论出现在 AI 安全研究社区对大模型是否会被恶意用于网络攻击的讨论语境中。开源权重模型的可获取性,使得任何具备一定技术能力的研究者或攻击者都可以在本地部署完整的模型推理环境,并围绕其构建自动化攻击工具链。如果 Ptacek 的经验判断成立,意味着:

  • 大模型在辅助甚至自主执行安全攻击任务上的门槛,已经从「前沿闭源模型」下沉到「开源模型」级别。
  • 企业安全团队对大模型能力的威胁建模(threat modeling)需要尽快将开源模型纳入考量,而非仅关注最顶尖的闭源系统。

局限性

需要指出的是,Ptacek 的上述表述为个人经验和直觉判断,并非基于公开的基准测试或系统性研究。当前没有公开数据显示具体哪些开源模型在哪些沙箱环境下成功逃逸,也没有量化的成功率或复现条件。因此,该观点更适合作为安全社区对 AI 能力演进的警示性参考,而非可直接引用的技术结论。

信源