桃子桃子快讯
返回首页
行业动态

OpenAI 用自家模型排查并修复内部关键漏洞,将公开方法论

OpenAI 联合创始人 Greg Brockman 透露,公司用自有模型发现并修复内部系统关键漏洞,团队规模超 250…

2026.09.10 · 周四2 分钟阅读

OpenAI 联合创始人 Greg Brockman 在 X 平台透露,公司已利用自有大模型对内部系统进行安全审计,并定位、修复了一批关键漏洞。这项工作由 OpenAI 内部超过 250 人的跨团队协作完成——这一规模本身意味着,AI 实验室已不再把模型仅当作对外交付的产品,而是同时用作防御自身基础设施的核心工具。

为何值得关注

OpenAI 处于 AI 能力前沿,其内部系统既包括训练与推理平台,也覆盖对外服务与数据管线,攻击面与价值都极高。将模型投入安全排查,本质上是「用 AI 防御 AI 系统」的一次大规模实战。如果方法论有效并被推广,将为整个行业提供可复用的参考。

当前已披露的信息

  • 执行主体:OpenAI 内部 250+ 人的协作团队。
  • 核心动作:使用 OpenAI 自研模型对内部系统进行漏洞发现与修复。
  • 后续动作:OpenAI 计划公开 playbook(操作手册)、学习心得(learnings)与架构设计,供业内参考。

仍待回答的问题

目前 Brockman 的发言仅为一则预告,公开材料中并未给出以下关键细节:

  • 涉及哪些类型的漏洞(如越权访问、注入、模型特有攻击等)。
  • 用了哪一类模型能力(代码理解、推理、agent 编排等)。
  • 人机协作的具体分工(哪些环节由模型主导,哪些仍由安全工程师闭环)。
  • playbook 与架构文档的发布时间与获取方式。

小结

这则消息的主语是「OpenAI 用 AI 做安全」,但谓语和宾语尚未展开。在官方放出 playbook 之前,更适合将其视为一条信号——头部 AI 实验室已将「模型驱动的防御」纳入正规工程流程,而非一次性演练。读者可以保持关注,待完整材料发布后再评估其方法是否可被中小团队复用。

信源