开源
AI Agent 安全事件数据集发布:千起事件分类整理
HuggingFace 上线 AI Agent 安全事件数据集,收录超千起分类事件,涵盖提示注入、沙箱逃逸等多种攻击类型…
2026.08.26 · 周三约 2 分钟阅读
一项针对 AI 智能体安全的开源数据集在 HuggingFace 上线,目前已收录超过 1,000 起经过分类的安全事件,其中 82 起被标记为严重级别。该数据集采用 CC BY 4.0 协议开放,每条记录均附有可验证的来源链接,便于研究者追溯与复核。
数据来源与采集方式
数据集的采集流程完全在本地运行,作者使用联想 Legion 笔记本(仅 CPU)配合 Ollama 与 Llama 3.1 8B 模型,自动从 NVD/CVE、GitHub Advisories、Hacker News 以及多个安全资讯源持续抓取并归类事件。整套数据管道的代码已在 GitHub 开源,供社区审阅与改进。
主要统计与分类
根据已公开的统计概览,该数据集的主要特征包括:
- 收录事件总数:1,000+ 起,其中严重事件 82 起
- 受影响最多的厂商:NVIDIA(48 起)、OpenAI(46 起)、TensorFlow(44 起)
- 主要攻击类型:API 漏洞利用、未授权操作、配置漏洞利用、数据外泄、提示注入(prompt injection)、沙箱逃逸(sandbox escape)等
- 新发现的攻击模式:slopsploit_attack_chain,由模型在分析中识别并归入分类体系
意义与局限
该数据集填补了 AI Agent 安全领域公开、可溯源事件资料的空白,对研究智能体攻防、红队测试与防御策略的研究者具有一定参考价值。不过,该项目由社区个人维护,更新频率与覆盖范围受限于其本地算力(一台仅 CPU 的笔记本)以及数据源广度,且未提供与商用级威胁情报平台同等粒度的元数据。在使用其结论时,仍建议结合官方安全公告与其他独立来源交叉验证。
项目作者公开邀请社区反馈,包括误报修正、分类体系改进以及新数据源建议。数据集最近一次更新标注为 2026 年 8 月 23 日。
