桃子桃子快讯
返回首页
工具

Fabraix 推出自动红队测试代理 Nyx

Fabraix 发布 Nyx 自动红队测试代理,可对任意 AI 智能体发起对抗性攻击,内置超 1 万条越狱攻击样本。

2026.08.20 · 周四2 分钟阅读

AI 安全初创公司 Fabraix 近日发布了名为 Nyx 的自动红队测试代理(autonomous red-teaming agent),用户可将其指向任意 AI 智能体,自动运行对抗性攻击测试,以暴露系统中的安全漏洞。这是面向智能体(agent)产品的自动化安全评估工具,旨在帮助开发者在发布前后系统性地检测越狱(jailbreak)与提示词注入等风险。

核心功能

Nyx 的核心定位是「针对 AI 智能体的自动化渗透测试」:

  • 内置超过 10,000 条越狱攻击样本库,覆盖多种已知对抗手法;
  • 可对目标智能体发起端到端的对抗性攻击,并记录完整攻击链路;
  • 测试结束后输出可复现的攻击步骤,便于智能体识别漏洞模式;
  • 同一测试可在版本发布后重新回放,验证漏洞是否已被修复。

工作机制

与传统人工红队评估不同,Nyx 采用「自主代理」模式运行:测试人员只需指定目标智能体,Nyx 会自主从攻击库中选取策略,尝试绕过安全防护,并以结构化报告形式回传发现的问题。这意味着即便没有专职安全团队,开发团队也能在 CI/CD 流程中嵌入持续性的对抗测试。

Fabrrax 也展示了语音 AI(voice AI)方向的渗透测试样例,表明该工具的攻击面不止于文本对话,还可覆盖语音交互场景下的智能体安全。

行业意义

随着大模型与智能体在企业场景中加速落地,针对智能体的对抗攻击也日益受到关注。Nyx 试图把「越狱测试」从一次性人工审计,转向可重复、可版本化的自动化流程,降低中小团队的安全评估门槛。不过,该工具同样可能被用于恶意目的——其超过万条的越狱样本库一旦外泄,也可能成为攻击者的现成「武器库」,其分发渠道与使用条款仍有待观察。

整体来看,Nyx 是 AI 安全工具市场中又一例「以 AI 测试 AI」的产品思路,与近期兴起的模型安全评估、护栏(guardrails)类产品形成互补,但其在攻击库覆盖深度、误报率及与企业主流智能体框架的兼容性上仍缺少公开数据支撑。

信源