工具
CrewScore:浏览器本地的 AI 提示词护栏覆盖检查工具
CrewScore 在浏览器本地对照 23 项公开护栏控制项检查 AI 提示词,不上传内容、无需 API Key,可接入…
2026.08.13 · 周四约 2 分钟阅读
CrewScore 是一款面向 AI Agent 提示词的开源护栏覆盖检查工具,其 0.6.11 版本在 Hacker News 上以 Show HN 形式发布。工具在浏览器本地运行,把用户粘贴的 AI 指令与 23 项公开护栏控制项逐一比对,输出「已覆盖」与「待补充」的列表,并提示首个需要关注的缺口。整套流程不上传提示词文本,不需要注册账号、API Key 或调用任何模型。
核心功能与定位
与传统基于运行时行为的评测不同,CrewScore 明确表示自己检查的是「书面控制覆盖」,而不是 Agent 是否真的执行了这些规则。开发者可以选择三类输入来源:系统提示词 / AI 指令、编码 Agent 指令,或通用 AI 助手指令,也支持直接粘贴 ChatGPT 自定义指令、Claude Project 提示词、客服 Bot 提示词等。
- 23 项公开控制项,规则集与版本号完全公开
- 评分在浏览器内完成,提示词文本不会离开本地
- 提供开发者模式,可查看每条控制项的精确匹配与 ID
- 支持命令行版(CLI)与 GitHub Action,可针对特定控制项设置 CI 策略
局限与适用场景
项目方在文档中坦率说明了边界:CrewScore 不做质量排名、不提供认证、也不执行运行时测试,结论不能等同于 Agent 安全。对于已经在团队仓库内维护 AI 提示词的工程团队而言,它更像一个「防退化」工具:在 CI 流程中强制要求某些安全话术必须出现在提示词里,缺失时输出 SARIF 格式的发现项。
开源与社区参与
所有控制项、正则表达式与规则集版本均以开源形式发布,开发者可查阅打分目录或提交自定义规则。CLI 与 GitHub Action 均为开源组件,便于在现有 DevSecOps 流程中复用。整体来看,CrewScore 适合作为 AI 应用工程化阶段的辅助检查项,而非模型层级的安全保障手段。
