桃子桃子快讯
←返回首页
模型发布

ZeroDrift 发布 Anchor 3.0:面向合规审查的小型专用模型

ZeroDrift 推出 Anchor 3.0,号称首个合规执行模型,在 FINRA 基准上召回率高于七款前沿模型,速度…

2026.09.25 · 周五约 4 分钟阅读

AI 初创公司 ZeroDrift 发布了 Anchor 3.0,并将其定位为「首个合规执行模型」。不同于通用大模型在 prompt 中塞入规则手册的做法,Anchor 3.0 是一款参数量在 100 亿以下的小型语言模型,将金融、保险、医疗等领域的大量监管规则直接「写进」权重中,企业自有政策可通过 LoRA 适配器或文档上传方式加入。

核心定位:通用模型做推理,执行模型做裁决

ZeroDrift 把这一类产品称为 enforcement model。其工作方式是:读取一条 AI 即将发给客户的消息,找出违反法规或公司政策的措辞,给出改写版本,并对改写结果做二次校验。模型返回的不是开放式回答,而是一个决策(违规/合规)、所引用的规则条款、原文片段以及已校验过的合规改写,所有决策都会被记录可追溯。

公司表示,Anchor 3.0 单条消息推理约 1.5 秒,成本约 1 美分,因此可以对 agent 发出的每一条消息都做检查,无需采样。

基准对比:召回率领先,速度与成本大幅占优

ZeroDrift 与数据标注公司 Surge AI 合作,构建了一个包含 150 条任务的「FINRA Communications Benchmark」,由人类合规审核员标注。Anchor 3.0 与七款被其标注为「frontier model」的模型在同一基准上对比,结果如下:

  • 召回率(Recall):Anchor 3.0 为 95.5%,其余模型分布在 61.1%–92.9% 之间。ZeroDrift 称,比表现最接近的前沿模型 GPT-5.6 Sol(high)少漏掉 37% 的违规。
  • p95 延迟:Anchor 3.0 为 1.51 秒,仅次于 Gemini 3.5 Flash-Lite(1.58 秒),但显著快于其它前沿模型;自部署在客户 VPC 中时延迟可低于 100 毫秒。
  • 每千条消息成本:Anchor 3.0 报价 10 美元(包含改写与校验,无输出 token 计费),低于 Sonnet 5、Sol、Opus 5、Astra、Fable 5.1 等多款前沿模型。

ZeroDrift 称最快可比前沿模型快 34 倍、最多便宜 12 倍。需要指出的是,基准中列出的部分模型名称(如 GPT-5.6 Sol、GPT-6 Astra、Claude Opus 5、Claude Sonnet 5、Gemini 3.5 Flash-Lite 等)在公开信息中尚无对应产品,且基准标注的日期为 2026 年 9 月,对比结果的外部可验证性有限。

精度与权衡

在精度(precision)维度,Anchor 3.0 为 55.7%,与 Sol(55.0%)、Astra(49.6%)处于相近区间,但低于 Haiku 4.5(69.3%)、Fable 5.1(60.8%)等模型;F1 分数为 72.2%,并非所有对比模型中最高(Sonnet 5 为 79.7%、Fable 5.1 为 73.7%)。

ZeroDrift 认为,在合规场景下「漏报一条违规」可能招致监管处罚,而「误报」只是增加人工复核成本,因此将召回率作为首要指标。该公司也表示,所有模型在同一测试集上对人类审核员的标注做评分,已尽量控制测试条件一致。

部署形态

Anchor 3.0 可通过 ZeroDrift 的 API 调用(每千条消息 10 美元统一价),也支持自部署在企业自有云环境中,单 GPU 即可运行,对应参数规模在 100 亿以下。整体上,这一产品定位介于传统规则引擎与通用大模型之间,主打低延迟、低成本、可解释的合规前置检查。

信源