美国移民律师使用 AI 的伦理规范与可靠性研究综述
梳理 ABA、EOIR 及多州律师协会对律师使用生成式 AI 的具体要求,并呈现斯坦福对主流大模型法律推理幻觉率的实测数…
生成式 AI 在美国法律行业的渗透速度持续加快,但正式成文的 AI 使用政策在多数律所仍是例外。律师将客户信息输入自学习工具前的告知同意、未经核实的 AI 输出能否提交法庭、AI 辅助工作能否计入计费时长等基础问题,长期缺乏统一答案。本文依据美国律师协会(ABA)、移民审查办公室(EOIR)以及多个州律师协会的一手文件,并结合斯坦福 RegLab 的可靠性研究,梳理当前对律师使用 AI 的实际要求。
ABA 512 号正式意见:国家级基线
ABA 于近期发布的 512 号正式意见将律师的五项既有义务与 AI 使用行为逐一对应。能力义务方面,意见并不要求律师变成工程师,仅要求对所用生成式 AI 的「能力与局限」有合理理解;并明确,缺乏这种理解所导致的「不加批判地依赖生成式 AI 内容」可能产生不准确的法律建议,责任仍由律师承担。保密义务方面,意见要求在将案件信息输入自学习工具前取得客户的知情同意,并堵住了一个被许多律所依赖的漏洞:在委托书中加入「通用、模板化的授权条款」并不足以满足要求。法庭诚信义务方面,意见要求 AI 输出必须经过仔细审核,确保向法院陈述的内容不包含虚假信息,即使是无意间的错误陈述,也可能触发职业行为规则 8.4(c) 项下的虚假陈述认定。计费方面,意见给出具体示例:用于提示词撰写与输出审核的 15 分钟可以计费,而单纯「节省」的时间以及律师学习使用工具所花的时间均不可计费。
移民审查办公室的专项指引
EOIR 针对移民程序发布了专门备忘录,其内容比多数从业者预想的更精简。备忘录并未全面禁止律师使用 AI,也没有在全国层面强制要求披露 AI 使用情况,但保留了一项纪律性约束:提交由 AI 幻觉或捏造的内容,可依据 8 C.F.R. § 1003.102(c) 关于「明知或严重漠视地提供虚假证据」的条款受到处罚,备忘录援引 ABA 512 作为说服性权威依据。个别移民法官仍可通过常设命令施加披露要求,因此「EOIR 在国家层面不要求披露」并不意味着「面前的法官不会要求披露」。备忘录本身被定位为临时性文件,EOIR 曾表示司法部预计将在 2025 年底前发布全部门的生成式 AI 指南,但截至本文撰写时,尚无公开信息确认该指南已正式发布。
州级律师协会的差异化立场
部分州律师协会走得比 ABA 更远。佛州的意见包含审查范围内最严格的计费语言,禁止任何「虚假膨胀律师计费工时」的 AI 计费方式,并要求按律师审阅律师助理工作那样的标准审核 AI 输出。德州 705 号意见(2025 年 2 月定稿)点出一个易被忽视的风险:许多生成式 AI 工具通过「对话」方式邀请律师解释案情,可能在律师未察觉的情况下泄露超出本意的保密细节。纽约州任务小组提出了「技术解决方案主义」一词,作为对「AI 自动解决行业司法可及性问题」这一假设的警示,但也提示对真正有用、经过严格审查的工具的全面拒绝,可能在未来演变为能力义务层面的问题。加州正考虑修订其《职业行为规则》正文(涉及规则 1.1、1.4、1.6、3.3、5.1 与 5.3),要求律师独立审核并核实 AI 输出,并明确对捏造、断章取义或脱离语境援引判例的责任;相关修订仍处于律协规则制定程序中,尚未成为具有约束力的法律。
斯坦福 RegLab 的可靠性实测
两项斯坦福研究被频繁引用,却因测试对象不同常被混淆。较早的一项研究由斯坦福 RegLab 团队开展,使用经过验证的真实案件数据集,对通用大模型在 14 类法律推理任务上的表现进行了超过 80 万次查询。幻觉率差距明显:GPT-4 为 58%,GPT-3.5 为 69%,PaLM 2 为 72%,另有模型高达 88%。这一组数据与 ABA 512 中关于「不加批判地依赖 AI 输出将带来不准确法律建议」的判断形成相互印证,也为各州律师协会强化审核要求提供了实证依据。对正在考虑将 AI 整合进执业流程的律师而言,这组数据意味着任何 AI 输出在提交客户或法院前,均需经过与人工起草同等强度的实质性审核。
