开源
Qwen3.8-27B 登顶 Harvey 法律 Agent 基准开源权重榜首
通义千问宣布 Qwen3.8-27B 在 Harvey 法律 Agent 基准测试中位列开源权重模型第一,可本地部署。
2026.08.19 · 周三约 2 分钟阅读
通义千问(Qwen)官方账号近日宣布,新模型 Qwen3.8-27B 在 Harvey 发布的 Legal Agent 基准测试中取得开源权重(open-weight)模型第一名,并强调该模型「足够强大」以处理专业法律任务,同时「足够小」可在本地机器上运行。官方将其定位为可融入日常工作流的开源大模型。
核心进展:Legal Agent 基准登顶
据 Qwen 官方披露,Qwen3.8-27B 在 Harvey 的 Legal Agent 基准上超越其他开源权重模型,排名第一。Harvey 是面向律所与法律团队的法律 AI 平台,其 Legal Agent 基准专注于评估大模型在真实法律场景中的智能体能力,涵盖合同审阅、案件研究、法律文书起草等任务,是当前法律垂直领域较受关注的一项评测。
模型定位与特性
- 参数规模:27B 参数级别,介于中型与大型模型之间。
- 开源权重:以开放权重形式发布,开发者可自由下载、微调与本地部署。
- 本地可运行:官方强调其对硬件要求友好,可在消费级或单卡工作站上运行。
- 专业场景:面向法律等专业领域任务,而非通用聊天场景。
信息局限
需要指出的是,Qwen 官方本次披露的信息较为简洁,尚未公开:
- Qwen3.8-27B 在基准上的具体得分与排名细则。
- 与闭源模型及同尺寸开源模型(如 Llama、DeepSeek 等)的对比数据。
- 模型的架构细节、训练数据、微调方法与技术报告。
- 官方下载渠道与许可证类型。
上述信息的缺失,使外界目前难以全面评估该模型的真实能力与适用边界。后续如 Qwen 团队发布更详细的技术说明或开放下载链接,可进一步验证其宣称的性能与可用性。
行业意义
Qwen 此次的成绩,体现了两条趋势:一是开源权重模型在垂直专业领域(尤其是法律、金融、医疗等高门槛行业)持续追赶闭源模型;二是中等参数规模(27B 级别)模型在「性能与可部署性」之间的平衡能力,正在成为开源社区的重要发力点。但鉴于目前披露信息有限,行业分析师与开发者仍需等待更多技术细节与第三方复现,方可做出更准确的判断。
