桃子桃子快讯
返回首页
模型发布

通义 Qwen 模型在 Legal Research Bench 排名升至第 4

通义 Qwen 官方账号透露,其新模型在 Legal Research Bench 上从第 22 名升至第 4 名,但未…

2026.08.12 · 周三2 分钟阅读

通义 Qwen 近日通过其官方 X 账号公布了一项 benchmark 进展:其新模型在 Legal Research Bench(法律研究基准)上的排名从第 22 名跃升至第 4 名,官方称这是「稳健的进步」。

事件背景

Legal Research Bench 是面向法律研究任务的大模型评测基准,由学术界提出,用于衡量模型在法律条文检索、法条推理、案例分析等任务上的综合表现。在该基准上取得排名提升,意味着模型在法律领域知识理解与推理方面有所增强。

官方披露信息

  • 发布主体:通义 Qwen 官方 X 账号
  • 发布形式:社交媒体简短公告
  • 排名变化:从第 22 名上升至第 4 名
  • 评测基准:Legal Research Bench
  • 模型名称:Qwen3.8-Max(该名称在公告中直接出现,与此前已知的 Qwen 系列命名体系并不完全一致,是否为正式发布版本尚需进一步确认)

信息缺口

该公告仅以一条推文的形式发布,缺少以下关键信息:

  • 模型参数量、架构、训练数据等基础技术规格
  • 在 Legal Research Bench 上各项子任务的具体得分
  • 与其他主流模型(如 GPT、Claude、Gemini 等)在该基准上的横向对比
  • 是否会开源或开放 API 调用

后续关注

由于官方未同步发布技术博客或论文,上述排名变化的实现路径与具体能力边界尚不清晰。Qwen 系列通常会在后续通过官方博客、模型卡或开源仓库补充详细信息,建议关注通义千问的官方技术渠道以获取完整评测数据与模型说明。

信源