模型发布
通义 Qwen 模型在 Legal Research Bench 排名升至第 4
通义 Qwen 官方账号透露,其新模型在 Legal Research Bench 上从第 22 名升至第 4 名,但未…
2026.08.12 · 周三约 2 分钟阅读
通义 Qwen 近日通过其官方 X 账号公布了一项 benchmark 进展:其新模型在 Legal Research Bench(法律研究基准)上的排名从第 22 名跃升至第 4 名,官方称这是「稳健的进步」。
事件背景
Legal Research Bench 是面向法律研究任务的大模型评测基准,由学术界提出,用于衡量模型在法律条文检索、法条推理、案例分析等任务上的综合表现。在该基准上取得排名提升,意味着模型在法律领域知识理解与推理方面有所增强。
官方披露信息
- 发布主体:通义 Qwen 官方 X 账号
- 发布形式:社交媒体简短公告
- 排名变化:从第 22 名上升至第 4 名
- 评测基准:Legal Research Bench
- 模型名称:Qwen3.8-Max(该名称在公告中直接出现,与此前已知的 Qwen 系列命名体系并不完全一致,是否为正式发布版本尚需进一步确认)
信息缺口
该公告仅以一条推文的形式发布,缺少以下关键信息:
- 模型参数量、架构、训练数据等基础技术规格
- 在 Legal Research Bench 上各项子任务的具体得分
- 与其他主流模型(如 GPT、Claude、Gemini 等)在该基准上的横向对比
- 是否会开源或开放 API 调用
后续关注
由于官方未同步发布技术博客或论文,上述排名变化的实现路径与具体能力边界尚不清晰。Qwen 系列通常会在后续通过官方博客、模型卡或开源仓库补充详细信息,建议关注通义千问的官方技术渠道以获取完整评测数据与模型说明。
