桃子桃子快讯
返回首页
行业动态

网友观察:Qwen 3.8 27B 跻身代码 Arena 第 9,Gemma 4 31B 仅排第 80

Reddit 用户发帖称 Qwen 3.8 27B 在代码 Arena 榜单位列第 9,而 Gemma 4 31B 排名…

2026.08.25 · 周二2 分钟阅读

近日,Reddit 用户 @tarruda 在 r/LocalLLaMA 板块发帖称,社区维护的代码类 Arena 榜单上,通义千问 Qwen 系列的新版本 3.8 27B 已跻身第 9 位,而 Google 的 Gemma 4 31B 仅排在第 80 位,两者排名差距悬殊,引发不少本地模型关注者的讨论。

帖子核心信息

该帖以一行标题概括了观察结果,未附详细分数、参数或评测维度,仅提供了两个模型在榜单上的位次。从表述看,所指的应为 LMArena(原 LMSys Chatbot Arena)的代码 Arena(Code Arena)子榜单,该榜单通过人类盲测投票对不同模型在编程任务上的表现进行两两对比排名。

  • 帖主提到:Qwen 3.8 27B 排名第 9。
  • 同帖对比:Gemma 4 31B 排名第 80。
  • 原帖正文仅含外链占位,未提供截图、数据来源链接或投票数等附加信息。

解读与背景

代码 Arena 排名通常被视为衡量模型实际编程能力的重要参考之一。若 Qwen 3.8 27B 确实稳定在前十,将意味着在 27B 参数量级上,国产模型在编程任务中已具备与一线大模型竞争的实力。而 Gemma 4 31B 排在第 80 位的结果若属实,则与其参数规模所暗示的能力预期存在明显落差,值得关注后续是否会有版本更新或评测条件修正。

需要指出的是,该帖发布时间、截图及具体榜单快照均未在原文中给出,以上信息仅基于标题中两个数字的转述,社区后续是否有官方或第三方跟进确认仍待观察。

信源