桃子桃子快讯
返回首页
模型发布

Qwen3.8-Max 登顶 Image-to-WebDev Arena 榜单第二

阿里通义千问团队宣布 Qwen3.8-Max 在 Image-to-WebDev Arena 榜单中位列第二,强调其图像…

2026.08.05 · 周三2 分钟阅读

阿里通义千问团队日前在 X 平台宣布,旗下模型 Qwen3.8-Max 在 Image-to-WebDev Arena 榜单中位列第二。官方配文以「It sees, it builds」概括该模型的能力定位,即从图像识别到网页构建的一体化输出能力。

榜单背景

Image-to-WebDev Arena 是一项聚焦于「图像到网页开发」任务的大模型评测基准,用户给出设计稿或界面截图,模型据此生成可运行的网页代码,排名依据社区投票或自动化评估结果。能够进入榜单前列,意味着模型在视觉理解、代码生成与前端工程化方面均具备一定水准。

Qwen3.8-Max 的定位

从官方表述看,Qwen3.8-Max 是 Qwen 系列在多模态与代码生成方向的最新迭代版本,强调:

  • 视觉理解:可解析输入图像的布局、组件与样式。
  • 代码生成:直接产出 HTML、CSS 及部分 JavaScript 代码。
  • 一体化流程:从图像识别到网页搭建的端到端能力。

不过,本次官方披露极为简洁,仅给出排名结果与一句宣传语,未公布具体的投票分数、与榜首模型的差距、模型参数量、上下文长度或上下文窗口等技术细节

信息不足之处

截至目前,公开渠道尚未透露以下关键信息:

  • Qwen3.8-Max 的正式发布日期与可用渠道(如 API、开源权重、网页应用等)。
  • 是否相较前代 Qwen3 系列在多模态能力上有架构层面的升级。
  • Image-to-WebDev Arena 的具体评测方式与样本规模。
  • 与 Gemini、Claude 等同类多模态模型在网页生成任务上的横向对比数据。

小结

Qwen3.8-Max 进入 Image-to-WebDev Arena 第二名,说明通义千问在视觉到代码的端到端生成方向上具备一定竞争力;但本次披露信息量极为有限,读者若需评估其真实能力边界,仍需等待后续官方更完整的技术说明或独立评测。

信源