桃子桃子快讯
返回首页
开源

商汤 SenseNova 发布 U1-8B-MoT-图像 V3:8B 开源权重,编辑能力升级

商汤推出 SenseNova-U1-8B-MoT-Infographic-V3,8B 参数、Apache 2.0 许可,…

2026.07.22 · 周三2 分钟阅读

商汤 SenseNova 团队近日上线了 SenseNova-U1-8B-MoT-Infographic-V3 图像模型,相较两个月前发布的 V2 进一步打磨了编辑能力与生成质量。模型权重以 Apache 2.0 协议开源,参数规模为 8B,可在本地或私有环境部署。

模型能力覆盖四类编辑场景

据官方介绍,SenseNova-U1-8B-MoT-Infographic-V3 针对信息图(infographic)类图像提供四类编辑能力:

  • 局部文本编辑:圈选区域或用自然语言指定,替换特定文本,可用于修正错别字、修改数字、调整标题,其余内容保持不变。
  • 局部内容编辑:在指定位置增删或替换图表、图标、物体等局部元素。
  • 全局风格编辑:切换整体视觉风格(如乐高、赛博朋克、传统中国风、复古地图等),同时保留内容与版式。
  • 全局布局编辑:重新组织并美化版式布局,避免信息丢失。

开发者反馈中重点提及「只改一处错别字而不会重绘整张图」的体验,认为这显著降低了无效重生成次数。

训练范式调整带动质量小幅提升

与 V2 在已有 T2I(文生图)模型上「叠加」编辑能力的做法不同,V3 回到多任务训练(MT)阶段,将 T2I 与编辑联合训练。官方在 Qwen-Image-Bench 上的得分由 V2 的 48.00 提升至 50.23,生成质量未出现回退。

资源与许可

  • 模型权重:Hugging Face 仓库 sensenova/SenseNova-U1-8B-MoT-Infographic-V3
  • 代码与文档:GitHub OpenSenseNova/SenseNova-U1
  • 权重许可:Apache 2.0
  • 参数规模:8B

该版本面向信息图编辑与生成场景,适合需要稳定文本保真与风格/布局可控的中小规模部署项目。

信源