开源
商汤 SenseNova 发布 U1-8B-MoT-图像 V3:8B 开源权重,编辑能力升级
商汤推出 SenseNova-U1-8B-MoT-Infographic-V3,8B 参数、Apache 2.0 许可,…
2026.07.22 · 周三约 2 分钟阅读
商汤 SenseNova 团队近日上线了 SenseNova-U1-8B-MoT-Infographic-V3 图像模型,相较两个月前发布的 V2 进一步打磨了编辑能力与生成质量。模型权重以 Apache 2.0 协议开源,参数规模为 8B,可在本地或私有环境部署。
模型能力覆盖四类编辑场景
据官方介绍,SenseNova-U1-8B-MoT-Infographic-V3 针对信息图(infographic)类图像提供四类编辑能力:
- 局部文本编辑:圈选区域或用自然语言指定,替换特定文本,可用于修正错别字、修改数字、调整标题,其余内容保持不变。
- 局部内容编辑:在指定位置增删或替换图表、图标、物体等局部元素。
- 全局风格编辑:切换整体视觉风格(如乐高、赛博朋克、传统中国风、复古地图等),同时保留内容与版式。
- 全局布局编辑:重新组织并美化版式布局,避免信息丢失。
开发者反馈中重点提及「只改一处错别字而不会重绘整张图」的体验,认为这显著降低了无效重生成次数。
训练范式调整带动质量小幅提升
与 V2 在已有 T2I(文生图)模型上「叠加」编辑能力的做法不同,V3 回到多任务训练(MT)阶段,将 T2I 与编辑联合训练。官方在 Qwen-Image-Bench 上的得分由 V2 的 48.00 提升至 50.23,生成质量未出现回退。
资源与许可
- 模型权重:Hugging Face 仓库
sensenova/SenseNova-U1-8B-MoT-Infographic-V3 - 代码与文档:GitHub
OpenSenseNova/SenseNova-U1 - 权重许可:Apache 2.0
- 参数规模:8B
该版本面向信息图编辑与生成场景,适合需要稳定文本保真与风格/布局可控的中小规模部署项目。
