模型发布
商汤开源 SenseNova U1.5-Lite 预览版,8B 多模态模型
商汤发布 8B MoT 参数的多模态模型 SenseNova U1.5-Lite 预览版,支持 4K 分辨率生成与编辑,…
2026.08.03 · 周一约 2 分钟阅读
商汤(SenseTime)近日通过官方 X 账号发布 SenseNova U1.5-Lite 预览版,这是一款基于自研 NEO-Unify 原生统一架构打造的轻量级多模态模型,采用 8B MoT 参数规模,以开源形式向社区开放。官方称,该模型在生成与编辑质量上已可比肩主流闭源商用模型。
模型亮点
SenseNova U1.5-Lite 基于 NEO-Unify 原生统一架构设计,能够在同一模型中统一完成理解、推理、生成与编辑等多模态任务,主要能力更新包括:
- 支持最高 4K 分辨率输出,细节更丰富、视觉瑕疵更少;
- 强化中英文文本渲染能力,可应对复杂版面排版合成;
- 视觉控制更精准,对长提示词与多重约束的响应更稳定;
- 原生图像编辑能力更可靠,覆盖参考图风格迁移、多参考合成、局部信息图编辑与文本编辑等场景。
基准表现
相比前代 U1,U1.5-Lite 在多个生成与编辑基准上均有明显提升:
- Qwen-Image-Bench:47.14 → 55.20(含 PE)
- ImgEdit-Bench:3.90 → 4.37
- GEdit-Bench-en:7.47 → 8.17
- GEdit-Bench-zh:7.42 → 8.05
开源与后续规划
此次发布为预览版本,权重与代码已同步上线 GitHub 与 Hugging Face,开发者可通过官方仓库获取并测试。同时商汤表示,面向创作者的生产级版本 U1 Pro 也将在不久后向公众开放。
生态信息
- GitHub 仓库:SenseTime 官方链接
- Hugging Face 模型页:SenseTime 官方链接
- 社区讨论入口:官方 Discord
从 U1 到 U1.5 的开源迭代,反映了商汤在基础模型层面的持续投入;8B 量级的轻量化设计也降低了多模态生图与编辑能力的部署门槛,为后续本地化推理与二次开发留出了空间。
