开源
商汤开源 SenseNova-U1-8B 信息图视觉文档模型
商汤在 X 平台宣布开源 SenseNova-U1-8B-MoT-Infographic-V2 模型,面向专业视觉文档与…
2026.07.22 · 周三约 2 分钟阅读
商汤(SenseTime)近日在其官方 X 账号上公布了最新开源模型 SenseNova-U1-8B-MoT-Infographic-V2,定位为面向专业视觉文档生成的多模态模型,重点能力是自动产出信息图(infographic)以及文本—图像交错内容。
发布背景
该模型由商汤「日日新(SenseNova)」系列推出,属于 8B 参数规模的开源权重版本。商汤在公告中将其描述为「为专业视觉文档打造」的开源模型,目标用户是需要批量生成结构化图文资料的内容创作者与团队。公告同时感谢了 YouTuber Ai_Wave111 对该模型的独立评测视频。
能力与使用场景
根据商汤官方描述,SenseNova-U1-8B-MoT-Infographic-V2 的核心卖点包括:
- 专业视觉文档生成:可将结构化信息自动转化为信息图形式,降低排版成本。
- 文本—图像交错输出:支持在同一画面中交替排布文字与图像元素。
- 内容创作加速:商汤官方称其能「显著加快内容创作流程」,但未给出具体速度或质量对比数据。
获取方式
用户可通过以下渠道体验或下载该模型:
- SenseNova Studio 在线体验(含信息图生成入口)。
- Hugging Face 仓库下载开源权重。
- Discord 社区参与文本—图像交错生成的交流。
- Token Plan 付费 API 配额方案。
信息局限
需要指出的是,商汤此次公告以推广为主,并未同步披露模型架构细节、训练数据规模、在标准基准(如信息图质量、人工评估或自动评测)上的表现,也未与同类模型进行横向对比。对于希望评估该模型实际效果的用户,建议直接参考评测视频或在 Hugging Face 上自行测试。
