桃子桃子快讯
返回首页
开源

商汤开源 SenseNova U1:把推理与生图放进同一个流程

商汤发布开源模型 SenseNova U1,将推理与图像生成统一为一个流程,支持信息图模式与图文交错生成。

2026.08.04 · 周二2 分钟阅读

商汤在 X 平台官方账号发文,宣布其开源多模态模型 SenseNova U1 正式开放体验。该模型的核心卖点是把「推理」与「图像生成」统一在同一条工作流中,用户输入一次提示即可得到兼具逻辑输出与视觉呈现的结果,目前已上线 SenseNova Studio、Hugging Face 与 GitHub 等渠道。

两种主推模式

商汤在发布中重点演示了两个应用场景:

  • 信息图模式(Infographic Mode):单条 prompt 即可生成结构化幻灯片,含图标、分区与排版,适合快速产出可视化汇报材料。
  • 图文交错模式(Interleaved Mode):模型按步骤交替生成文字与图像,官方案例中展示了用六步绘图教程的形式「边讲边画」,可直接用作教学类内容。

模型定位与差异点

相较于常见的「先思考、再单独调生图模型」的两段式方案,SenseNova U1 把推理与生图合并到同一流程内,目标降低多模态应用的工程复杂度。原文中特别感谢了一位名为 Dan 的用户进行早期测试,并未披露参数规模、训练数据、评测基准等更多技术细节。

获取渠道

目前模型可通过以下方式试用或下载:

  • 在线体验:SenseNova Studio 官网优先上线「信息图」功能,文图交错生成需加入 Discord 社区解锁。
  • 开源权重与代码:Hugging Face 与 GitHub 已同步发布。
  • 社区运营:商汤开设了 Discord 频道,便于开发者反馈与交流。

从发布形式看,SenseNova U1 仍处于早期开放阶段,官方放出的更多是产品形态演示而非 benchmark 数据,其在主流多模态榜单中的实际表现、与现有开源方案的对比仍待后续披露。

信源