MiniMax Design 发布视频生成 Agent,切入商业视频赛道
MiniMax 推出以 Agent 为入口的视频生成平台 Design,从需求出发自动完成脚本、分镜、配音与成片,直接对…
MiniMax 近日发布视频生成平台 MiniMax Design,以 Agent 作为创作入口重新组织商业视频生产流程,目标直指 Adobe、Canva 在商业视频与设计协作领域的腹地。同期发布的底层模型 MiniMax H3 提供开放权重、API 与 ComfyUI 接入,已进入剪映国际版 CapCut 平台。
商业视频的「后生成时代」瓶颈
2025 年 Adobe 调研显示,超过 60% 的营销人员认为内容需求已增长至原来的 5 倍或以上。WPP Media 在《2026 年年中全球广告预测》中预计,2026 年全球广告收入将达到 1.3 万亿美元,同比增长 8.9%。
当生成环节被 AI 大幅加速,团队反而将更多时间消耗在需求拆解、分镜设计、版本筛选、校对、跨平台尺寸适配与素材管理上。多工具叠加并未消除这些隐性成本,单纯拼装图片生成、视频动效、配音与剪辑软件,反而带来更多割裂的工作流。要承接「做 100 条视频、下午就要」的常态需求,市场需要一套能从需求直达交付的视频生产平台。
与 Adobe、Canva 的差异化路径
Adobe 正将 Creative Agent 嵌入 Firefly、Photoshop 与 Premiere;Canva 则从模板化设计进一步走向 Agent。两者本质上都是把 Agent 装进既有软件体系。
MiniMax Design 走的是相反的路线:以 Agent 作为创作主入口,用户描述产品、受众、平台、卖点与风格后,主 Agent 负责理解目标、拆解任务并匹配模型,文案、图像、视频与音频 Agent 协同完成脚本、分镜、画面、配音与成片。
产品将脚本、分镜、图像、视频、配音、音乐与编辑统一在同一张 Canvas 上,节点自动连接,减少跨工具素材搬运。重心明确落在短剧、电商内容、品牌 TVC 与广告素材等商业短视频场景。
Skill 机制:把成功方法沉淀为可复用流程
Design 的关键能力之一是自定义 Skill 与插件体系。用户既可通过对话创建 Skill,也可直接调用 Skill Plaza 中已沉淀的工作流,覆盖短剧、分镜、商业广告、电商、音频与音乐等场景,并可借助插件处理电影特效等复杂任务。
- Skill 保存的不只是一段提示词,而是任务拆解顺序、节点关系、模型选择、参考素材、参数约束与质量检查的整套生产方法。
- 制作一条 KOC 种草视频时,目标人群、场景、卖点、口语化脚本、人物、产品露出、字幕与包装均可被封装为可复用 Skill。
- 批量生产 100 条视频时,团队无需逐条重写 Prompt,也不再依赖某位操作人员的个人经验。
- Skill 同时支持多人协作、跨项目复用与人员变动下的一致性交付,使 AI 从一次性灵感工具进一步接近日常生产系统。
底层模型 H3 与开放适配
底层模型 MiniMax H3 项目地址:https://github.com/MiniMax-AI/MiniMax-H3
H3 统一理解文本、图像、视频与音频输入,可生成带同步立体声音频的视频;API 支持 768P 与 2K 输出,时长 4 至 15 秒。
开放适配带来两点直接价值:
- 模型与产品之间反馈链路更短,商业生产中暴露的人物一致性、商品还原、声音同步等问题可更快进入模型迭代。
- 企业可按需选择接入方式:普通创作者直接使用 Design,专业团队连接本地素材与外部工具,具备开发能力的企业则可通过 H3 API、开放权重与 ComfyUI 接入原有生产流程,无需推翻既有资产。
模型开始吞噬软件层
Anthropic 对 50 万次 Claude Code 与 Claude.ai 交互的分析显示,Claude Code 中 79% 的对话包含某种形式的自动化,高于 Claude.ai 的 49%。模型借助 Harness 获得文件读写、命令执行与结果检查能力后,从回答问题的助手变成开发环境里的执行者,这一路径同样适用于内容创作。
当模型获得工具调用与任务规划能力,传统的「软件负责组织、模型负责生成」分工开始被打破。MiniMax Design 以 Agent 为入口、Canvas 组织生产、Skill 复用流程、开放模型适配既有工作流,是模型公司向上吞噬软件层的一个具体样本。
