模型发布
Runway 上线 WAN 3.0:支持图像、视频、音频多模态参考输入
Runway 官宣 WAN 3.0 模型上线,可生成视频与音频,并支持多模态参考输入。
2026.08.25 · 周二约 2 分钟阅读
Runway 近日通过其官方 X 账号宣布,旗下视频生成模型 WAN 3.0 正式在 Runway 平台上线。该版本被官方定位为「state-of-the-art」,主打视频与音频的一体化生成能力,并首次开放对多种参考输入的支持。
模型核心能力
根据 Runway 的官方公告,WAN 3.0 的核心卖点是「多模态参考输入」:
- 支持同时输入多张图像、视频片段与音频片段作为参考;
- 可基于上述参考生成与之风格、节奏或内容相关的视频与音频输出;
- 官方用「state-of-the-art」描述其生成质量,但未公布具体 benchmark 数据或对比指标。
这与此前仅支持单一图像或文本参考的视频生成工作流相比,输入端的灵活性明显提升。
平台与可用性
- 上线渠道:Runway 网页端及现有产品入口(官方公告中附带访问链接)。
- 账号要求:未在公告中说明是否对所有用户开放或仅限付费用户,尚待官方进一步披露。
- 定价与配额:公告未提及积分消耗、分辨率上限或时长限制等使用细节。
信息有限,待官方补充
值得注意的是,Runway 此次公告以社交媒体短帖形式发布,正文仅寥寥数语,未包含以下通常被开发者与从业者关注的关键信息:
- 模型架构与参数量;
- 与 WAN 2.x 的具体能力差异或对比;
- 视频分辨率、最长生成时长、支持的比例与帧率;
- 同期是否同步开放 API 与企业级接入。
在 Runway 后续发布技术博客、文档或定价说明之前,外界难以对 WAN 3.0 的实际表现做出完整评估。建议关注 Runway 官网与官方 X 账号的更新,以便第一时间获取技术细节与使用条款。
