模型发布
阶跃星辰发布首个音乐生成基础模型 StepAudio 3 Music
阶跃星辰联合 ACE Studio 推出 StepAudio 3 Music,支持文本与歌词一键生成完整歌曲,集成四种创…
2026.09.17 · 周四约 2 分钟阅读
阶跃星辰(StepFun)近日联合 ACE Studio 正式推出 StepAudio 3 Music,这是其首个音乐生成基础模型。该模型面向完整歌曲创作场景,用户只需提供一段文字描述(prompt)和歌词,即可生成一首结构完整、可直接播放的歌曲。
模型定位与核心能力
StepAudio 3 Music 定位于「音乐生成基础模型」,强调可控性与可迭代性。用户可以在提示词中指定以下要素:
- 流派(Genre)、情绪(Mood)与人声风格
- 配器、和声调性(Key)与节奏速度(BPM)
- 歌曲结构与编曲安排
模型支持多次迭代:用户先生成一个版本,再修改提示词、编辑 ABC 乐谱标注,反复打磨直到接近脑海中的声音。
四种创作工作流
StepAudio 3 Music 将四种典型音乐创作场景集成在同一个模型中:
- 🎤 歌曲生成:基于提示词与歌词生成完整歌曲
- 🎹 纯音乐生成:仅产出器乐伴奏,无人声
- 🔁 音乐翻唱(Cover):对已有歌曲进行风格化重新演绎
- 🎙️ 人声转歌曲:上传干声,自动补全编曲与和声
ABC-COT:先规划,再合成
模型的核心技术机制被称为 ABC-COT(Chain-of-Thought in ABC Notation)。在最终音频合成之前,模型会先以 ABC 乐谱形式规划音乐的曲式结构与编曲布局,从而让生成结果更具结构感与可控性。
据官方透露,ABC-COT 相关 API 将「很快上线」,届时开发者可更细粒度地介入这一规划过程。
试用与体验
官方已上线交互式 Demo,用户可在网页端体验上述四种工作流的生成效果。阶跃星辰此次与 ACE Studio 合作推出,也意味着该模型将借助后者在音频工程与音乐人社区中的渠道触达更广泛的用户群体。
作为阶跃星辰在音频生成方向的首款基础模型,StepAudio 3 Music 将公司能力从语音、对话扩展到了完整的歌曲创作领域,后续的 ABC-COT API 与实际生成质量值得持续关注。
