跳到正文
ZH

Stable Audio 2

Stability AI 的音频模型

访问官网

Stable Audio 是什么

Stable Audio 是 Stability AI 的生成式音频平台。它从文本提示或你提供的音频产出音乐与音效,version 2 把输出扩展到最长三分钟的完整曲目,结构清晰,并以标准音频分辨率给出立体声输出。它还包含音频到音频的转换与风格重塑,并有一个开放权重的版本供本地试验。

你可以用它做什么

  • 从提示词生成音乐与音效
  • 把一段音频转成另一种风格
  • 产出更长、有结构的曲目
  • 在授权允许的情况下本地运行开放模型
  • 原型验证声音设计想法

适合谁使用

  • 音乐与影视制作人
  • 游戏声音设计师
  • 研究人员与本地模型用户

需要留意什么

  • 托管服务与开放权重版本的授权条款不同,商业使用前两边都要看
  • 生成式音频的训练数据来源在全行业都有争议,请跟进当前的法律进展
  • 更长的曲目发行前仍需母带处理
  • 本地运行需要够格的硬件

优点与缺点

✓ 我们认可的地方

  • 比早期版本输出更长更有结构
  • 支持音频到音频转换
  • 开放权重便于本地使用

! 需要留意的地方

  • 授权随发布渠道不同
  • 训练数据在全行业存在争议
  • 仍需母带处理

常见问题

生成的曲目能有多长?

第 2 版被描述为可生成最长三分钟的完整曲目。

可以用音频作为输入吗?

可以。页面描述了音频转音频与风格重塑。

有本地运行的选项吗?

页面提到 Stable Audio Open 可用于本地试验。

最后评测: 2026-09-18

更多 AI 音乐创作 工具

查看全部 →

评测方法