跳到正文
ZH
English soon 简体中文 日本語 soon

Fish Audio

多种语音模型的语音合成

访问官网

Fish Audio 是什么

Fish Audio 是一个 AI 语音合成与克隆平台。它提供文字转语音与声音克隆,可以用大约三十秒清晰音频构建个人语音模型,并支持多语言与跨语言生成,内置大量语音模型,免费与付费套餐都能通过 API 访问。

厂商声称其开源项目 Fish-Speech 在 TTS-Arena2 评测中排名第一。

你可以用它做什么

  • 从文本生成语音
  • 用一段短样本构建语音模型
  • 制作跨语言配音
  • 通过 API 集成合成能力

适合谁使用

  • 内容创作者与播客主
  • 制作多语言音频的团队
  • 需要接入文字转语音的开发者

需要留意什么

  • 克隆需要说话者同意,三十秒的样本让滥用变得容易,绝不要克隆他人
  • 评测排名属于厂商自述,要用自己的素材测试
  • 库里的语音模型可能模仿真人,商业使用前核对许可
  • 跨语言输出要听一遍口音与措辞问题

优点与缺点

✓ 我们认可的地方

  • 克隆所需样本很短
  • 模型库庞大
  • 提供 API 与免费套餐

! 需要留意的地方

  • 克隆很容易被滥用
  • 排名说法来自厂商
  • 模型许可需要核对

常见问题

克隆需要多少音频?

公开信息称需要大约三十秒清晰语音。

它支持其他语言吗?

支持。官网把多语言与跨语言生成列为能力。

有免费方案吗?

有。免费版与付费版都提供。

最后评测: 2026-09-18

更多 AI 音频工具 工具

查看全部 →

评测方法