AuK:语音生成与编辑开源基础模型

支持的任务

  • 语音生成:音色克隆合成 · 文字描述音色合成
  • 内容编辑:歌词编辑 · 语音内容编辑
  • 声学编辑:音调编辑 · 语速编辑 · 音量编辑
  • 副语言编辑:情绪 · 音色 · 去口音 · 非语言声编辑 · 气声转换
  • 增强与分离:语音增强 · 人声分离 · 音乐分离

指令增强器可选,默认开启。开启时,时长填 0 表示自动估算,填大于 0 的值则覆盖估算结果。关闭时必须显式填写大于 0 秒的时长——即便已提供参考音频或文本也一样。

若本 Space 响应缓慢或不可用,可改用官方的 ModelScope 创空间

默认开启:自动判定任务类型并生成标准指令。时长保持 0 表示自动估算,填入数值则覆盖估算。关闭后必须填写大于 0 的时长。
模型
0 120

开启指令增强器:0 = 自动估算,大于 0 则覆盖估算。关闭时请填写大于 0 的值。

4 64
0 5

Base:NFE 32 / CFG 2.0 · Flash:NFE 4 / CFG 0(锁定)

指令增强器输出

示例

点击任意示例即可载入左侧面板,然后点 生成。也可以换不同的随机种子试试。