用 30 秒样本克隆声音。

录制或上传两到三十秒的真实说话声。FuturVoice 会为你转写、构建出这个声音,并用它生成语音--支持十种语言,在浏览器中完成,无需安装任何东西。

什么样的样本才算好

两到三十秒的日常说话声,在任何安静到能听清字词的地方录制都可以。你无需输入任何文字:样本会被自动转写,引擎正是按这份文字稿来对齐的。

接近无声的片段会被直接拒绝,而不是照单全收、做成一个谁都不像的声音。被拒绝的上传不收费,并会告诉你原因。

具体数字

样本长度
2–30 秒
样本大小上限
50 MB
克隆声音支持的语言
10
生成费用
每秒音频 1 个额度
注册即送
500 个额度(≈ 8 分钟)

三种引擎任你选择

声音、引擎和语言都在同一处设置,因此你可以完全复现某一次生成,也可以要求换一个版本。生成按实际交付的音频秒数计费--失败不收费,完全相同的请求第二次也不收费。

声音做好之后会怎样

它会成为你可以拿来创作的素材。生成的片段会落进一条时间轴,可以裁剪、重排和叠加;八种录音棚级音效可以试听而不动原始文件;所有内容都能导出为 WAV、MP3 或 Opus。

关于克隆的问题

克隆一个声音需要多少音频?

两到三十秒的真实说话声--接近无声的片段会被拒绝,而不是拿去做成一个糟糕的声音。样本由我们转写,你无需输入任何文字。

可以用于商业用途吗?

可以,前提是你有权使用这些声音。未经本人许可克隆他人的声音,我们不会提供协助。详见服务条款。

用 500 个免费额度克隆一个声音