Zero-shot Voice Cloning

全模态的声音能力,
一个界面就够了。

上传十秒人声即可克隆音色,让任意文字用你的声音读出来。支持情感控制、长文本与多角色配音,成品可直接用于视频、有声书与播客。

按次计费 · 每日签到领取次数 · 请仅克隆已获授权的声音

文本

各位听众,欢迎收听本期节目。今天我们聊一聊,声音是如何被复刻的。

音色
我的录音 · 15s
情感
平静 0.80
语速
1.00×
时长
00:08

能力

从一段录音,到可交付的成品音频

克隆

零样本音色复刻

十秒录音即可复刻音色,不需要训练,也不需要等待。

情感

八维情感与语速

情感向量逐维调节、情感参考音频、0.5–2 倍语速,逐句可控。

长文

长文本自动分段

整篇稿件按句拆分合成再无缝拼接,最长 5000 字一次产出。

多角色

剧本对话配音

写一段「角色:台词」,每个角色分配音色与情绪,一键生成整段对话。

多语言

五种语言

中文、英文、日文、西班牙文、阿拉伯文,同一个音色都能说。

资产

音色库长期复用

音色存在账号里,可命名、试听,跨项目反复使用。

流程

三步出成品

  1. 01

    上传或录制样本

    10–30 秒干净人声,也可以用浏览器直接录。

  2. 02

    输入要说的内容

    粘贴稿件、挑情绪、调语速,长文自动分段。

  3. 03

    试听并下载成品

    结果保存在生成记录里,随时试听与下载 WAV。

现在就开始

注册即用,按次计费;会员每天签到领更多次数。