需完成六步:一、注册登录;二、Voice Lab创建语音并选“Clone from Audio”;三、上传3–8秒高质量单声道音频;四、点击Train Model等待状态变Ready;五、在Settings设语言、情绪、语速;六、Create Speech输入文本生成首段语音。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望在Resemble AI平台上创建属于自己的克隆声音,但尚未完成语音模型的初始化与配置,则可能是由于缺少关键音频样本或未按流程完成平台内各模块的联动设置。以下是完成Resemble AI声音克隆完整设置的具体步骤:
一、注册账户并登录控制台
访问Resemble AI官网是启动整个克隆流程的前提,只有完成身份验证才能进入语音管理界面并调用训练功能。
1、打开浏览器,访问 https://www.resemble.ai 官方网站。
2、点击页面右上角“Sign Up”按钮,支持使用邮箱或GitHub账号注册。
3、查收注册邮箱中的验证链接,完成激活后返回登录页输入凭证。
4、成功登录后,系统将自动跳转至仪表板(Dashboard)界面。
二、进入Voice Lab并创建新语音
该步骤用于声明克隆意图并为后续声纹建模分配独立资源空间,所有克隆语音均需在此模块中显式新建。
1、在左侧导航栏点击 “Voice Lab” 选项。
2、在主界面中点击 “Create Voice” 按钮。
3、在弹出窗口中为语音输入唯一名称,例如“张三-中文旁白”。
4、从模式选项中选择 “Clone from Audio”,而非预设语音或文本驱动生成。
三、上传高质量音频样本
音频质量直接决定克隆语音的自然度与稳定性,系统仅接受无背景噪音、单人发音、格式合规的原始录音。
1、准备一段时长为3–8秒的WAV或MP3文件,内容应包含清晰元音与辅音组合,如“你好,今天很高兴见到你”。
2、确保录音环境安静,采样率为16kHz,单声道,无压缩处理。
3、在创建语音界面中点击上传区域,拖入或选取该音频文件。
4、上传完成后,系统将自动显示音频波形图及基础元数据校验结果。
四、启动训练并确认模型就绪状态
平台基于实时嵌入式声纹建模技术对音频进行特征提取,生成可复用的语音嵌入向量,无需用户干预训练参数。
1、音频上传完毕后,页面自动出现 “Train Model” 按钮,点击启动训练。
2、等待进度条完成,通常耗时30–90秒,期间不可刷新页面。
3、训练结束后,对应语音条目状态栏将由“Processing”变为 “Ready”。
4、点击该语音右侧的“⋯”菜单,选择“View Details”,可查看梅尔频谱对比图与韵律标记覆盖率。
五、配置语言、情绪与语速参数
Resemble AI支持多语言混合识别与细粒度情感建模,这些设置在语音生成阶段生效,但需在模型就绪后预先定义。
1、在语音详情页中找到 “Settings” 标签。
2、下拉选择目标语言,包括简体中文、粤语、英语、日语等共12种语言选项。
3、在“Emotion”区域勾选预设情绪类型,如“Confident”、“Calm”、“Excited”等,每种情绪对应独立韵律模板。
4、滑动“Speed”调节条,在0.7x–1.3x范围内设定默认语速,该值可在每次生成时覆盖。
六、输入文本并生成首段克隆语音
此步骤验证语音模型是否已正确绑定文本解析引擎与声学合成器,是设置流程的最终功能性确认环节。
1、返回仪表板,点击顶部导航栏的 “Create Speech”。
2、在中央文本框中输入不超过500字符的测试语句,例如“欢迎使用Resemble AI语音克隆服务”。
3、在语音下拉菜单中,选择刚刚创建并标记为“Ready”的克隆语音。
4、点击 “Generate” 按钮,系统开始合成音频。
5、生成完成后,播放器将自动加载输出结果,可反复试听基频连续性与停顿自然度。


















