必须先完成音色克隆才能让即梦AI数字人使用你的声音,具体步骤为:上传5~30秒含元音、辅音及词组的清晰录音(关闭降噪),生成自定义音色后,在数字人模块的【音色】下拉菜单中选择该音色,并确认“音画同步已启用”再生成。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想让即梦AI数字人开口说话时用你自己的声音,而不是系统预设的“知性女声V3”或“阳光少年”,必须先完成音色克隆,再在数字人模块中调用——这一步不能跳过,否则所有台词都会走默认音库。
上传录音并生成自定义音色
打开即梦AI网页端(https://jimeng.jianying.com/),登录后点击左上角【配音生成】→【克隆音色】。
录制一段5~30秒的清晰人声音频:内容建议包含元音(啊、哦、咿)、辅音(b、p、m、f)和常见词组(如“今天天气很好”“我正在测试语音”),语速自然,避免背景噪音。手机录音即可,但【必须关闭降噪功能,否则AI无法提取真实声纹特征】。
点击“上传音频”,等待约90秒,页面显示“音色生成成功”并自动归入【我的音色】列表。
在数字人中调用你的音色
切换至【数字人】模式→上传人物图片(正脸、光线均匀、无遮挡)→点击右侧【音频】区域。
为使用即梦(Dreamina/Jimeng)Seedance 2.0 进行图生视频(image-to-video)生成提供全面的提示词撰写指南。图生视频提示词采用“增量式”设计:参考图像负责承载静态视觉内容,而文本提示仅需描述画面中**发生运动与变化的部分**。 本技能涵盖以下 4 种子模式: - 单图生视频(single image→video) - 首尾帧过渡(first-last frame transition) - 多帧故事板叙事(multi-frame storyboard na
在【音色】下拉菜单中,找到你刚命名的音色(如“张三-日常语速”),直接点击选中。
输入台词文字,例如:“大家好,我是小满,现在带你看一场山间晨雾。”→点击【生成】前,务必确认左下角提示栏出现“音画同步已启用(Seedance Pro)”字样。未出现则说明模型未加载成功,需刷新页面重试。
验证与修正
第一步:生成完成后播放预览,右下角出现实时跳动的音频波形图,且能听清人声+环境音混合输出;
第二步:若只听到系统提示音或音色失真,立即点【重新生成】,不要下载;
第三步:返回【配音生成】→【我的音色】→点击该音色右侧【编辑】→检查是否误启了“方言混响”或“情感强度>7级”,这些参数会扭曲原始音色,建议先还原为默认值再重试。

















