可灵2.6/01支持音画同出,需在「配音台词」框输入简体中文台词、选择增强型音色、提示词中明确描述说话动作,并关闭“仅生成画面”开关。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果你已经用可灵AI生成了一段文生视频,但人物只是做动作、没说话,现在想让TA准确说出你写好的台词(比如“人生自古谁无死,留取丹心照汗青”),就必须绕过默认的静音输出,启用其内置的音画同出能力——这在可灵2.6版本中已成标配,无需额外配音再对口型。
确认模型版本与入口
打开可灵AI官网(klingai.kuaishou.com),登录后点击「AI视频」→「文生视频」。右上角查看当前模型标识,必须为【可灵2.6】或【可灵O1】;若显示“可灵1.6”或“可灵2.0”,则不支持直接音画同出,需先切换模型。
注意:旧版模型即使输入文本提示词,也不会生成语音,强行提交只会输出无声视频。
输入台词并启用语音合成
在“图片创意描述”下方,找到新增的「配音台词」文本框(非旧版的“提示词”栏),直接粘贴你要人物说出的中文台词,例如:“三十功名尘与土,八千里路云和月”。
确保台词为简体中文,单句不超过12秒(约50字以内),避免使用括号注释、英文缩写、生僻古字。若含标点,只保留逗号、句号、感叹号、问号;顿号、分号、破折号会导致TTS解析异常,嘴型错位。
选择音色与情绪参数
方法一:下拉选择预置音色
点击「音色」右侧下拉菜单,优先选带【Emotion-Enhanced】或【Viseme-Optimized】后缀的中文音色,如“Lingyun(Emotion-Enhanced)”“Xiaoqiu(Multilingual)”。普通音色(如“ZhangSan”“LiSi”)缺乏唇形绑定能力,嘴动不同步。
方法二:微调语气节奏
展开「高级语音设置」,拖动「语速」滑块至0.9–1.1区间(默认1.0),勾选「启用呼吸停顿」。这会让AI在逗号、句号处自然换气,避免一字一顿的机械感。不勾选时,人物会持续张嘴直到台词结束,像没换气的朗诵机器人。
生成带声画同步的视频
第一步:检查提示词是否包含说话动作描述
在“图片创意描述”中,必须写明人物正在发声的动作,例如:“一位穿青衫的宋代文官,正面特写,嘴唇清晰开合,神情庄重地朗读诗句”;若只写“宋代文官站在竹林前”,系统将忽略台词,生成静音画面。
第二步:关闭“仅生成画面”开关
页面底部有灰色开关按钮,文字为“仅生成画面(关闭语音)”,确认该开关处于【关闭状态】(即右侧无蓝色填充)。一旦误开,无论填多少台词,输出均为无声视频,且无法回溯补音。
第三步:点击「立即生成」→ 等待进度条走完 → 下载MP4文件


















