必须用即梦AI生成双人静态图再导入可灵AI分镜处理:先用即梦AI产出构图合理的母女对话图,再通过可灵“图生视频”分别驱动单人动作,最后用剪映合成并手动对齐口型与节奏。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要用可灵AI生成双人对话场景的视频,必须绕过它当前不支持多角色动作协同的硬限制——直接输入“两人聊天”类模糊提示词,大概率出现人物重叠、口型错位或一人消失等异常。你需要把双人互动拆解为单人可控动作,并用剪辑逻辑补全对话关系。
先用即梦AI生成稳定双人构图图
可灵对人物一致性的控制仍不稳定,无法从零生成两个长期共存的角色。所以第一步必须跳过可灵的文生图环节,改用即梦AI产出高稳定性静态画面。
打开即梦AI网页版(https://jimeng.jianying.com/s/iyrmHgaU/)→点击「图片生成」→在提示词框中输入:“一对母女坐在客厅沙发两侧,母亲微微前倾身体,女儿抬头看着她,两人视线自然交汇,柔和灯光,浅景深,写实风格,4:3画幅”→模型选「图片3.0pro」→比例设为「4:3」→点击「立即生成」。
生成的四张图中,选人物间距合理、面部朝向清晰、无肢体遮挡的一张。这一步很关键:【若两人肩膀或手部有粘连,后续可灵生成时极易崩坏成一团色块】。保存高清图至本地,命名如“mother_daughter_talk.jpg”。
在可灵AI中配置双人视频参数
可灵当前网页端(https://app.klingai.com/cn/)不支持直接上传双人图做文生视频,但可通过「图生视频」+「首尾帧」组合逼近效果。
方法一:用同一张图做首尾帧,靠提示词驱动微动作
登录可灵AI→顶部导航栏点「视频生成」→左侧菜单选「图生视频」→在「首帧」和「尾帧」上传同一张即梦产出的双人图→提示词栏输入:“母亲缓慢点头,女儿嘴唇轻微开合,两人保持坐姿,背景静止,无镜头移动,5秒,1080p,可灵2.6音画同出”→分辨率选「1080×1920」→时长选「5秒」→点击「立即生成」。
方法二:分镜拆解,生成两段单人视频再合成
将原图用PS或在线工具(如Photopea)沿中线垂直切为左右两半→分别保存为“mother_half.jpg”和“daughter_half.jpg”→回到可灵AI「图生视频」页→首尾帧均上传“mother_half.jpg”→提示词写:“母亲开口说话,嘴唇自然开合,面带温和表情,无多余肢体动作,4秒”→生成后重复操作,用“daughter_half.jpg”生成女儿说话片段→导出两段视频。
用剪映完成最终对话合成
打开剪映电脑版→新建项目→将母亲视频拖入轨道1→将女儿视频拖入轨道2,起始时间对齐→选中女儿视频,在右侧「画面」面板中勾选「镜像水平翻转」→调整轨道2位置,使两人在画面中呈面对面布局→在轨道1上方添加「音频」轨道,导入母亲语音(可用可灵2.6自带对口型功能生成,或用剪映「文本朗读」输入台词)→同理在另一音频轨道加入女儿语音,注意错开0.3秒制造真实对话节奏→导出视频。
这一步不能省略:剪映里必须关闭「自动踩点」功能,否则语音会强制对齐节拍导致口型错位。


















