应启用多主体参考功能或用主体库/分层合成法实现多人同框:一、Vidu 1.5中开启多主体参考,上传并框选至多三张图;二、预存角色至主体库后@调用;三、分段生成再剪辑合成;四、避免混用差异素材、模糊动词、合影图及跳过主体选择。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望在 Vidu 中生成包含多个角色同框互动的视频,但发现人物形象错乱、比例失真或动作不协调,则可能是由于未正确启用多主体参考功能或上传素材不符合一致性要求。以下是实现多人场景视频的多种可行路径:
一、启用多主体参考生视频模式
该方法利用 Vidu 1.5 版本原生支持的「多主体参考」能力,可同时锁定最多三个独立主体(人物、道具、地标等),确保其在动态视频中保持结构与风格统一。此为官方推荐的高保真方案。
1、登录 vidu.cn,点击首页“创作视频”,选择模型为 Vidu 1.5。
2、在功能区切换至 “参考生视频” 模式,并开启 “多主体参考”开关。
3、点击“上传主体”,依次添加三张图:第一张为人物A正面照、第二张为人物B半侧面照、第三张可为共同场景元素(如咖啡馆吧台或城市街景)。
4、上传后点击每张图下方的 “选择主体” 按钮,用矩形框精准圈定需参考的区域(例如只框选A的脸部、B的手部或吧台的木质纹理)。
5、在提示词框中输入中文指令,例如:“两位年轻人在东京涩谷十字路口相视而笑,行人流动缓慢,霓虹灯闪烁,电影级浅景深”。
6、点击生成,等待系统完成解析与渲染(约60–120秒)。
二、使用主体库预存角色再组合调用
该方法适用于需重复调用同一角色参与不同多人场景的创作者,通过预先构建角色档案降低每次生成的参数误差,提升长期项目的一致性稳定性。
1、进入 Vidu 主界面,点击左侧导航栏中的 “主体库”。
2、点击“创建主体”,上传人物A的三视图(正面/左侧面/背面),命名为 “小林”;再新建第二个主体,上传人物B的单张高清正脸图,命名为 “佐藤”。
3、保存两个主体后,在新创作任务中选择 “参考生视频” 模式,不上传新图,而在提示词中直接输入:“@小林 和 @佐藤 并肩站在京都伏见稻荷大社千本鸟居前,一起举起相机自拍,阳光透过鸟居缝隙洒落”。
Vidu视频生成插件(viduq3-pro、viduq3-turbo、viduq2、viduq1)。支持文字转视频、图片转视频、参考转视频以及起始编辑。
4、确认模型为 Vidu 1.5,点击生成。
三、分层合成法:图生视频 + 剪辑叠加
当目标角色超过三个,或需严格控制镜头运动逻辑时,可采用分段生成+后期合成策略,规避模型对超多主体的空间理解瓶颈。
1、分别以单主体图驱动,生成两段独立视频:第一段为人物A在指定场景中的3秒动作片段;第二段为人物B在同一场景构图下的3秒片段(提示词中强调 “相同机位、相同光照、相同背景虚化程度”)。
2、导出两段视频后,导入剪映专业版,将第二段视频设为“混合模式:正常”,调整透明度至85%,手动对齐人物脚底位置与地平线。
3、在时间轴上为第二段添加 “边缘羽化” 效果,消除合成硬边。
4、导出最终合成视频前,启用剪映的 “AI 人物抠像增强” 功能二次优化边缘自然度。
四、规避常见错误的操作要点
以下行为会显著降低多人同框效果可信度,须全程避免:
1、禁止在一次生成任务中混用不同分辨率、不同光照条件或不同拍摄角度的人物图作为主体输入。
2、禁止在提示词中使用模糊动词如“走动”“聊天”“互动”,必须明确动作指向,例如:“小林向右伸出手,佐藤左手抬起轻握其指尖”。
3、禁止上传含多人合影的原始图作为单一主体图——VIDU 无法自动分离识别,会导致特征混淆。
4、禁止在多主体上传阶段跳过 “选择主体” 步骤,默认全图参考极易引发服装纹理错位或肢体比例坍缩。

















