必须进入“多图参考”专用入口并严格按流程上传标注,否则系统仅识别首张图;需一次性上传最多7张图并为每张填写明确用途标签,否则角色/道具易错乱。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想在Vidu里上传多张参考图来控制人物、场景、道具或风格,但点开界面找不到批量上传入口,或者传了3张图系统只认第一张——这通常是因为没进入正确的功能路径,或上传顺序与标注方式不符合Vidu多图参考机制的硬性要求。
确认当前使用的是支持多图的功能模块
打开Vidu网页端或App后,必须先进入明确标注“多图参考”“一键生成MV”或“Q1/Q3参考生”字样的入口。普通“文生视频”或基础“图生视频”模式仅支持单图,【上传再多张也会被自动忽略除首张外的所有图像】。
常见入口位置:首页轮播推荐位 → “一键生成MV”卡片;创作页左侧导航栏 → “参考生视频” → 顶部切换标签 → 选择“多图协同”;或模型选择下拉菜单中手动选中“Vidu Q1 参考生”“Vidu Q3 物理引擎”等带版本号的专用模型。
上传操作流程(以网页端为例)
第一步:点击「添加参考图」按钮,不是「上传图片」或「选择文件」。
第二步:在弹出的窗口中,一次性框选最多7张本地图片(JPG/PNG格式,单张不超10MB),直接拖入或按Ctrl/Cmd+A全选后回车。不要一张张点选上传——分次点击会触发单图逻辑,导致后续图片无法绑定用途。
第三步:每张图上传后,系统自动弹出标注框,必须为每张图填写明确用途,例如:“主角正面照”“古风庭院实景”“青花瓷瓶特写”“背景光源示意图”。【空填、填“图1”“图2”或重复用词如“人物”将导致模型无法区分锚定维度,生成时角色/道具极易错乱】。
第四步:全部标注完成后,点击右下角「确认并继续」。此时页面会显示7张缩略图+对应标签,且右上角出现“已启用多图参考(7/7)”状态提示,才算真正激活。
移动端APP上传要点
方法一:长按相册图片→多选→勾选6–7张→点击右上角「分享」→选择「Vidu」→自动跳转至标注页。
方法二:进入「一键生成MV」→点「+」号→选择「从相册添加」→进入后顶部有“多图模式已开启”蓝条提示→上传完毕后逐张点击缩略图下方文字框进行用途标注。
注意:iOS用户若遇上传中断,需关闭后台的“照片隐私保护”开关;安卓部分机型需授予Vidu“读取媒体文件”权限,否则仅能上传最近7天内拍摄的照片。
上传后校验是否生效
提交生成前,在提示词输入框上方查看是否有“参考图:7张|角色×2|场景×3|道具×2”这类结构化统计标签。没有该标签,说明多图未被识别,需返回重新上传并确保每张都完成用途标注。
若已生成视频但主体漂移,截图任意一帧→用Vidu「重绘」功能→上传该帧+原参考图中对应的一张→输入“强化此图中红衣女子的发饰细节与袖口纹样”,可局部修复一致性。


















