必须创建并复用主体资产以确保同一角色多视频中脸型、发型、服装、体型及声纹严格一致;需上传三张无遮挡高清多角度图、启用多视角补全、提取声纹、命名保存;后续任务在提示词开头添加[character:名称]即可调用。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

可灵AI中优先启用主体资产调用
当你需要为同一角色生成多个视频,且要求每条视频里人物的脸型、发型、服装、体型甚至声纹都严格一致时,必须跳过临时上传参考图的快捷路径,直接创建并复用主体资产。这是可灵AI目前唯一支持跨视频持久化调用角色数字档案的方式。
进入可灵AI Web端→点击左上角“资产”→选择“主体资产”→点击“新建资产”。
上传该角色的正面高清图(≥1024×1024)、左侧45度半身照、右侧45度半身照各一张,三张图必须光照均匀、无遮挡、无美颜滤镜——【若其中任一角度模糊或反光,系统将无法锁定三维结构,后续所有视频都会出现面部漂移】。
勾选“启用多视角智能补全”,等待系统完成5组特征图渲染并显示“已锁定基础体型”提示;再上传3秒以上无背景音的清晰语音片段,点击“提取音色特征”,生成唯一声纹ID。
填写中文名称(如青衫女子)与简要描述(如“古风女子,青衫白裙,手持团扇”),点击“保存为成熟主体”。此后所有新任务,只需在提示词开头固定添加[character:青衫女子],模型即强制加载该资产全部参数。
多图参考模式比单图参考更稳
单张参考图只提供静态快照,AI在生成动态镜头时极易丢失未呈现的角度细节。而多图参考能联合建模三维结构,尤其适合需环绕运镜、俯仰切换或多人同框的短剧场景。
方法一:三图分层绑定
上传角色图(单人正面)、服装图(该角色常穿服饰特写)、姿态图(标志性动作静帧)。每张图右下角点「框选」,只圈出关键区域(如脸、衣领、手部),避免背景干扰。
方法二:同源序列垫图
准备3张源自同一拍摄会话的图片:正面半身、侧脸45°、背面带肩部轮廓。上传后全部启用框选,且各图框选区域保持相同部位比例(如均框选从发际线至锁骨的纵向范围)。
两种方法都必须在提示词中采用三段式结构:[角色:青衫女子] + [动作:缓步前行,左手轻提裙摆] + [环境:江南雨巷,青石板路]。禁用“类似”“风格化”等泛化词,所有描述必须指向已上传图中的具体细节。
首尾帧锚定专治动作镜头变形
当角色要做抬臂、转身、蹲起等有明显肢体位移的动作时,仅靠主体资产仍可能在中间帧发生面部拉伸或关节错位。此时必须启用首尾帧语义锚定,把运动轨迹压进确定性路径。
第一步:准备两张高分辨率PNG图像。第一帧需完整呈现角色静止姿态与初始表情;最后一帧须严格匹配目标动作终点(如“抬手指向右侧”“闭眼微笑”),两张图人物位置、朝向、景别需高度一致。
第二步:在生成界面点击“启用首尾帧”,分别上传两图,并勾选“强制姿态连续性校验”。
第三步:提示词中必须包含明确的时间逻辑短语,例如“从自然站立状态匀速抬臂,全程耗时3.2秒”。
第四步:在插值设置中关闭贝塞尔曲线,手动选择“线性时间采样”,并将帧率锁定为24fps——【非24fps会导致时间采样偏移,首尾帧约束失效,中间帧立刻失稳】。


















