讲师中心 微信公众号
AI工具推荐 视频效率加速

可灵AI图生视频如何保持人物一致性【实操】

胖丽酱_4470

胖丽酱_4470

发布时间:2026-06-30 19:12:24

|

441人浏览过

|

来源于php中文网

原创

首帧图需作为角色“数字身份证”严格准备:①用Midjourney生成含具体人脸特征的定妆照;②导出PNG并清除透明通道与ICC配置文件;③手机相册原图导出以剥离EXIF冗余数据。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

可灵ai图生视频如何保持人物一致性【实操】

用可灵AI做图生视频时,人物在不同镜头里突然变脸、五官错位、发型漂移、衣服颜色跳变——这些问题不是模型“抽风”,而是参考图没用对、提示词没锁死、关键参数被默认值悄悄绕过。

上传首帧图前必须做好的三件事

首帧图不是随便截一张就能用。它得是角色的“数字身份证”,否则后续所有生成都在猜。

第一步:用Midjourney或即梦生成一张正面半身定妆照,提示词必须含具体人脸特征,例如:“Portrait of a 28-year-old Han Chinese woman, heart-shaped face, double eyelid, slight upturn at outer eye corners, small freckle on right cheekbone, shoulder-length wavy brown hair, wearing ivory knitted turtleneck, soft studio lighting, clean white background”。

第二步:导出PNG格式,分辨率不低于1024×1024,用Photoshop检查是否带透明通道或嵌入ICC配置文件——【若有,必须删除,否则可灵会误读色彩空间导致肤色偏移】。

第三步:把这张图拖进手机相册再原图导出一次,目的是剥离EXIF中的拍摄设备、GPS、时间戳等冗余元数据——可灵部分版本会因读取这些字段触发异常重采样。

图生视频界面的关键设置

进入可灵Web端→点击「图生视频」→上传刚准备好的首帧图后,立刻执行以下操作:

关闭「智能背景增强」和「自动光影匹配」两项开关——它们会强行重绘人物边缘与明暗交界线,直接破坏面部结构稳定性。

Midjourney
Midjourney

通过Midjourney Discord机器人进行AI图像生成:根据提示词创作图像、放大、制作变体、混合图像及描述图像。适用场景:(1) 生成...

下载

将「运动强度(Motion Scale)」手动设为5.2~6.8区间——低于5动作僵硬,高于7.0极易引发手指/耳垂/发梢等高频细节崩坏;这个范围是实测中肩颈过渡与微表情保留率最高的安全带。

勾选「保持原始构图比例」并锁定「宽高比=1:1」——哪怕你最终要输出16:9,也先在这里固定,否则模型会在每帧重新计算人物在画面中的锚点位置,造成轻微漂移累积。

提示词写法:只准动“动作”和“环境”,其余全部冻结

方法一:基础冻结法
提示词严格按此结构书写:
[Same person as input image] → [动作:缓步向左平移两步,右手自然下垂,左手轻抚腰侧] → [环境:浅灰水泥地面,顶部柔光灯带,无窗无装饰]。
注意:“Same person as input image”必须作为第一短语,且不能加任何修饰词,不能换行,不能前置“Film still of…”之类描述。

方法二:动态锚点法(适合有运镜需求)
在动作描述中插入不可删减的物理约束短语,例如:“右脚跟始终接触地面→左膝弯曲角度维持在28°±3°→头部水平旋转不超过11°”。
【这类角度数值必须来自首帧图中用标尺工具量出的真实数据,凭感觉写的数字会让模型彻底放弃一致性】。

生成后必做的帧间校验

① 把生成视频导入Premiere,打开“放大器”效果,将缩放倍数调至400%,逐帧检查左眼瞳孔高光位置是否偏移超过3像素;

② 截取第1帧、第12帧、第24帧(对应0s、0.5s、1s),用Photopea叠图模式设为“差值”,观察面部区域是否出现大面积灰色噪点——有则说明三维表征未锁定;

③ 拖动时间轴到人物抬手最高点,暂停,用吸管工具点击她右手食指尖,记录RGB值;再跳到第36帧(1.5s)同一位置,RGB偏差>8即判定为材质闪烁,需回退启用三维结构锁定。

热门AI工具

更多
WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

火山引擎

火山引擎是一款面向企业的云计算与AI服务平台。

Laper
Laper Hot

Laper是专为编剧、导演和制片人推出的 AI 原生剧本创作工具。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

Atoms
Atoms Hot

Atoms是一款AI智能体工具,第一支自动构建真实业务的 AI 团队。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

立刻MV
立刻MV Hot

立刻MV是一款AI文本写作工具,AI 音乐视频(MV)创作工具。

Loomy
Loomy Hot

一款AI工具,主要用于科大讯飞发布的桌面级 AI 助理,比 OpenClaw 更易用、更安全!,适合需要提升相关任务效率的用户。

相关专题

更多
Figma AI图像处理全指南:抠图、扩图与矢量化实操
Figma AI图像处理全指南:抠图、扩图与矢量化实操

无需PS插件,掌握 Figma AI 原生图像工具,支持一键移除背景、智能填充丢失区域以及将位图快速转为高精度矢量路径。

232

2026.05.13

可灵AI视频生成教程
可灵AI视频生成教程

全面讲解可灵AI视频生成教程,涵盖文生视频、图生视频、镜头控制、提示词编写、视频延长、角色一致性等内容,帮助新手快速掌握可灵AI视频创作流程,提升短视频、广告视频和创意内容制作效率。

205

2026.06.05

可灵AI提示词教程
可灵AI提示词教程

整理可灵AI提示词教程与Prompt编写技巧,涵盖人物、场景、动画、广告、电商、影视分镜等常见创作场景,帮助用户快速掌握高质量提示词写法,提高视频与图片生成效果。

139

2026.06.05

可灵AI图片生成教程
可灵AI图片生成教程

提供可灵AI图片生成教程,包括AI绘画、风格转换、海报设计、插画创作、电商图片制作等内容,帮助用户掌握图片生成技巧,实现高质量视觉内容创作。

135

2026.06.05

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

80

2026.09.30

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

80

2026.09.30

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

40

2026.09.30

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

40

2026.09.30

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

60

2026.09.29

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
可灵AI官方入门手册
可灵AI官方入门手册

共0课时 | 0人学习

midjourney AI绘画手册
midjourney AI绘画手册

共0课时 | 0人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn