必须将人物动作与镜头运动彻底分离描述,人物动作绑定主体并用动词+宾语结构表达,镜头运动独立说明机位、运动方式等,通过分号、括号或分段实现解耦,避免混淆导致画面故障。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让可灵AI生成的视频里人物动作自然、镜头运动专业,必须把“谁在动”和“怎么拍它”彻底分开写,混在一起就会出现人物漂浮、镜头乱晃、动作卡顿等典型故障。
先分清动作主体:人物动作≠镜头运动
人物动作是角色自身做出的行为,比如“抬手”“转身”“奔跑”“眨眼”,这些必须绑定到具体主体上,用动词+宾语/状态的结构表达,例如“穿红裙的女孩踮脚旋转”——“踮脚旋转”是她自己完成的,不是镜头推过去才看起来像在转。
镜头运动是摄像机的物理位移或光学变化,比如“镜头缓缓推进”“无人机俯冲下降”“左摇镜头掠过树梢”,它独立于人物存在,可以静止拍动作,也可以动作静止时镜头狂扫。
【人物动作描述中绝对不能夹带镜头词】,如“她走过来(镜头拉近)”这种写法会让模型混淆主次,大概率生成人物突兀放大、比例失真;正确写法是拆成两句:“穿灰风衣的男人沿铁轨行走”+“镜头以低角度缓慢跟拍,保持其全身入画”。
提示词中明确分离两套语言体系
方法一:用分号硬性区隔视觉基底与运镜指令
在同一个提示句内,用英文分号“;”将人物动作层和镜头运动层切开。前半段只讲人、物、环境、行为;后半段只讲机位、运动方式、焦距、景别。例如:“穿蓝工装的女焊工蹲下扶正头盔;中景固定镜头,背景虚化,焊花飞溅时自动触发慢动作”。
方法二:用括号标注责任归属
把镜头相关描述统一放进括号,且括号前不加逗号,避免被模型误判为修饰人物。例如:“少年单膝跪地举起相机(镜头从他肩后平视推出,焦距由16mm渐变至35mm)”。括号内容会被识别为纯运镜指令,不会干扰人物姿态建模。
方法三:分段书写,强制逻辑断层
第一行写人物动作:“白发老者拄拐缓步穿过石桥,左手轻抚桥栏”;第二行空一行再写镜头:“【镜头指令】航拍视角,以桥拱为构图中心,镜头随人物匀速右移,保持桥面始终居中”。可灵3.0 Pro对换行敏感,这种物理分隔比标点更可靠。
验证是否写对的三秒自检法
第一步:遮住提示词中所有含“镜头”“摄像机”“推”“拉”“摇”“移”“俯”“仰”的字眼;
第二步:读剩下部分——是否仍能清晰还原人物在干什么、在哪、什么状态?如果不能,说明人物动作描述本身就不完整,镜头词补不了这个漏洞;
第三步:再遮住所有关于人的描述,只看镜头部分——是否每条都可独立执行而不依赖人物位置?例如“镜头环绕旋转”必须搭配“以女孩为中心”,否则AI不知道绕谁转。
这一步做完,人物动作和镜头运动就真正解耦了,生成画面中不会再出现“人没动但镜头猛推导致人脸炸开”这类事故。


















