需按四步法将脚本转为连贯AI短视频分镜:一拆镜头单元并标注时间地点动作;二用“3+2结构”写MJ Prompt;三用Style Lock或CREF+ SREF锚定风格;四为每图预设逻辑衔接的动态指令。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把一段文字脚本快速变成有镜头感、可动、能连贯播放的AI短视频分镜图,而不是靠手绘或反复试错生成一堆风格不统一的图。这要求你从第一句解说词开始,就用导演思维拆解画面要素,让Midjourney每一张图都精准卡在节奏点上,且后续能自然过渡成视频。
第一步:把脚本拆成“可拍”的镜头单元
逐句扫描原始脚本,删掉所有无法成像的抽象描述。比如“市场充满活力”必须改成“早市摊位前热气蒸腾,穿蓝布衫的老妇掀开蒸笼盖,白雾涌出遮住半张脸”。
对每个句子标出三个硬指标:【时间(晨/午/夜)、地点(室内/街角/屋顶)、主体动作(推门/转身/抬手)】。缺任一者,这张图后期做视频时就会卡顿或跳帧。
把标注好的句子按顺序编号,格式为“01_晨_菜市场_掀蒸笼盖”,这是后续重命名和排序的唯一依据。
第二步:写带镜头语言的Midjourney Prompt
不用写完整句子,直接套用“3+2结构”:主体 + 动作 + 镜头类型 + 光影 + --ar 16:9。
例如:“old woman in blue cloth jacket lifting steamer lid, steam billowing upward, medium close-up shot from eye level, warm morning light with soft shadows --ar 16:9”。
镜头类型必须明确——establishing shot(建置镜头)、medium shot(中景)、over-the-shoulder(过肩镜头)等术语AI能识别;避免用“看起来”“感觉”这类模糊词。
如果脚本中同一角色连续出现,务必在首张图Prompt末尾加--sref XXXX(用MJ生成图的ID),否则后续图中人物脸型、服装会漂移。
第三步:批量生成并强制风格锚定
方法一:用MJ官网Explore页的“Style Lock”功能。上传首张满意图→点击“Lock Style”→复制其URL→在后续所有Prompt开头粘贴该URL+空格+你的新描述词。
方法二:手动植入CREF(角色一致性)。生成首张图后,在V6模式下用/imagine prompt: [新描述] --cref [首图URL] --sref [首图ID]。注意【--cref和--sref必须同时存在,缺一则角色会变形】。
生成过程中若某张图构图歪斜或主体偏小,不要重试,立即用Photoshop裁切至1920×1080并保存。AI视频生成对画幅敏感,留白过多会导致Runway Gen-2运动刷失效。
第四步:为每张图预设动态方向
① 打开Midjourney官网画廊,找到编号01图,悬停→点击Animate Image。
② 在弹出面板中选Manual模式,于提示框末尾追加运镜指令:如“slow push-in toward steam”或“gentle pan right across market stalls”,再加--motion 3 --raw。
③ 生成4个变体后,下载运动最平滑的那个MP4,重命名为“01_晨_菜市场_掀蒸笼盖_v1.mp4”。
④ 对编号02图重复步骤①~③,但运镜指令需与前一帧逻辑衔接,例如前帧是“push-in”,本帧可用“hold for 2 sec then tilt up to sky”。
这一步不能跳过——Auto模式会丢失镜头意图,导致相邻视频片段运动方向冲突,剪辑时会出现画面撕裂感。


















