用Seko制作人物出镜短视频需四步:一创建锁定主体形象,上传正面纯色证件照生成三视图;二准备人声,可上传音频或TTS配音并加“|”控停顿;三搭建场景与运镜,绑定场景图、设置动线及动作提示;四校验一致性后导出1080P带唇形同步视频。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用Seko制作有人物出镜讲解的短视频,必须先让AI“认准”这个人是谁、长什么样、站在哪儿讲——否则生成的视频里人物会忽胖忽瘦、忽明忽暗、忽左忽右,甚至上一秒穿衬衫下一秒套羽绒服。
第一步:创建并锁定主体形象
进入SEKO主界面→点击左侧「主体库」→右上角「新增主体」→选择「上传证件照」;【必须用正面、纯色背景、无遮挡、光线均匀的清晰照片,侧脸或戴帽子会导致生成时肢体错位】。
上传后系统自动提取五官特征并生成三视图(正/侧/背),这一步完成后,该形象即被写入项目DNA,后续所有分镜中的人物都将严格遵循此建模基准。
若无证件照,可输入文字描述:“30岁亚洲男性,短发,黑框眼镜,浅灰POLO衫”,但生成稳定性低于实拍图,尤其在动态镜头中易出现手指数量异常或袖口变形。
第二步:准备讲解脚本与人声素材
方法一:直接上传已录制人声。点击「素材库」→新建文件夹命名为“人声”→拖入MP3或M4A格式音频,单条时长建议≤60秒,采样率44.1kHz,环境安静无键盘声、空调风噪;【若背景有持续底噪,AI将把噪声误判为语音成分,导致字幕错乱率达70%以上】。
方法二:用SEKO内置TTS合成。在编辑页点击「配音」→输入讲解文案→选择音色(如“沉稳男声_03”)→生成后自动对齐口型。此方式无需录音设备,但需手动调整停顿点:在句末加“|”符号可强制延长0.8秒,避免语速过快导致嘴型抽搐。
第三步:搭建讲解场景与运镜逻辑
第一步:绑定场景图。点击「素材库」→新建文件夹“场景”→上传1张高清实景图或AI生成图,例如“现代简约书房,落地窗+原木书桌+绿植”,图中需包含人物站立/坐姿所需的空间结构。
第二步:设置讲解动线。在无限画布中新建分镜→点击「添加主体」选择已创建的形象→拖入场景图→点击「运镜」→选择“中景固定机位”或“缓慢推进”;若需手势强调,可在提示框输入“(右手抬起指向右侧)这个数据说明增长趋势明显”——括号内动作描述会被AI解析为骨骼驱动指令。
第三步:校验一致性。生成首帧预览后,放大查看人物耳垂形状、袖口褶皱走向、发际线弧度是否与三视图一致。如有偏差,立即返回主体库点击「重生成特征锚点」,否则后续所有分镜将沿错误模型扩散。
第四步:导出带口型同步的成片
全部分镜确认无误后→点击右上角「生成视频」→选择分辨率1080P、帧率30fps→勾选「启用唇形同步」→等待渲染完成。
这一步耗时取决于分镜数量和网络状态,通常3分钟内可完成1分钟视频。生成完毕后自动跳转至预览页,播放时重点检查人物讲话时下唇运动幅度是否匹配音节闭合节奏,若发现“啊”音对应咧嘴、“嗯”音对应抿唇等反常现象,说明人声素材信噪比不足,需重新录制并上传。


















