Seko可在网页端一站式完成图生视频,支持数字人说话眨眼、分镜转短视频;上传高清人物图后选模型,配音需对口型并选音色,无声则选动态模型;可局部重绘微调,导出720p/1080p MP4。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让一张静态人物照开口说话、眨眼走动,或把手绘分镜图自动变成带运镜和转场的短视频,Seko能直接在网页端完成图生视频全流程,无需下载软件、不拼接多平台、不手动调时间轴。
上传图片并选择视频模型
打开 https://seko.sensetime.com/explore,登录后点击首页【数字人视频】或【图生视频】入口。上传你准备好的单张高清人物图(正面、面部清晰、无遮挡),【必须为JPG/PNG格式,分辨率不低于720p,背景尽量简洁】。
上传成功后,页面自动跳转至模型选择页。当前可选视频模型包括VEO 3有声版、即梦4.0驱动视频、Nano Banana动态增强版等——若你刚上传了主体图,系统会默认启用一致性强化模式;若未传主体,仅靠文字描述生成,则此处仅显示通用模型,效果稳定性下降。
配置对口型或无声动态
方法一:需要配音说话 → 点击【对口型】,粘贴台词文本(支持中/英/粤语),从音色库中选择对应声音(如“青年男-沉稳”“少女-清亮”),调整每句起止时间点,注意避免两段语音重叠导致嘴型错乱。
方法二:纯画面动作 → 关闭对口型,开启【无声视频】,从下拉菜单中任选一个动态模型:VEO 3适合电影感运镜,Nano Banana更适合Q版角色微表情,即梦4.0驱动则强在肢体连贯性。选完直接进入生成队列。
提示:若上传的是非人主体(如宠物、物品、风景图),请选择【无声视频】+「场景动态增强」类模型,对口型功能将不可用且强制灰显。
微调与导出成片
第一步:等待首帧预览生成(通常15–40秒)。出现播放条后,拖动检查动作自然度。
第二步:不满意?点击【重绘此帧】→ 选择「局部重绘」框选晃动的手部或僵硬的肩膀,输入提示词如“自然垂落”“轻微抬肩”,再点生成。
第三步:确认无误后,点击右上角【导出视频】→ 选择分辨率(720p/1080p)→ 勾选是否保留字幕轨道 → 最后点击【开始导出】。文件将自动打包为MP4,下载到本地。


















