小云雀AI平台支持本地音频与字幕自动对齐合成录播视频。需按顺序准备:①单声道48000Hz/16bit WAV音频;②毫秒级SRT字幕;③同名同目录WAV+SRT文件;④绑定合规虚拟形象;⑤上传后预览同步、修正延迟、导出MP4。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把提前录好的多段口播音频、字幕文本和虚拟主播形象快速拼成一条连贯的录播视频,中间不能有卡顿或音画不同步。小云雀AI平台支持本地素材导入+自动对齐+一键合成,但必须按特定顺序准备文件,否则合成会失败或人物嘴型错位。
准备合规的音频与字幕文件
第一步:用Audacity或剪映导出单声道WAV格式音频,采样率必须为48000Hz,位深度16bit。【不满足此参数会导致小云雀无法识别语音起始点,合成后嘴型全程静止】
第二步:将每段音频对应生成SRT字幕文件,时间轴精度需达毫秒级——可用Arctime Pro自动生成并手动校准,不可直接用手机语音转文字粗略粘贴。
第三步:把同一段内容的WAV文件和SRT文件放在同一文件夹,命名完全一致(如“产品介绍.wav”和“产品介绍.srt”),扩展名区分大小写也要严格匹配。
在小云雀中绑定虚拟形象并加载素材
方法一:登录小云雀控制台→点击「虚拟人管理」→选择已购形象→点击「设为默认播报形象」→返回首页刷新页面。
小云雀AI (Windows) 1.0.37版重点优化Windows端运行性能与生成稳定性,升级Seedance 2.0视频模型与Seedream图像生成能力,新增智能分镜自动排版与脚本联动生成机制,强化“爆款视频复刻”和数字人口播效果,提升批量生成效率,让用户在Windows端实现更高效的AI短视频与图像内容生产。
方法二:若使用自定义形象,需先上传FBX模型+配套表情绑定文件,等待后台审核通过(通常2小时内),审核未完成前无法进入合成页。
这一步操作起来很简单,直接把文件拖进去就行。但注意:免费试用版仅支持3个预设形象,切换自定义形象需升级企业版。
执行三步合成并导出成品
① 点击首页「录播合成」→「新建任务」→点击「添加音频」上传WAV文件→系统自动关联同名SRT(若未出现,请检查文件名是否含空格或中文标点)。
② 点击「预览同步效果」:拖动进度条观察虚拟人口型是否随字幕逐字开合。若出现延迟>0.3秒,返回修改SRT中的时间戳,不要调整音频。
③ 确认无误后点击「开始合成」→选择输出分辨率(推荐1080p)→勾选「嵌入硬字幕」→点击「导出MP4」。合成过程约耗时音频时长的1.8倍,完成后自动跳转下载页。

















