百度一镜数字人可在3分钟内完成口播短视频制作,全程无需露脸、剪辑或调音:第一步选形象或上传30秒正脸视频克隆自己;第二步输入文案或由AI生成口语化脚本;第三步选择音色、驱动模式及背景;第四步一键渲染导出或直发抖音。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用百度一镜数字人把一条口播短视频从零做到发布,全程不用露脸、不碰剪辑软件、不调音轨,3分钟内就能生成可直接发抖音或视频号的成片。
第一步:选形象或克隆自己
打开百度一镜官网,登录后点击「创建数字人」→ 选择「形象克隆」或「公共库形象」。
选公共库形象的话,直接在数千个预设形象里挑一个:商务白衬衫、知性教师风、活力学生款,点一下就能预览口型同步效果。这一步操作起来很简单,直接把文件拖进去就行。
想克隆自己,需上传一段【30秒无遮挡正脸说话视频】(要求:横屏/竖屏皆可、SDR格式、25fps、人脸居中、光线均匀)。系统会在1–3分钟内生成专属形象+声音模型。注意:视频里不能戴口罩、墨镜或大幅侧脸,否则克隆失败率超70%。
第二步:输入内容或让AI写脚本
进入「视频生成」页,有两种方式填文案:
方法一:直接粘贴已写好的口播稿(支持2000字以内);
方法二:只输入主题词,比如“iPhone16电池续航实测”,系统自动输出符合口播节奏的脚本——它会拆解成3–5个短句段落,每段控制在8–12秒,避免AI念长句卡顿。
百度热榜监控 | Baidu Hot Topics Monitor. 获取百度热搜榜、搜索趋势、关键词热度 | Get Baidu trending searches, trends, keyword popularity. 触发词:百度、热搜、baidu.
AI生成的脚本默认带口语化填充词(如“其实呢”“大家可能不知道”),若你偏好干练风格,可在编辑框里手动删减,但【不要删除句末标点】,否则语音合成会连读错位。
第三步:配音、口型、背景一键绑定
确认脚本后,点「音色设置」→ 从「自然男声」「知性女声」「少年音」等选项中任选一个,或使用你刚克隆的声音模型。
接着选「驱动模式」:默认启用「口型驱动+微表情联动」,系统会根据语义自动匹配眨眼、点头、挑眉等动作;若要更稳态输出(比如企业培训类视频),可关闭微表情,只保留基础口型同步。
背景设置有三档:纯色底(推荐用于知识类)、动态模板(带文字弹入动效)、自定义上传图(支持PNG透明底)。上传图时文件大小不能超过5MB,否则前端会静默失败且不提示错误。
第四步:渲染与导出
点击「立即生成」后,进度条走完即得MP4文件——无需等待排队,后台采用百度自研AIGC视频引擎实时渲染。
生成结果默认为9:16竖版,分辨率1080×1920,码率自动适配平台要求;如需横版,可在导出前勾选「16:9宽屏模式」,但注意部分动态模板在横版下会裁切边缘元素。
导出按钮旁有「下载」和「发布到抖音」两个选项:选后者会跳转抖音创作者平台完成一键发布,但需提前在百度一镜后台绑定抖音账号并授权「视频上传权限」。

















