百度一镜支持离线、云渲染及混合模式:断网时用本地GPU渲染,需提前激活;5G/千兆宽带优先云渲染并指定region以降低延迟;弱网下启用断点续传与分片上传,结合云端语音驱动+本地口型对齐提升首帧速度与成功率。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要在弱网、断网或高丢包环境下稳定生成数字人视频,又担心本地渲染太慢、云渲染连不上——百度一镜同时支持离线渲染与云渲染,但两者的实际表现差异极大,必须按网络条件选对模式才能不卡顿、不重跑、不白等。
断网/局域网环境:只能用离线渲染
第一步:确认设备已安装百度一镜离线渲染客户端(v2.3.1+),且完成本地授权激活。未激活状态下启动会直接报错退出,【离线模式必须提前绑定硬件ID并联网激活一次,之后才可完全无网运行】。
第二步:导入脚本+人像包+语音文件→点击「本地合成」→选择输出分辨率(建议720p起,4K需RTX 4090级别显卡)→开始渲染。
第三步:渲染全程不依赖任何外网请求,所有AI推理均在本地GPU完成;若中途断电或强制关闭,进度不可恢复,需重新开始。
5G/千兆宽带环境:优先走云渲染
方法一:网页端一键提交
登录百度一镜控制台→上传脚本和语音→选择「云端合成」→勾选「自动适配最优节点」→提交。系统自动将任务路由至最近的百度智能云边缘节点,实测平均排队时间<8秒。
调用百度PaddleOCR‑VL大模型API,支持PDF、Word、PPT、图片等多格式文档解析,精准识别印刷体、手写体、表格、公式、图表、印章等复杂元素,支持100+语言,可处理不规则布局和跨页长文档。触发词:文档解析、VLM解析、大模型OCR、PaddleOCR、多模态文档、手写识别、公式识别、复杂版面。
方法二:API直连调用
调用接口 https://open.xiling.baidu.com/v1/render/submit,Header中携带有效access_token,Body中指定region=“bj”或“sz”等具体区域。注意:【若未指定region,系统默认调度至华北节点,跨域传输可能增加300ms以上延迟】。
弱网环境(2G/高丢包/延迟>300ms):必须切换混合模式
第一步:打开一镜客户端设置→启用「断点续传+分片上传」开关→调整分片大小为2MB(默认4MB,弱网下易失败)。
第二步:上传前先压缩语音文件为16kHz单声道MP3,体积缩小约60%,上传耗时下降明显;人像包不得修改,否则校验失败无法合成。
第三步:点击「弱网优化合成」→客户端自动拆解任务为「云端语音驱动+本地口型对齐」两阶段,首帧返回时间比纯云模式快2.1倍,且丢包率>15%时仍能完成92%以上任务。

















