PixTV制作AI短剧时,旁白与对白必须分轨分步生成:旁白走【音频→旁白配音】,仅纯文本生成独立音频;对白走【角色→配音合成】,需绑定角色唇形模板,严禁混用,否则导致口型错乱、无法修改。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在PixTV制作AI短剧时,旁白与对白必须分轨处理、分步生成,否则角色嘴型会强行匹配旁白语句,导致口型错乱、节奏僵硬、无法单独修改——这是PixTV底层音画绑定逻辑决定的硬性限制。
先区分旁白和对白的用途边界
旁白是画外音,用于交代背景、切换时空、解释设定,不需对口型;对白是角色开口说的台词,必须严格绑定唇动模型。PixTV中二者使用不同生成入口:旁白走【音频→旁白配音】,对白走【角色→配音合成】。混用会导致系统自动启用唇形驱动,后续无法剥离。
粘贴剧本时,用空行明确分隔旁白段与对白段。例如:
【旁白】三年后,城市已不再有信号塔。(空一行)
【张伟】“这台老收音机,还能收到2023年的天气预报吗?”
【空行不可省略,PixTV靠此识别语义区块,否则全部判为对白】
生成旁白:纯文本→独立音频轨
进入PixTV主界面 → 点击左侧菜单【音频工具】→ 选择【旁白配音】。
将剧本中所有标注【旁白】的段落复制粘贴进输入框,删掉括号内动作提示(如“(低沉地)”“(画外,渐远)”),只留纯叙述句。系统不解析语气标记,只按语义断句生成气口。
音色选择页勾选【叙事专用】筛选器,优先选带“长文本优化”标签的音色(如“纪录片男声D5”“胶片女声F9”)。这类音色内置呼吸停顿算法,不会在逗号处卡顿半秒以上。
点击【生成旁白】→ 下载MP3。该文件已按段落切分为独立音频片段,命名含时间戳(如“PB_00:12:04.mp3”),可直接拖入剪辑时间轴对应位置。
生成对白:绑定角色+唇形帧率校准
方法一:角色已建模完成时操作
在项目角色库中选中目标角色(如“林薇-科研员V2”)→ 点击【配音合成】→ 粘贴该角色全部台词(仅台词,不含“林薇:”前缀)→ 选择【匹配当前角色唇形模板】→ 点击【生成对白】。
方法二:多角色混录需防串音
逐个角色单独生成对白,禁止一次性粘贴多个角色台词。PixTV会对未指定角色的句子默认分配至首个创建的角色,且无法后期更正唇形绑定关系。
【生成前务必确认角色唇形模板已训练完成——若状态栏显示“唇形待校准”,点击该角色头像→【重训唇形】,耗时约47秒,跳过将导致口型漂移】
在时间轴上对齐旁白与对白
第一步:导入视频主轨 → 将旁白MP3拖至音频轨2 → 将各角色对白MP3分别拖至音频轨3、轨4等独立轨道。
第二步:选中旁白音频轨 → 右键【设为画外音】→ 系统自动解除该轨与视频帧率的同步锁,允许自由拉伸变速。
第三步:对白轨必须保持原速。若某句对白时长与画面口型不匹配,不能拉伸音频,而应返回【配音合成】页,调整该句语速参数(±12%以内),重新生成替换。
第四步:微调起始点。按住Alt键+拖动旁白波形,让第一字爆破音(如“突”“那”“看”)对齐画面中关键动作帧;对白则必须让首字起始帧与角色张嘴第一帧完全重合——可用放大时间轴到200%精度操作。


















