可灵AI视频生成音频干扰需关闭“智能音频补全”或用提示词精准约束,如添加“【无任何环境音、无对话、无背景音乐、纯静音】”,企业API用户还可设audio_model为"none"实现全静音输出。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

可灵AI视频生成时出现杂音、环境音干扰或人声不清晰,常因提示词未明确约束音频输出导致。2.6版本虽支持音画同出,但默认会根据画面内容自动补全声音,若不干预,系统可能添加你没要求的背景音、回声、混响甚至错误语种配音。
关闭自动音频补全
进入可灵AI网页版 → 点击「AI视频」→ 选择「文生视频」或「图生视频」→ 在提示词输入框下方找到「高级设置」展开栏 → 关闭「智能音频补全」开关。【此操作必须在提交前完成,生成后无法撤回】
该开关默认开启,一旦启用,模型会基于画面推理出“合理声音”——比如生成厨房场景就自动加切菜声+水龙头声+锅铲碰撞声,哪怕你只想要静音运镜。
用提示词精准压制非必要声音
方法一:在提示词末尾直接加否定指令
在完整描述后追加一句:“【无任何环境音、无对话、无背景音乐、纯静音】”,注意用中文顿号分隔,不用引号,不换行。
✅ 五大心智模型(M1-M5)全保留 ✅ 四层建筑法(L1-L4)完整表格化 ✅ @多模态绑定语法优先级表 ✅ 20+ 场景诊断表(问题/原因/修复/边界) ✅ 八大行业模板(都配了完整提示词示例) ✅ 诚实能力边界表 ✅ Agent 触发关键词 + 标准入参/出参 ✅ 表达 DNA 固定风格
方法二:指定声音类型并限死数量
如需保留某一种声音,写成:“一只金毛犬慢步走过木地板,爪子轻触地面发出轻微哒、哒声,【仅此一种声音,无呼吸声、无风声、无远处车流、无BGM】”。
方法三:用物理场景反向屏蔽
写“真空环境中的玻璃球自由落体,无声撞击金属台面”,模型会识别“真空”为绝对静音前提,强制抑制所有振动传导类声音。
替换默认音频模型(仅限企业API用户)
调用可灵2.6 API时,在请求参数中将 audio_model 字段设为 "none" 或 "silence_v1"。【普通网页版用户不可见此选项,仅开放给已签约企业客户】
该参数生效后,视频轨道将输出全静音PCM数据流,帧率与画面完全同步,但音频波形恒为0振幅。

















