必须先完成百度AI开放平台实名认证与应用创建以获取AppID、API Key和Secret Key,再在Dify工作流中通过代码节点获取access_token并配置HTTP请求调用百度TTS API,否则无法通过鉴权。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在Dify中接入百度语音合成服务实现个性化语音播报,必须先完成百度AI开放平台的实名认证与应用创建,获取合法可用的AppID、API Key和Secret Key,再在Dify工作流中配置HTTP请求节点调用百度TTS REST API,否则所有后续步骤均无法通过鉴权校验。
获取百度语音合成服务凭证
打开浏览器访问百度AI开放平台官网 → 点击顶部导航栏【语音技术】→ 右上角点击【控制台】→ 完成手机号注册并实名认证(【未实名将无法领取免费额度且调用必失败】)。
进入控制台后,左侧菜单点击【应用列表】→ 点击【创建应用】→ 应用名称填“Dify-TTS-Baidu”,接口选择务必勾选【语音合成】→ 点击【立即创建】。
创建成功后,在应用详情页完整复制AppID、API Key、Secret Key三项值,它们将用于Dify中构造签名参数,缺一不可。
构造百度TTS签名与请求体
百度TTS要求每次请求携带access_token,该token需用API Key和Secret Key向https://aip.baidubce.com/oauth/2.0/token发起POST请求获取,有效期30天但建议每次调用前刷新。
实际语音合成请求地址为:https://aip.baidubce.com/rest/2.0/tts/v1,请求方式为POST,Header必须包含Content-Type: application/json,Body为JSON格式,含text(待合成文本)、lang(语言,zh_CN或en)、cuid(设备唯一标识,可填任意字符串如“dify-workflow-2026”)、ctp(客户端类型,填1)、per(发音人ID,如106=度小宇男声、110=度小美女声)、spd(语速0–15,默认5)、pit(音调0–15,默认5)、vol(音量0–15,默认5)。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
注意:text字段内容必须UTF-8编码且URL转义,中文直接传入即可,但若含特殊符号(如&、=)必须encodeURI处理,否则百度API会返回错误码282000。
在Dify Workflow中接入百度TTS
进入Dify控制台 → 新建Workflow应用 → 拖入「用户输入」节点,字段名设为“text”,类型为段落,最大长度5000,必填。
拖入「LLM」节点 → 选择qwen2.5模型 → 在System提示词中写:你是一个语音参数提取器。请从用户输入{{#1768335663610.text#}}中提取纯文本,去除所有Markdown标记、链接、代码块,只保留可朗读内容。输出格式严格为{"text":"..."},不加任何额外字符或换行。
拖入「HTTP请求」节点 → 方法选POST → URL填https://aip.baidubce.com/rest/2.0/tts/v1?access_token={{#xxx.token#}}(token需先由前置节点生成)→ Body填:{"text":"{{#llm.text#}}","lang":"zh_CN","cuid":"dify-workflow-2026","ctp":1,"per":110,"spd":6,"pit":5,"vol":10} → Headers添加Content-Type: application/json。
关键一步:在HTTP请求节点前插入一个「代码」节点(Custom Code),用Python脚本调用百度OAuth接口获取access_token,并将结果存入变量token,供后续HTTP节点引用。脚本需使用requests库,传入data={"grant_type": "client_credentials", "client_id": "你的API Key", "client_secret": "你的Secret Key"}。

















