已发布的克隆音色才能调用:在「我的音色」确认状态为【已发布】;网页端通过「智能配音」或「API调试页」调用;集成API需获取密钥、构造JWT鉴权头、正确填写voice_name等参数。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想在讯飞智作里把刚克隆好的专属音色真正用起来,比如给视频配音、生成有声书或接入自动化流程,但找不到调用入口或不清楚API怎么配参数。
确认音色已训练完成并发布成功
登录讯飞智作官网→进入「AI声音工厂」→点击「我的音色」,查看目标音色状态。只有显示【已发布】的音色才能被调用,灰色“训练中”或“审核中”状态无法使用。
若音色卡在“待审核”,需检查是否违反内容安全规范:系统会自动拦截含敏感词、方言混杂、背景噪音过大的录音样本。
网页端直接调用生成语音
方法一:在「智能配音」工作台调用
打开「智能配音」→粘贴文本→点击「选择发音人」→在「我的音色」分类下找到你的克隆音色→点击启用→点击「立即合成」。
注意:首次调用时,页面右上角会弹出「音色授权确认」浮层,必须勾选「同意将该音色用于本次合成任务」才能继续,否则始终停留在加载状态。
方法二:通过「API调试页」快速验证
进入「开发者中心」→「API调试工具」→选择「TTS语音合成v3」接口→在voice_name参数中填入你音色的完整ID(格式如:iflytek_custom_20260815_xxxx)→输入测试文本→点击「发送请求」。
这一步操作起来很简单,直接把文件拖进去就行。返回结果为base64音频数据或直链URL,可立即播放验证音色还原度。
调用API集成到自有系统
第一步:获取凭证
在「开发者中心」→「应用管理」中创建新应用,获取APP_ID、API_KEY、SECRET_KEY三组密钥。
第二步:构造请求头
必须使用HTTPS协议,Header中携带Authorization字段,值为"Bearer " + 由API_KEY和SECRET_KEY签发的JWT令牌,过期时间2小时,超时需重新签发。
第三步:提交合成请求
POST /v3/tts 接口,Body为JSON,关键字段包括:text(UTF-8编码纯文本,单次≤300字)、voice_name(音色ID,大小写敏感)、sample_rate(推荐16000)、speed(0.5~2.0)、volume(0~100)。其中【voice_name必须与「我的音色」列表中显示的ID完全一致,复制时勿带空格或换行】。
第四步:处理响应
成功返回code=0,data.audio包含base64音频流;若返回code=10112,说明音色ID不存在或未发布;code=10105表示token失效。音频默认为MP3格式,无需额外转码即可嵌入网页audio标签播放。


















