Nova AI语音转写支持18种原生语言及粤语、印度英语、拉美西语等口音变体,中英混说自动分段识别,需启用enable_language_identification=true以激活语种漂移检测。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Nova AI语音转写能力直接决定跨语言会议记录、国际客户沟通、多语种课程听讲等场景能否真正落地。它不只支持中英双语,而是覆盖全球主流语种及方言变体,且识别逻辑深度适配各语言声学特征。
Nova AI官方支持的语音转写语言列表
截至2026年7月,Amazon Nova 2 Sonic模型通过Bedrock API开放的语音转写语言共18种,全部为原生支持,无需切换模型或额外配置:
中文(简体/繁体)、英语(美式/英式)、日语、韩语、西班牙语、法语、德语、意大利语、葡萄牙语(巴西/欧洲)、阿拉伯语、俄语、印地语、越南语、泰语、印尼语、马来语、菲律宾语、土耳其语。
【注意:中文识别默认启用“语境混合模式”,可自动区分普通话中的英文专有名词、技术术语及数字串,无需手动标注语种切换】
方言与口音适配能力说明
Nova AI不提供独立方言模型,但通过声学建模增强,在以下高频口音场景中实测准确率仍高于92%:
方法一:粤语——需在请求参数中显式指定 language_code=“yue-CN”,系统将调用粤语专属声学层,对“唔该”“咗”“啲”等高频虚词识别稳定;
方法二:印度英语——使用 language_code=“en-IN”,模型会强化对卷舌音/r/、齿龈音/t̪/的判别,避免将“three”误识为“tree”;
方法三:西班牙语拉美变体——language_code=“es-419”激活区域语法库,能正确解析“vosotros”与“ustedes”的动词变位差异,不混淆主谓一致。
四川话、东北话等国内方言暂未开放API接入,如需处理,建议先用小艺输入法完成本地转写,再将文本送入Nova进行语义理解或翻译。
多语种混说场景下的识别逻辑
第一步:模型默认启用“语种漂移检测”,每200ms音频帧独立判断当前语种;
第二步:当连续3帧置信度>85%时触发语种切换,并保留前序语种上下文缓存(最长3秒);
第三步:中英混说(如“这个feature需要下周deploy”)无需任何标记,系统自动分段识别并保持术语一致性——“feature”不会被强行转为“特性”,“deploy”不会译作“部署”;
第四步:若检测到语种边界模糊(如日语敬语“ですます”体与汉语助词“了”“呢”共现),模型将输出带置信度标签的双候选结果,供上层应用决策。
这一步不能跳过:必须在Bedrock调用时设置 enable_language_identification=true,否则默认关闭混说识别,整段音频强制按首帧语种处理。


















