应根据知识库类型选择向量模型:结构化文档选hunyuan-embedding-v1,长文本选hunyuan-embedding-pro,中英混杂或含代码选bge-m3;须避开口语化强或术语多时使用通用小模型,且bge-m3需显式配置embedding_type。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

腾讯混元知识库应用中,向量模型选择直接影响检索准确率和响应速度,选错会导致召回内容不相关、答案张冠李戴甚至完全失效。
确认知识库场景类型
先判断你的知识库属于哪一类:是产品手册、FAQ、工单记录等结构清晰的文档,还是会议纪要、客服对话、研发日志等语义松散、口语化强的内容。前者适合通用语义模型,后者必须用领域微调或长文本适配模型。
如果知识库含大量技术术语、缩写(如“TCVDB”“RAG”“SA3.LARGE8”),【必须避开仅在通用语料上训练的开源小模型】,否则向量化后向量空间严重失真,相似度计算失去意义。
查看腾讯云控制台支持的向量模型列表
登录腾讯云向量数据库控制台 → 进入目标实例 → 点击「集合管理」→ 创建新集合时,在「向量化配置」区域下拉框可见当前地域可用的模型选项。
截至2026年9月,华南地区(广州)默认提供以下4个官方预置模型:hunyuan-embedding-v1、hunyuan-embedding-pro、text2vec-large-chinese、bge-m3。华北、华东节点可能略有差异,务必以你所购实例所在地域的实际列表为准。
按需求匹配具体模型
方法一:追求开箱即用且知识库为标准企业文档(PDF/Word/Markdown格式,内容规范)
选 hunyuan-embedding-v1。这是腾讯混元团队专为中文企业知识优化的轻量级嵌入模型,对产品参数、政策条款、FAQ问答对识别稳定,首字延迟低于300ms,适合90%的客服、培训、导览类知识库。
方法二:知识库含大量非结构化长文本(如万字技术白皮书、跨部门协作纪要、多轮对话日志)
选 hunyuan-embedding-pro。它支持最长8192 token输入,对段落间逻辑关联建模更强,实测在召回“某功能在哪个版本上线”“某故障的根因分析结论”类问题时,准确率比v1高22%。但推理耗时增加约40%,需确认QPS容量是否足够。
方法三:已有成熟向量检索经验,且知识库中英文混杂或含代码片段
选 bge-m3。该模型在MTEB中文榜单综合得分第一,对代码注释、API文档、中英术语混合场景鲁棒性极强。但注意:【它不兼容腾讯混元大模型原生提示词模板,需在conf/config.ini中将model.embedding_type显式设为bge】,否则后续RAG生成环节会报错。


















