需配置自定义大模型接口接入Minimax:一、申请API Key并开通abab5.5-chat/abab6-chat权限;二、部署minimax-openai-proxy代理服务转换协议;三、在FastGPT中添加模型配置并确保网络可达;四、适配Prompt模板、禁用tools调用、优化知识库参数;五、测试对话流、校验token计费与超时机制。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望在FastGPT中接入Minimax模型以增强智能客服系统的响应能力,需通过配置自定义大模型接口实现。Minimax未提供公开的OpenAI兼容API,因此必须基于其官方API文档构造适配层。以下是完成集成的具体步骤:
一、申请Minimax API Key并确认权限
Minimax模型调用需有效API Key及对应模型访问权限,未开通权限将返回403错误。您需登录Minimax开发者控制台完成实名认证与模型授权。
1、访问Minimax开发者控制台,使用企业邮箱注册账号。
2、进入「API密钥管理」页面,点击「创建新密钥」,填写应用名称为“FastGPT-CustomerService”。
3、在「模型权限」中勾选abab5.5-chat与abab6-chat两项,提交审核。
4、审核通过后,复制生成的api_key与group_id,二者均需在后续配置中使用。
二、部署Minimax代理API服务(兼容OpenAI格式)
FastGPT原生仅支持OpenAI风格接口,而Minimax采用自有协议,因此需部署轻量级反向代理服务进行协议转换。该服务接收OpenAI格式请求,转发为Minimax格式,并将响应还原为OpenAI结构。
1、克隆开源代理项目:git clone https://github.com/MiniMax-Platform/minimax-openai-proxy。
2、修改.env文件,填入MINIMAX_API_KEY、MINIMAX_GROUP_ID及监听端口PORT=3001。
3、执行npm install && npm start启动服务,验证接口可用性:curl -X POST http://localhost:3001/v1/chat/completions -H "Content-Type: application/json" -d '{"model":"abab5.5-chat","messages":[{"role":"user","content":"你好"}]}'。
4、确保返回含choices[0].message.content字段的JSON,且HTTP状态码为200。
三、在FastGPT中添加自定义模型配置
FastGPT通过models.json或环境变量注入外部模型信息,需明确定义模型标识、请求地址、鉴权方式及参数映射规则,否则前端下拉列表无法显示该模型。
1、进入FastGPT项目根目录,打开docker/.env文件(若使用Docker部署)或config/models.json(若源码部署)。
2、在models数组末尾追加以下JSON对象:
{
"name": "minimax-abab5.5",
"avatar": "?",
"maxOutput": 4096,
"price": {"input": 0.0008, "output": 0.0008},
"request": {
"url": "http://host.docker.internal:3001/v1/chat/completions",
"headers": {"Authorization": "Bearer <strong><font color="green">YOUR_MINIMAX_API_KEY_HERE</font></strong>"}
}
}
3、若使用Docker Compose,确保fastgpt服务能通过host.docker.internal访问宿主机的3001端口;若部署于Kubernetes,需配置Service DNS或ClusterIP。
4、重启FastGPT服务:执行docker-compose restart fastgpt或重新构建镜像。
四、配置知识库与Prompt工程适配Minimax特性
Minimax模型对system prompt敏感度高于Llama或Qwen系列,且不支持tools调用,需调整FastGPT默认提示词模板,避免触发无效字段解析异常。
1、进入FastGPT管理后台,导航至「系统设置 → 模型配置 → minimax-abab5.5」。
2、将「系统Prompt」替换为以下内容:
你是一名专业客服助手,严格依据提供的知识库内容回答问题。禁止编造信息、禁止输出markdown、禁止使用编号列表。所有回答必须简洁、口语化、单段落,长度不超过120字。
3、关闭「启用工具调用」开关,因Minimax当前API不支持function calling字段。
4、在「知识库匹配策略」中,将「最大相关片段数」设为3,「最小相似度」设为0.65,适配Minimax对长上下文理解较弱的特点。
五、测试对话流并校验Token消耗准确性
集成完成后需验证端到端链路是否正常,重点检查流式响应中断、token计费偏差及错误码透传问题,避免用户提问后界面卡死或计费异常。
1、在FastGPT聊天界面右上角选择模型「minimax-abab5.5」,输入问题:“订单号123456789的发货时间是?”
2、打开浏览器开发者工具,切换至Network标签页,筛选/api/v1/chat/chat请求,确认响应Header中包含X-Used-Tokens: 217字段。
3、对比Minimax控制台「用量统计」中同一时间段的abab5.5-chat调用记录,核对input_tokens与output_tokens总和是否一致。
4、手动触发超时场景:发送含1000字以上长文本的问题,观察FastGPT是否在30秒内返回504 Gateway Timeout而非挂起,确认代理层超时配置已生效。


















