要让Fitten Code连接私有本地模型,需先登录并启用本地模式,再配置localModelEndpoint、localModelProvider及可选的localModelApiKey,最后通过状态栏、补全响应和Network面板验证连接成功。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想让Fitten Code不再调用云端API,而是连接自己部署在内网服务器或本地显卡上的Qwen3-4B、ChatGLM3或CodeGeeX-13B等私有模型,必须绕过默认云服务路径,手动指定模型API地址与通信协议。
确认Fitten Code已登录并启用本地模式开关
打开VS Code → 左侧扩展图标 → 搜索“Fitten Code” → 确保状态为“已启用”且右下角显示绿色登录标识。【未登录状态下所有本地模型配置均无效】。
点击右下角Fitten Code图标 → 选择“Settings” → 在设置搜索框中输入“local model” → 找到“Fitten Code: Enable Local Model Mode”选项并勾选。这一步会禁用所有远程模型自动发现逻辑,强制插件等待你手动注入地址。
配置本地模型API端点(HTTP方式)
按下 Ctrl + ,(Windows/Linux)或 Cmd + ,(macOS)→ 点击右上角“打开设置(JSON)” → 在用户级 settings.json 文件最外层大括号内插入以下字段:
"fitten.code.localModelEndpoint": "http://127.0.0.1:8000/v1/chat/completions",
"fitten.code.localModelProvider": "openai",
注意:端口和路径需与你实际启动的本地服务完全一致。比如OpenCode默认用8080,CodeGeeX默认用8000;若你用Ollama跑Qwen3-4B,则应填 http://127.0.0.1:11434/api/chat。
【切勿遗漏末尾斜杠前的v1/chat/completions,这是OpenAI兼容接口的固定路径,填错将返回404】。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
配置模型身份与认证(可选但推荐)
如果你的本地服务启用了API Key校验(如FastChat、vLLM或自建Flask后端),需同步配置密钥:
"fitten.code.localModelApiKey": "sk-local-xxxxx",
该字段值必须与你本地服务配置的allowed_api_keys列表中某一项完全匹配。不填则Fitten Code发送请求时不带Authorization头,多数服务会拒绝响应。
若本地服务未设密钥,此项可留空或删除,但建议保留字段并设为空字符串 "",避免插件因字段缺失 fallback 到云模式。
验证本地模型是否成功接管
第一步:关闭VS Code全部窗口 → 重新打开一个含.py文件的项目 → 等待右下角Fitten Code状态栏从“Loading…”变为“Ready (Local)”。
第二步:在代码中输入def hello(): → 换行后敲# → 按Tab键触发补全 → 观察弹出建议是否由你本地模型生成(如响应延迟明显高于云端、内容风格更贴近你部署的Qwen3而非通用大模型)。
第三步:打开VS Code开发者工具(Help → Toggle Developer Tools)→ 切换到Network标签页 → 再次触发一次补全 → 查看是否有请求发往你配置的http://127.0.0.1:8000 → 若看到status 200且response body含"choices"字段,说明连接成功。

















