必须修改Ollama默认端口至8000并配置Cherry Studio自定义LLM:API基础URL填http://localhost:8000/api,模型ID与ollama list名称严格一致,测试连接成功且能响应系统时间即接入完成。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在本地运行DeepSeek模型并让Cherry Studio识别、调用它,必须让两者通过标准API协议通信,不能直接拖入模型文件或点击加载——Cherry Studio不支持裸模型文件直连,只认HTTP服务端点。
确认DeepSeek已成功启动为本地API服务
先验证DeepSeek是否已在本地以API形式运行:打开终端,执行 curl http://localhost:8000/health。返回 {"status":"healthy"} 才算就绪;若报错 Connection refused,说明服务未启动或端口被占。
启动命令示例(使用Ollama):ollama run deepseek-coder:7b → 然后另起终端执行 ollama serve → 默认监听 http://127.0.0.1:11434。注意:Cherry Studio默认不兼容该端口,需额外代理或改配置。
【必须修改Ollama默认端口】 否则Cherry Studio无法自动发现服务。编辑 ~/.ollama/config.json,添加 "host": "127.0.0.1:8000" 并重启Ollama服务。
在Cherry Studio中配置DeepSeek后端地址
打开Cherry Studio客户端 → 点击左下角齿轮图标进入「设置」→ 选择「AI模型」→ 「添加模型」→ 「自定义LLM」。
填写以下三项:
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
- 模型名称:填
deepseek-7b-local(可任意,但不能含空格) - API基础URL:填
http://localhost:8000/api(不是/v1,也不是/) - 模型ID:填
deepseek-coder:7b(必须与Ollama中ollama list显示的名称完全一致)
点击「测试连接」→ 若弹出绿色对勾且返回响应时间(如 234ms),说明通路已建立。若提示 404 Not Found,大概率是API基础URL少写了 /api 路径段。
启用模型并验证对话功能
第一步:回到主界面,点击顶部模型切换按钮 → 从下拉列表中选择刚添加的 deepseek-7b-local。
第二步:新建一个聊天窗口 → 输入 你好,请用中文自我介绍 → 按回车。
第三步:观察右下角状态栏——出现 Thinking… 且3秒内返回文本,即表示接入成功。若卡住超过15秒,检查GPU显存是否溢出(nvidia-smi 查看),此时需关闭其他占用显存的进程。
第四步:输入 输出当前系统时间 → 若返回精确到秒的本地时间(如 2026年8月4日 18:13:22),说明模型具备上下文感知与工具调用能力,接入无残留异常。


















