Ollama是最轻量稳定的本地部署选择,只需下载安装、设置环境变量、运行ollama run deepseek-r1:7b命令即可几分钟内启动服务,支持GPU加速与API调用,全程无需云端依赖或服务器状态监控。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想在Windows电脑上不依赖云端、不看服务器状态,直接运行DeepSeek模型进行本地问答或知识库构建,Ollama是最轻量且稳定的选择——它能绕过复杂环境配置,一条命令拉取模型,几分钟内启动服务。
下载并安装Ollama(装到D盘)
打开浏览器,访问 ollama.com/download,点击 Windows 版本的 OllamaSetup.exe 下载安装包。
双击运行安装程序时,不要直接点“Install”,否则默认装进C盘;在弹出窗口中点击右下角“Customize installation”,将安装路径手动改为 D:\Ollama。
勾选 “Add to PATH” 选项,确保后续能在任意终端执行 ollama 命令。安装完成后,打开 PowerShell 或 CMD,输入:
ollama --version
若返回类似 “ollama version is 0.5.12” 的结果,说明安装成功。
修改模型存储位置(避免C盘爆满)
Ollama 默认把模型文件存在 C:\Users\用户名\.ollama\models,7B模型单个就占14GB,大模型动辄30GB以上。
必须提前设置环境变量,让所有新拉取的模型自动存到D盘:
① 按 Win+R 输入 sysdm.cpl → “高级”选项卡 → “环境变量” → “系统变量” → “新建”
② 变量名填:OLLAMA_MODELS
③ 变量值填:D:\OllamaModels
设置完后,必须刷新环境变量:打开任务管理器 → 找到“Windows 资源管理器” → 右键 → “重新启动”。这一步跳过会导致后续 pull 失败,模型仍写入C盘。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
拉取并运行DeepSeek-R1模型
方法一(推荐新手):直接运行交互式会话
在终端输入:
ollama run deepseek-r1:7b
首次运行会自动拉取模型,约14GB,需保持网络畅通。下载完成后直接进入聊天界面,输入 /? 可查看帮助命令。
方法二(便于后续集成):先拉取再创建别名
ollama pull deepseek-r1:7b
ollama create my-ds -f "FROM deepseek-r1:7b"
之后用 ollama run my-ds 启动,名称更简短,也方便在UI工具里引用。
注意:如果显存≥6GB,可加 --gpu 参数加速推理:
ollama run my-ds --num-gpu 1
验证服务是否正常启动
模型启动后,默认监听 https://www.php.cn/link/dcd3f83c96576c0fd437286a1ff6f1f0/api/tags
打开浏览器,访问 https://www.php.cn/link/dcd3f83c96576c0fd437286a1ff6f1f0,页面显示 JSON 格式的模型列表,说明 API 服务已就绪。
若打不开,检查是否被杀毒软件拦截,或执行:
netstat -ano | findstr :11434
确认端口处于 LISTENING 状态。


















