必须安装Ollama本地运行模型并配置OpenClaw指向http://localhost:11434,选用codellama:7b等兼容chat模式的模型,禁用云端兜底逻辑,才能实现完全离线、零费用、数据不出本地的大模型调用。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想让OpenClaw彻底脱离云端API、不花一分钱调用大模型,同时保证代码和文档永远不离开本地电脑——这必须依赖Ollama在本机运行模型并提供标准接口,否则OpenClaw仍会回退到收费的远程服务。
安装Ollama并验证基础服务
前往 https://ollama.com/download 下载对应你操作系统的安装包,Windows用户直接运行exe,macOS用户双击pkg,Linux用户执行提供的shell脚本。
安装完成后打开终端(或命令提示符),输入 ollama --version 确认版本号不低于 【0.3.7】;低于此版本会导致OpenClaw无法识别服务端点。
运行 ollama serve 启动服务,此时服务默认监听 http://localhost:11434。别关掉这个窗口——它不是后台进程,关闭即服务中断。
下载并加载适合OpenClaw的本地模型
OpenClaw对模型格式和响应协议有严格要求,必须使用支持chat模式且兼容OpenAI API schema的模型。
方法一:快速启用基础能力
执行 ollama run llama3:8b,Ollama会自动拉取、解压并启动该模型。首次运行耗时较长(约3–5分钟),取决于你的SSD读取速度。
方法二:选用代码增强型模型(推荐)
执行 ollama pull codellama:7b → 等待下载完成 → 再执行 ollama run codellama:7b。该模型在函数生成、语法纠错、上下文理解上明显优于通用版,尤其适配OpenClaw的任务编排逻辑。
【注意】不要用phi-3或gemma系列——它们缺少system角色支持,OpenClaw初始化时会报错“invalid message role”并拒绝连接。
配置OpenClaw指向本地Ollama服务
第一步:确认OpenClaw已安装且能正常启动(v0.8.2及以上)。
第二步:找到OpenClaw配置文件路径:
Windows:%APPDATA%\OpenClaw\config.yaml
macOS:~/Library/Application Support/OpenClaw/config.yaml
Linux:~/.config/openclaw/config.yaml
第三步:用文本编辑器打开该文件,在llm:节点下修改以下两项:
provider: "ollama"base_url: "http://localhost:11434/api/chat"
第四步:保存文件,重启OpenClaw桌面客户端。如果左下角状态栏显示“✅ Ollama (codellama:7b)”,说明连接成功。
强制OpenClaw跳过云端兜底逻辑
OpenClaw默认开启“云端失败自动降级”机制,哪怕Ollama已就绪,它仍会在每次请求末尾尝试调用OpenAI API——这会产生隐蔽的token消耗。
打开OpenClaw主界面 → 点击右上角齿轮图标 → 进入「高级设置」→ 找到「Fallback Behavior」选项 → 将其设为 【Disabled】。
这一步不可跳过。若保留默认值,即使Ollama响应成功,OpenClaw也会额外发起一次OpenAI请求,导致账户被扣费。


















