OpenClaw API额度耗尽主因是未切换至本地模型,需通过Ollama本地部署实现零Token消耗:验证服务运行、强制配置base_url指向localhost:11434/v1、禁用远程回退、监控请求流向并改用Ollama原生API协议。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您正在为 OpenClaw 或其他 AI Agent 框架的 API 额度频繁耗尽而困扰,却发现免费额度始终用不完,问题很可能出在调用路径未真正切换至本地模型。Ollama 本地部署可使全部推理请求完全脱离云端 API,实现零 Token 消耗。以下是实现该效果的具体方法:
一、验证 Ollama 服务是否正常运行
本地模型调用的前提是 Ollama 后台服务已启动并监听默认端口,否则所有请求仍将回退至远程 API。需确认服务状态与基础连通性。
1、打开终端(Windows 使用 PowerShell 或 CMD,macOS/Linux 使用 Terminal)。
2、执行命令 ollama list,检查是否列出已安装模型(如 qwen2.5-coder:14b、llama3 等)。
3、执行命令 curl http://localhost:11434,若返回空响应或 404,说明服务已启动;若报 “Connection refused”,则需重新运行 ollama serve。
4、访问 http://localhost:11434/health,确认返回 JSON 中 status: "ok"。
二、强制 OpenClaw 使用本地 Ollama 接口
OpenClaw 默认可能仍配置为调用云端 API,必须显式修改其 LLM 配置项,将 base_url 指向本地 Ollama 服务,并禁用远程密钥验证逻辑。
1、定位 OpenClaw 配置文件,通常为 config.toml 或 config.example.toml(重命名为 config.toml)。
2、在 [llm] 区块中,将 base_url 修改为 "http://localhost:11434/v1"。
3、将 api_key 设为任意非空字符串(如 "sk-ollama-local"),部分版本要求该字段存在但不校验值。
4、确保 model 字段值与 ollama list 输出的模型名称完全一致(含大小写及冒号后版本标识)。
三、关闭所有远程 API 回退机制
某些 OpenClaw 版本内置失败自动降级逻辑,当本地请求超时或返回错误时会悄悄切回云端 API,导致 Token 悄悄消耗。必须禁用该行为以杜绝隐性调用。
1、在配置文件中查找是否存在 fallback_to_remote、auto_retry_cloud 或类似字段。
商业LOGO设计技能:依据用户描述,使用阿里云百炼千问图像模型(qwen‑image‑2.0‑pro)生成专业商业LOGO图片。适用场景:设计公司/品牌LOGO、生成商业标识图标、创建品牌视觉符号、按描述生成logo图片。支持自定义尺寸、风格、负面提示词等。
2、将其值明确设为 false 或 "disabled"。
3、若配置项不存在,需在 [llm] 下新增一行:disable_fallback = true。
4、重启 OpenClaw 进程,确保新配置加载生效。
四、监控实际请求流向
仅靠配置无法完全确认流量是否真实落地本地,需通过网络层观测验证请求是否真正发往 localhost 而非远程域名。
1、启动 Ollama 时添加日志开关:OLLAMA_DEBUG=1 ollama serve。
2、在另一终端执行 OpenClaw 任务,观察 Ollama 控制台是否实时打印出 POST /api/chat 及请求体内容。
3、使用系统工具抓包:在 macOS/Linux 执行 sudo tcpdump -i lo0 port 11434,Windows 可用 Wireshark 过滤 tcp.port == 11434。
4、确认抓包结果中无任何指向 api.openclaw.ai、api.moonshot.cn 或其他公网域名的 HTTP 流量。
五、替换模型调用协议为原生 Ollama 格式
部分 OpenClaw 部署依赖 OpenAI 兼容层,该层可能引入冗余封装或缓存逻辑,导致请求未被 Ollama 正确识别。直接使用 Ollama 原生 API 可彻底规避中间层风险。
1、修改配置中 base_url 为 "http://localhost:11434/api"(去掉 /v1 后缀)。
2、将 model 字段保留不变,但确保其格式符合 Ollama 命名规范(如 qwen2.5-coder:14b)。
3、在请求头中显式添加 Content-Type: application/json,避免因 MIME 类型不匹配触发代理转发。
4、构造原始 payload 示例:{"model":"qwen2.5-coder:14b","prompt":"你是谁?","stream":false},用 curl 直接测试。


















