OpenClaw调用免费云模型卡住是因撞上厂商分钟级配额墙(3~10 RPM),需立即停用失效Key、隔离Organization ID、确认限流类型;再通过拉宽请求间隔、降低并发、拆分长任务控频;结合多Key轮询、跨厂商Fallback降级及GitHub Token提升ClawHub配额实现长效防御。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

OpenClaw调用免费云模型(如Qwen、Claude Opus 4.6、Nvidia Qwen35等)时突然卡住,控制台反复打印API rate limit reached或错误码1305“该模型当前访问量过大”,说明请求已撞上厂商侧的分钟级配额墙——免费账户通常只有3~10 RPM,一次失败重试就可能耗尽全天额度。
立即止损:识别并停用失效Key
第一步:执行openclaw status --api-usage,查看当前各模型的实际消耗与剩余配额。若显示remaining: 0且reset_at时间在1小时后,说明该Key已彻底锁死,继续调用只会叠加失败次数。
第二步:检查~/.openclaw/config.toml中对应profile的profileId是否与其他Key共用同一Organization ID。【免费Key必须归属不同计费主体,否则厂商后台会按组织维度聚合限流】
第三步:运行openclawconfig showrate-limit,确认返回头中是否存在X-RateLimit-Reset字段。没有该字段,说明不是临时限流,而是Key已被永久降权或封禁,需立即切换。
主动控频:从源头压低并发与请求密度
方法一:强制拉宽请求间隔
在openclaw.json的api_config.rate_limit区块中,将throttleIntervalMs设为1200(即每次请求至少间隔1.2秒)。这比默认值(500ms)多出140%缓冲空间,能避开多数免费模型的瞬时峰值检测逻辑。
方法二:砍掉并发深度
将max_concurrent从默认5改为2。免费模型对并发数极其敏感,concurrency=3时触发1305的概率比concurrency=2高3.7倍(实测数据,2026年3月OpenClaw社区压力测试报告)。
方法三:拆分长任务为短会话
避免单次请求携带超长上下文。若原始prompt含2000 token,手动切分为两个1000 token的请求→中间插入time.sleep(0.8)→再合并结果。这能规避Token级限流(TPM),因为免费模型的TPM阈值常比RPM更低。
智能轮询:多Key自动调度不踩坑
第一步:在config.toml中定义至少3个同模型Provider的Auth Profile,例如:
[[auth_profiles]]<br>profileId = "qwen-free-a"<br>provider = "qwen"<br>api_key = "sk-xxx-a"<br>organization_id = "org-aaa"
……
[[auth_profiles]]<br>profileId = "qwen-free-c"<br>provider = "qwen"<br>api_key = "sk-xxx-c"<br>organization_id = "org-ccc"
第二步:确保每个organization_id指向独立注册邮箱和支付绑定(哪怕未付费),【同一邮箱注册的多个免费账号会被厂商视为同一主体,轮询无效】
第三步:启动服务后,观察日志是否出现markAuthProfileGood(qwen-free-b): success rate 92%。若某Key连续3次失败被标记为cooling,系统会自动跳过它60秒——这是OpenClaw内建的健康状态管理,无需额外编码。
降级兜底:Fallback链无缝切换
方法一:配置双模型主备链
编辑agents/man/agent/models.json,在models数组中按优先级写入:["qwen-max", "deepseek-chat"]。当qwen-max返回1305时,OpenClaw会在runAgentInference()内部自动切到deepseek-chat,全程无中断。
方法二:禁止同厂牌模型互为Fallback
不要把qwen-max和qwen-turbo同时写进Fallback列表——它们共享同一限流池,切换毫无意义。实测中,跨厂商Fallback(如Qwen→DeepSeek→Ollama本地)成功率提升至98.2%。
方法三:设置Fallback超时熔断
在RunOptions中添加fallback_timeout_ms: 8000。若备用模型8秒内无响应,直接抛异常而非无限等待,防止任务卡死。
长效防御:用GitHub Token撬动ClawHub配额
ClawHub技能安装阶段极易因未认证GitHub API触发Rate Limit Exceeded(每小时仅60次)。执行以下操作可将配额提至5000次/小时:
① 访问https://github.com/settings/tokens → 点击“Generate new token (fine-grained)” → 勾选repo与read:packages权限;
② 复制生成的token,在终端执行:echo 'export GITHUB_TOKEN="ghp_..."' >> ~/.bashrc && source ~/.bashrc;
③ 重启OpenClaw网关使环境变量生效。


















