收到“API调用余额不足”提示时,需依次检查服务商账户余额、密钥配额、更换新密钥、切换低开销模型、精简系统提示与输入内容。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在使用Hermes Agent过程中收到“API调用余额不足”的提示,说明当前绑定的API密钥所关联账户已无可用资金或配额耗尽,无法继续发起计费请求。以下是解决此问题的步骤:
一、检查API服务商账户实时余额
余额未更新是常见原因,前端界面可能缓存旧值,需通过多途径交叉验证真实可用金额。
1、登录对应API服务商官网(如OpenAI、智谱AI、Moonshot或majia bin等平台)。
2、进入账户中心或Billing页面,查找“可用余额”“Wallet Balance”或“当前资金”字段。
3、手动刷新页面,若数值未变,尝试退出账号后重新登录。
4、使用curl命令直连账户余额接口(如https://api.majiabin.com/v1/account/balance),在Header中携带Authorization: Bearer <your_api_key>,查看响应中balance字段是否大于0。
二、核查API密钥绑定的调用配额使用情况
即使余额充足,部分平台对单个密钥设定了独立的Token/请求量配额,配额耗尽也会触发相同错误。
1、在服务商控制台进入「API Keys」管理页。
2、点击当前用于Hermes Agent的密钥,展开其使用统计面板。
3、确认“今日已用Token”“每分钟请求数”及“配额重置时间”三项数值是否已达上限。
4、若显示“已用完”或剩余为0,需等待重置,或升级密钥权限等级以获取更高配额。
三、强制刷新并更换API密钥
旧密钥可能被服务端标记为失效,或仍关联充值前的校验状态,生成新密钥可重置全部绑定关系。
1、在API服务商平台定位当前密钥,点击「Revoke」撤销。
2、点击「Create new API key」生成全新密钥。
3、打开Hermes Agent配置文件(config.yaml或.env),将api_key字段完整替换为新密钥值。
4、确保所有环境变量、Docker容器配置、IDE运行参数中同步更新,避免残留旧密钥。
四、临时切换为低开销模型降低Token消耗
高参数量模型(如glm-5.1、gpt-4-turbo)单位请求Token成本显著高于轻量模型,降级可快速释放额度压力。
1、打开config.yaml文件,定位到model:配置区块。
2、将default:后的模型标识由z-ai/glm-5.1改为z-ai/glm-3-turbo,或将gpt-4-turbo替换为gpt-3.5-turbo。
3、保存文件,重启Hermes Agent服务进程。
4、重新执行此前失败的操作,观察是否仍报余额不足。
五、精简Hermes Agent系统提示与输入内容
冗余的System Prompt和过长的用户输入会成倍增加单次请求Token用量,人工压缩可立即腾出可用额度。
1、打开config.yaml,找到system_prompt或default_system_message字段。
2、删除所有“例如”“你可以这样理解”“请严格按以下格式输出”等非必要解释性语句。
3、将角色定义压缩至单句,如将“你是一个支持多语言、能处理代码与文档的全能助手……”简化为“你是一名专注技术任务执行的轻量级AI助手”。
4、对技能导入或批量处理场景,导出原始JSON/Markdown,删除debug_notes、update_history等元数据字段,并将说明文字压缩至原长度60%以内。


















