config.yaml配置失效或模型调用失败时,需检查YAML语法、缩进(禁用Tab)、字段对齐及base_url、api_mode等关键参数;支持OpenRouter、Ollama、vLLM及多模型fallback四种配置写法。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您尝试配置Hermes Agent但config.yaml文件未生效或模型调用失败,则可能是由于YAML语法错误、字段层级错位或关键参数缺失。以下是针对config.yaml文件的详细配置说明与多种写法示例:
一、主模型配置结构与规范
config.yaml是Hermes Agent的核心运行配置,定义了默认模型、服务提供商、API端点及调用模式。其顶层结构必须严格遵循YAML缩进规则,model节为必填项,provider字段决定后端路由逻辑。
1、确保使用空格缩进(禁止Tab),model下default与provider需对齐,缩进为两个空格。
2、base_url必须以http://或https://开头,末尾不加斜杠,且协议、主机、端口三者缺一不可。
3、api_mode必须为chat_completions或embeddings之一,Hermes仅支持OpenAI兼容接口模式。
二、OpenRouter模型配置写法
OpenRouter作为聚合型模型网关,需在.env中预设OPENROUTER_API_KEY,并在config.yaml中声明provider与模型ID。该方式支持动态切换200+模型,无需本地部署。
1、打开~/.hermes/config.yaml,定位至model段落。
2、写入以下标准格式(注意冒号后必须有空格):
model:
default: anthropic/claude-3.5-sonnet
provider: openrouter
base_url: https://openrouter.ai/api/v1
3、保存文件后执行hermes doctor验证连接状态。
三、Ollama本地模型配置写法
Ollama提供零依赖本地推理能力,config.yaml需显式指定模型名称与HTTP服务地址。该方式适用于无网络或高隐私场景,完全离线运行。
1、确认ollama serve已在后台运行,监听默认端口11434。
2、执行ollama list确认目标模型(如qwen2:7b)已拉取成功。
3、在config.yaml中写入如下内容:
model:
default: qwen2:7b
provider: ollama
base_url: http://localhost:11434
4、重启Hermes进程使配置加载:pkill -f hermes && hermes。
四、自托管vLLM服务配置写法
vLLM适合GPU服务器环境,通过其OpenAI兼容API暴露服务。config.yaml需精确匹配vLLM启动时指定的--host与--port参数。
1、启动vLLM服务时明确绑定地址,例如:vllm serve --host 0.0.0.0 --port 8000 --model Qwen2-7B-Instruct。
2、在config.yaml中配置对应字段:
model:
default: Qwen2-7B-Instruct
provider: openai
base_url: http://192.168.1.100:8000/v1
3、将base_url中的IP替换为实际服务器内网地址,避免使用localhost。
五、多模型fallback策略配置写法
Hermes支持按优先级链式回退机制,当首选模型超时或返回错误时自动切换至备用模型。该配置需在model节内嵌套fallback字段。
1、在config.yaml中构建带fallback的model结构:
model:
default: z-ai/glm-5.1
provider: majiabin
base_url: https://api.majiabin.com/v1
fallback:
- model: qwen2:7b
provider: ollama
base_url: http://localhost:11434
- model: openrouter/auto
provider: openrouter
base_url: https://openrouter.ai/api/v1
2、每个fallback项必须包含model、provider、base_url三个字段,顺序即为回退优先级。


















