可通过免费API或本地部署实现Hermes Agent双模型支持:一、DeepSeek用官方免费额度+OpenAI兼容接口;二、Qwen用DashScope每日1000次免费调用;三、Ollama本地运行轻量蒸馏模型;四、.env文件安全管理密钥;五、/model指令实时切换模型。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望在 Hermes Agent 中同时使用 DeepSeek 与 Qwen 模型,但又不依赖付费 API 配额或高成本调用,则可通过免费可用的模型接入方式实现。以下是针对两种模型的多种可行配置路径:
一、使用 DeepSeek 免费 API 接入方式
DeepSeek 官方为部分用户提供免费额度,且其 v4 系列模型完全兼容 OpenAI 协议,可直接通过标准接口接入 Hermes Agent,无需额外代理或转换层。
1、在终端中执行配置向导命令:hermes model。
2、当提示选择 Provider 时,输入 OpenAI Compatible 对应的编号。
3、在 Base URL 输入框中粘贴:https://api.deepseek.com/v1。
4、输入您的 DeepSeek 免费 API Key(可在 DeepSeek 平台 账户中查看)。
5、模型名称处填写:deepseek-v4-flash(免费额度下推荐,响应快、成本低)。
二、通过 DashScope 免费额度接入 Qwen
阿里云 DashScope 提供 Qwen 系列模型的免费调用额度(每日 1000 次请求或 100 万 tokens),且支持 OpenAI 兼容模式,可无缝对接 Hermes Agent。
1、访问 DashScope 控制台,进入「API 密钥管理」创建新 Key。
2、执行 hermes model 启动配置流程。
3、选择 Provider 类型为 Alibaba Cloud / DashScope 或手动选择 OpenAI Compatible。
4、Base URL 填写:https://dashscope.aliyuncs.com/compatible-mode/v1。
5、输入 DashScope API Key(注意:该 Key 不同于百炼 Token Plan 的 Key)。
6、模型字段填入:qwen-turbo(免费额度内优先使用,延迟低、响应稳定)。
三、本地部署轻量模型替代方案
若网络受限或需完全离线运行,可借助 Ollama 或 LM Studio 在本地运行开源 Qwen 或 DeepSeek 蒸馏版模型,并通过 OpenAI 兼容接口暴露给 Hermes Agent。
1、安装 Ollama:curl -fsSL https://ollama.com/install.sh | sh。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
2、拉取轻量模型:ollama run qwen2:0.5b 或 ollama run deepseek-coder:1.3b。
3、启动 OpenAI 兼容服务:OLLAMA_HOST=0.0.0.0:11434 ollama serve(需确保端口开放)。
4、在 Hermes 配置中选择 OpenAI Compatible,Base URL 设为:http://localhost:11434/v1。
5、API Key 可任意填写(Ollama 默认无需认证),模型名填对应标签如 qwen2:0.5b。
四、环境变量安全配置方式
为避免密钥硬编码在配置文件中,建议将所有 API Key 存入 .env 文件,由 Hermes 自动加载,提升安全性与可维护性。
1、创建或编辑环境变量文件:nano ~/.hermes/.env。
2、写入以下内容(替换为实际 Key):
DEEPSEEK_API_KEY=sk-xxx
QWEN_API_KEY=sk-yyy。
3、保存后退出,确保文件权限为仅当前用户可读:chmod 600 ~/.hermes/.env。
4、在 config.yaml 中引用变量,例如:api_key: ${DEEPSEEK_API_KEY}。
五、验证双模型切换功能
完成配置后,Hermes Agent 支持运行时动态切换模型,无需重启服务,便于对比效果与响应效率。
1、启动对话界面:hermes chat。
2、发送任意测试语句,确认默认模型(如 DeepSeek)正常响应。
3、在对话中输入指令:/model qwen qwen-turbo。
4、系统返回提示:Switched to Qwen-Turbo。
5、再次提问,验证响应来源已切换至 Qwen 模型。


















