Hermes Agent官方支持七类模型来源:Nous Portal(MiMo-V2系列)、OpenRouter(Llama 3.1等)、z.ai/GLM(GLM-4系列)、Kimi/Moonshot、MiniMax(abab系列)、OpenAI兼容接口及自定义端点;其中仅MiMo-V2 Omni通过全模态认证;配置通过config.yaml声明式注册,支持运行时动态切换。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在配置Hermes Agent时不确定可选用的模型来源,可能是因为未明确其官方支持的模型接入渠道。以下是Hermes Agent当前兼容的模型提供商及具体模型列表:
一、官方集成的大模型提供商
Hermes Agent架构原生支持多源大语言模型接入,无需修改核心代码即可切换后端模型服务。所有接入均通过标准化API网关完成,兼容主流认证与请求协议。
1、通过Nous Portal调用Xiaomi MiMo-V2系列模型,包括MiMo-V2 Pro、MiMo-V2 Omni与MiMo-V2 Flash;
2、接入OpenRouter平台,可选用其托管的Llama 3.1、Qwen 3、Phi-4等开源模型;
3、连接z.ai/GLM服务端点,支持GLM-4-Flash、GLM-4-Air等轻量推理模型;
4、对接Kimi/Moonshot API,启用Kimi Chat、Moonshot-128K等长上下文模型;
5、接入MiniMax平台,调用abab6.5、abab7等中文强优化模型;
6、使用OpenAI兼容接口,支持GPT-4o、GPT-4 Turbo(需自备API密钥与合规代理);
7、配置自定义端点,允许部署本地vLLM、Ollama或TGI服务,并映射至Hermes Agent统一调度层。
基于阿里云百炼 Qwen3.5-Omni 的全模态技能,支持文本、图片、音频、视频理解与文本/语音输出。适用于图片分析、音频转写理解、视频理解、跨模态问答及语音回复生成。
二、已验证的全模态专用模型
部分模型经Hermes Agent深度适配,具备跨模态感知与工具协同能力,可在同一会话中同步处理图像、音频、视频与文本输入。
1、MiMo-V2 Omni为唯一通过Hermes Agent全模态认证的模型,支持视觉理解、语音转写、帧级视频摘要及多模态工作流编排;
2、该模型需通过Nous Portal启用,且仅在限免期内开放全模态输入通道与跨会话记忆持久化功能;
3、其他模型如GPT-4o、Kimi Chat虽支持多模态API,但未激活Hermes Agent原生多模态路由协议,仅能处理文本增强型输入。
三、模型切换与配置方式
Hermes Agent采用声明式模型配置机制,所有模型源均在配置文件中以provider+model_id形式注册,运行时可动态加载。
1、编辑config.yaml中的llm_providers区块,添加对应服务商的API密钥与基础URL;
2、在default_model字段中指定模型标识符,例如nous:mi-mo-v2-pro或openai:gpt-4o;
3、启动Agent前执行hermes validate-config命令,校验模型端点连通性与权限有效性;
4、运行中可通过REST API向/v1/switch-model端点发送PATCH请求,实时切换当前会话所用模型。

















