Hermes Agent支持五大模型系列:一、Hermes-2-Pro(32B,高性能主力);二、Hermes-3-Lite(4.2B MoE,边缘轻量);三、Hermes-Mini(Phi-3蒸馏,纯离线嵌入式);四、Hermes-Quant(INT4量化,企业级安全部署);五、Hermes-Adapter(LoRA适配器,行为模式热切换)。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望为不同硬件条件或使用场景选择合适的Hermes Agent运行配置,则需明确其背后所依赖的模型家族差异。Hermes Agent本身不绑定单一模型,而是通过灵活的模型网关支持多种后端,其中Nous Research自研的Hermes系列模型构成其核心推理基础。以下是针对不同规模Hermes模型的介绍:
一、Hermes-2-Pro系列:高性能主力模型
Hermes-2-Pro是当前Hermes Agent推荐部署的主力模型,专为复杂任务链与高精度工具调用优化。该系列基于Qwen2架构深度微调,参数量达32B,在多步规划、技能生成与上下文建模方面表现突出。其设计目标是在16GB以上内存设备上提供低延迟响应,并支持完整的MCP协议解析能力。
1、在config.yaml中将model_provider设为nous_portal,并指定model_name: hermes-2-pro-32b。
2、启动时需确保Nous_API_KEY环境变量已正确配置,否则将触发本地Ollama回退机制。
3、该模型默认启用四层内存中的“技能过程记忆”模块,无需额外开启开关。
二、Hermes-3-Lite系列:轻量级边缘适配模型
Hermes-3-Lite面向资源受限环境设计,采用MoE稀疏激活结构,激活参数仅约4.2B,可在8GB内存设备(如树莓派5或Android Termux)稳定运行。它牺牲部分长程推理深度,但保留全部学习循环核心逻辑,包括周期性Nudge触发、自主技能生成判断与SQLite会话检索功能。
1、在~/.hermes/config.toml中设置model = "hermes-3-lite-4b-moe"。
2、执行hermes-cli --init --lite命令自动下载量化权重与精简工具集。
3、首次运行时系统将提示启用compact_persistent_memory以降低内存占用,此选项不可关闭,否则将导致技能沉淀失败。
三、Hermes-Mini系列:嵌入式与离线场景专用
Hermes-Mini是唯一支持纯离线部署的模型子系列,基于Phi-3蒸馏,整包体积小于2.1GB,可完整加载至手机本地存储。它禁用网络工具调用与远程记忆同步,但保留本地FTS5索引构建能力与终端命令执行权限。适用于无网络连接的工业控制终端或安全隔离实验室环境。
1、使用hermes-installer --offline --model mini完成安装,安装器将自动跳过所有联网验证步骤。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
2、所有技能文件生成路径强制锁定为/data/data/com.termux/files/home/.hermes/skills/offline/,该路径无法通过配置文件修改。
3、定时提醒(Nudge)间隔延长至每30个turn一次,以减少CPU唤醒频率。
四、Hermes-Quant系列:企业级部署优化模型
Hermes-Quant系列专为企业私有化部署设计,提供INT4量化版本与vLLM张量并行支持。该系列包含三个子型号:Hermes-Quant-S(标准版)、Hermes-Quant-E(加密增强版,集成国密SM4密钥封装)、Hermes-Quant-T(可信执行版,仅在Intel TDX或AMD SEV-SNP环境中启动)。所有型号均通过CNAS认证的供应链安全审计。
1、部署前须导入企业证书至/etc/hermes/certs/目录,否则hermes-daemon拒绝启动。
2、执行hermes-quant-setup --mode enterprise初始化安全沙盒环境。
3、Hermes-Quant-E与Hermes-Quant-T不兼容任何第三方模型网关,仅允许接入Nous Portal Enterprise Endpoint。
五、Hermes-Adapter系列:模型即插即用扩展套件
Hermes-Adapter并非独立模型,而是一组轻量级LoRA适配器,用于动态切换Hermes-2-Pro或Hermes-3-Lite的行为模式。目前发布四个官方适配器:CodeCraft(编程强化)、DocuMind(文档理解)、SysAdmin(系统运维)、LangBridge(多语种交互)。每个适配器体积小于8MB,支持热加载且不影响主模型权重。
1、将适配器文件放入~/.hermes/adapters/目录后,执行hermes-cli --adapter list确认识别状态。
2、在会话中发送指令/use adapter CodeCraft即可即时启用编程模式。
3、同一时间仅允许一个Adapter处于激活状态,重复启用将自动卸载前序适配器。

















