Hermes Agent免费模型与付费模型在调用权限、上下文长度、多模态能力、API频次及更新优先级五方面存在差异:免费模型免配置但限512K上下文、仅文本、3次/分钟、延迟更新;付费模型需授权,支持1M上下文、图像/视频/音频解析、高并发、热更新与实验功能。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在使用 Hermes Agent 时发现模型选项中既有免费型号又有标价型号,则需明确二者在调用权限、能力边界与服务保障上的实际差异。以下是区分 Hermes Agent 免费模型与付费模型的关键点:
一、模型调用权限与访问方式
免费模型通过 Hermes Agent 内置的 NousPortal 接口直接调用,无需额外配置凭证或订阅账户;付费模型则需绑定有效支付凭证并完成额度授权后方可启用。
1、启动 Hermes Agent 后执行 hermes model list 命令,查看当前可用模型列表。
2、识别模型名称后缀:带 -free 标签的为免费模型,如 MiMo-V2-Pro-free;无此标签且标注价格的为付费模型。
3、对免费模型执行 hermes model set MiMo-V2-Pro-free 即可立即切换使用。
二、上下文长度与推理性能限制
免费模型在单次请求中强制启用上下文截断机制,最大允许处理长度为 512K token;付费模型支持完整 1M token 上下文窗口,并启用动态分块缓存优化。
1、向 Agent 发送含长文档的指令时,观察响应头部是否出现 [TRUNCATED] 标识。
2、若出现该标识,说明当前使用的是免费模型且已触发截断保护。
3、切换至付费模型后,执行相同指令,确认响应中不再出现截断提示且返回内容完整性提升。
三、多模态能力开放范围
免费模型仅开放文本输入与文本输出通道;付费模型额外解锁图像解析、视频帧提取与音频语义转录三项能力接口。
1、尝试发送一张 PNG 格式截图至 Hermes Agent 对话窗口。
2、若收到 "Unsupported media type for current model" 提示,则表明正在使用免费模型。
3、切换至 MiMo-V2-Omni 后重试,确认 Agent 能正确识别图中文字并生成摘要。
四、API 请求频次与并发控制
免费模型实行严格的速率限制:每分钟最多 3 次请求,单次会话最多维持 5 分钟活跃状态;付费模型解除上述限制,支持连续会话与高并发批量调用。
1、在终端中运行 hermes api status 查看当前模型的配额余量。
2、当返回值中 "rate_limit_remaining": 0 时,表示已达免费模型调用上限。
3、此时执行 hermes model upgrade 并按提示完成支付流程,即可恢复调用权限。
五、模型更新优先级与专属功能开关
付费模型用户享有新版本热更新推送权,且可提前 72 小时启用实验性功能开关;免费模型更新延迟不少于 5 个工作日,且无法开启 Flash 加速、技能链预编译等高级特性。
1、运行 hermes version --check 查看本地版本与远程最新版差异。
2、若输出中显示 "available: v0.8.3 (premium only)",说明该版本仅限付费用户获取。
3、执行 hermes model flash enable 测试是否支持轻量响应模式——成功返回 "Flash mode activated" 表示已激活付费权限。


















