Hermes Agent提供五种部署方式:一、Docker Compose一键部署;二、源码克隆本地运行;三、极空间NAS设备部署;四、Modal云原生部署;五、边缘设备轻量级部署,适配不同硬件与使用场景。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望在本地环境中运行Hermes Agent,但尚未完成基础配置或遇到启动失败、模型无法加载、渠道不可用等问题,则可能是由于环境依赖缺失、配置路径错误或服务端口冲突所致。以下是部署Hermes Agent的多种可行方法:
一、使用Docker Compose一键部署
该方法通过预构建镜像与标准化配置实现快速启动,避免手动安装Python依赖和环境变量设置,适合大多数Linux/macOS系统及极空间等NAS设备。
1、创建部署目录并进入:
mkdir -p ~/hermes && cd ~/hermes
2、创建docker-compose.yml文件,内容如下:
version: "3.8"
services:
hermes:
image: nousresearch/hermes-agent:latest
container_name: hermes
restart: unless-stopped
command: gateway run
volumes:
- ~/.hermes:/opt/data
deploy:
resources:
limits:
memory: 4G
cpus: "2.0"
3、确保已设置环境变量MINIMAX_CN_API_KEY(或其他模型API密钥),并在~/.bashrc或当前shell中执行:
export MINIMAX_CN_API_KEY=your_actual_api_key_here
4、启动服务:
docker compose up -d
二、从源码克隆并本地运行
该方法适用于需要调试代码、修改Agent行为或集成自定义技能的开发者,可完全控制Python版本、依赖项及配置逻辑。
1、克隆官方仓库:
git clone https://gitcode.com/GitHub_Trending/he/hermes-agent
2、进入项目目录并安装依赖:
cd hermes-agent
./scripts/install.sh
3、配置服务器类型为OpenAI兼容模式(默认):
python run_agent.py --openai.server_type openai
4、如需接入本地Ollama模型,启动Ollama服务后,修改environments/hermes_swe_env/hermes_swe_env.py中的base_url为:
http://localhost:11434/v1
三、在极空间NAS设备上部署
该方案专为极空间Z4 Pro+等设备优化,利用其内置Docker与SSH能力,实现无公网IP下的私有化Agent运行,适配飞书/企微/钉钉等国内办公渠道。
1、通过极空间App启用Docker与SSH功能
2、SSH连接设备后,执行镜像拉取:
docker pull jvsheng/hermes-agent:latest
3、创建docker-compose.yml(注意映射/opt/data至可写路径):
volumes:
- /mnt/app/hermes-data:/opt/data
4、启动容器并进入交互式配置:
docker exec -it hermes-agent bash
hermes gateway setup
5、在配置流程中选择飞书渠道,并填入APP ID与App Secret,系统将自动生成webhook地址
四、使用Modal平台进行云原生部署
该方式适用于需要弹性扩缩容、按需计费及跨区域部署的场景,由Modal自动管理基础设施,无需维护服务器或容器生命周期。
1、安装Modal CLI:
pip install modal-client
2、登录Modal账户:
modal login
3、准备deployment.py脚本,引用ModalDeployment类:
from swerex.deployment.modal import ModalDeployment
deployment = ModalDeployment(config=config)
4、启动部署:
await deployment.start()
5、Modal将自动构建精简镜像(基于debian_slim)、挂载持久化存储卷,并暴露HTTPS终端网关地址,该地址格式为:https://your-app-name.modal.run
五、边缘设备轻量级部署
该方法针对CPU双核、内存4GB、存储10GB的嵌入式设备(如树莓派5、Jetson Nano),通过裁剪工具集与禁用非必要服务降低资源占用。
1、编辑toolsets.py,仅保留最小化工具集:
_HERMES_MINIMAL_TOOLS = ["file_tools", "terminal", "web_search"]
2、使用Alpine基础镜像构建运行时环境:
FROM python:3.11-alpine
RUN pip install --no-cache-dir torch==2.1.0 transformers==4.36.0
3、启动时指定低资源参数:
python run_agent.py --openai.server_type vllm --vllm.max_model_len 512 --vllm.gpu_memory_utilization 0.4
4、关键配置项需强制设为本地路径,防止写入失败:
memories_dir: /tmp/hermes/memories
logs_dir: /tmp/hermes/logs


















