随着自主AI智能体技术不断迭代,Hermes Agent凭借记忆持久化、自主技能生成、沙盒命令执行、浏览器自动化、多模型兼容能力,成为开发者搭建本地与云端智能体的主流开源项目。很多开发者本地调试完成之后,希望把Hermes Agent部署至云端服务器,实现7×24小时不间断运行,脱离本地电脑限制。阿里云ECS作为弹性云算力实例,可以提供稳定的云端运行环境,搭配百炼平台Coding Plan、Token Plan两套订阅服务,能够为Hermes Agent提供强大的大模型推理底座,无需反复管理多个模型服务商密钥,统一使用订阅套餐额度完成智能体全部任务调用。
很多新手在部署过程中会遇到各类问题:服务器环境依赖缺失、安全组端口没有放行、两套订阅计划接口地址混淆、密钥类型混用、配置参数填写错误导致调用报错、WebUI无法公网访问、服务无法开机自启等。本文作为保姆级实操教程,完整覆盖ECS实例准备、一键脚本部署、Docker容器部署两种部署方式,分别讲解Coding Plan、Token Plan两套订阅方案的完整配置命令,包含配置文件示例、服务启停、访问验证、开机自启、故障排查,帮助零基础开发者完成整套云端Hermes Agent环境搭建。阿里云部署AI Agent:OpenClaw/Hermes Agent全网最简单,只需两步,详情👉访问阿里云OpenClaw/Hermes一键部署专题页面了解。








Token Plan Token 最便宜/支持多模型切换:👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。




前期准备工作
首先完成ECS服务器实例选型与初始化。Hermes Agent资源消耗和开启的工具能力强相关,如果开启浏览器自动化、网页抓取工具,内存占用会明显提升。最低配置建议2核2G,仅做简单对话任务可以勉强运行;生产环境推荐选择2核4G及以上实例,操作系统选用主流CentOS Stream或者Ubuntu LTS版本。如果内存低于2G,运行浏览器工具时极易出现OOM内存溢出,进程直接崩溃退出。
实例创建完成之后,进入安全组配置页面,必须放行端口18789,该端口为Hermes Agent WebUI默认访问端口;同时开放22端口用于SSH远程连接。不要直接放行全部端口,仅开放业务必要端口,保障服务器安全。
本地终端使用ssh工具连接ECS服务器:
ssh root@你的ECS公网IP地址
输入服务器登录密码,成功登录服务器终端。
订阅层面,需要提前在百炼控制台完成对应订阅。Coding Plan面向编程场景,按照请求次数扣费,适合高频短会话代码任务;Token Plan按照Token折算Credits扣费,适合长文档解析、多模态、复杂Agent任务。两套订阅拥有各自独立专属API Key,不能使用普通按量计费的DashScope密钥代替,密钥页面只会在生成的时候完整展示,务必复制保存,关闭页面之后无法再次查看完整密钥内容。
重要区分:Coding Plan密钥、Token Plan密钥、普通按量API Key三者体系互相独立,混用会直接鉴权失败。
方式一:一键脚本部署Hermes Agent(新手首选)
官方提供一键安装脚本,自动处理系统依赖、二进制下载、环境变量初始化,不需要手动处理复杂编译,适合绝大多数用户。登录ECS服务器终端,直接执行安装脚本:
curl -fsSL https://hermes.aliyun.com/install.sh | bash
脚本执行完成,验证安装结果:
hermes --version
输出版本号即代表安装成功。如果提示command not found,执行source刷新环境变量:
source /root/.bashrc
执行完成之后,Hermes的配置目录位于~/.hermes/,核心配置文件config.yaml所有模型、密钥、运行参数全部保存在该目录,后续升级安装不会覆盖该目录数据,会话记忆、自定义技能都会持久化保存。
接下来启动后台服务,同时开启WebUI面板:
hermes start
查看运行状态确认服务正常:
hermes status
输出running代表服务正常运行。此时浏览器访问http://ECS公网IP:18789,即可打开Hermes Agent网页操作界面。如果打不开页面,优先回到安全组确认18789端口已经放行,同时检查服务器内部防火墙iptables、firewalld是否拦截端口。
设置开机自启,服务器重启之后自动拉起Hermes Agent服务,避免服务器重启后服务中断:
hermes service install
执行完成之后,系统会注册systemd服务,服务器开机自动运行Agent。查看systemd服务日志排查运行异常:
journalctl -u hermes -f
方式二:Docker容器化部署(进阶,环境隔离)
对于追求环境隔离,避免系统包冲突的开发者,推荐使用Docker容器部署Hermes Agent。先在ECS服务器安装Docker运行环境:
# Ubuntu系统
apt update && apt install docker.io docker-compose -y
systemctl enable docker && systemctl start docker
拉取官方稳定镜像:
docker pull hermes-agent/stable:latest
运行容器,做目录挂载持久化配置数据,映射WebUI访问端口,设置上海时区:
docker run -d \
--name hermes-agent \
--restart unless-stopped \
-p 18789:18789 \
-v ~/.hermes:/root/.hermes \
-e TZ=Asia/Shanghai \
hermes-agent/stable:latest
查看容器运行日志,确认启动无报错:
docker logs hermes-agent
进入容器内部执行hermes相关配置命令:
docker exec -it hermes-agent bash
容器部署模式下,所有配置命令和裸机脚本部署完全一致,配置同样保存至挂载目录~/.hermes,删除容器不会丢失会话与技能数据。
配置百炼Coding Plan订阅接入Hermes Agent
Coding Plan专门面向AI编程场景,按照请求次数进行计费,适合大量代码生成、调试、脚本编写的Agent任务,拥有专属Anthropic兼容接口地址。在服务器终端直接使用hermes config系列命令一键写入全部配置,替换下面命令中YOUR_CODING_PLAN_API_KEY为你自己的Coding Plan专属密钥。
# 设置模型提供商类型为custom自定义
hermes config set model.provider custom
# Coding Plan专属接口地址
hermes config set model.base_url https://coding.dashscope.aliyuncs.com/apps/anthropic
# 指定接口兼容模式
hermes config set model.api_mode anthropic_messages
# 填入Coding Plan专属API Key
hermes config set model.api_key "YOUR_CODING_PLAN_API_KEY"
# 设置默认运行模型
hermes config set model.default qwen3.7‑plus
命令执行完成,配置自动写入~/.hermes/config.yaml配置文件。也可以手动编辑配置文件,vi打开文件:
vi ~/.hermes/config.yaml
写入完整配置片段:
model:
default: qwen3.7‑plus
provider: custom
base_url: https://coding.dashscope.aliyuncs.com/apps/anthropic
api_mode: anthropic_messages
api_key: "YOUR_CODING_PLAN_API_KEY"
保存退出配置文件,重启Hermes Agent服务让配置生效:
hermes restart
执行测试命令验证链路是否正常连通:
hermes chat -q "写一个shell脚本,遍历目录统计每个文件行数"
如果Agent正常输出脚本代码,说明Coding Plan接入完成,后续所有Agent推理请求都会消耗Coding Plan订阅额度。
配置百炼Token Plan订阅接入Hermes Agent
Token Plan采用Credits统一抵扣机制,支持多模型、多模态调用,适合长文本处理、图像理解、复杂多步骤Agent任务,提供OpenAI兼容接口地址。同样使用hermes config命令快速配置,替换YOUR_TOKEN_PLAN_API_KEY为Token Plan生成的sk‑sp开头专属密钥。
hermes config set model.provider custom
hermes config set model.base_url https://token‑plan.cn‑beijing.maas.aliyuncs.com/compatible‑mode/v1
hermes config set model.api_key "YOUR_TOKEN_PLAN_API_KEY"
hermes config set model.default qwen3.7‑max
手动修改config.yaml完整内容参考:
model:
default: qwen3.7‑max
provider: custom
base_url: https://token‑plan.cn‑beijing.maas.aliyuncs.com/compatible‑mode/v1
api_key: "YOUR_TOKEN_PLAN_API_KEY"
配置修改完毕重启服务:
hermes restart
执行连通性测试:
hermes chat -q "简单介绍Hermes Agent具备哪些核心能力"
能够正常返回回答,则Token Plan配置生效。
重要提示:Token Plan接口地址和Coding Plan接口地址完全不一样,不要互相复制混用,否则直接鉴权报错。订阅地域必须和接口地址地域保持一致,否则额度无法抵扣调用失败。
WebUI面板使用与功能验证
浏览器访问http://ECS公网IP:18789进入Hermes Agent网页界面。可以在WebUI内切换模型、开启浏览器工具、启用沙盒终端执行代码、创建自定义技能。
执行完整Agent能力测试,发送指令:
请你读取服务器当前目录,列出文件,然后写一段python脚本读取系统内存占用,输出格式化结果。
正常情况下Agent会自主调用终端工具执行命令,编写脚本运行,返回结果,代表云端整套环境完整可用。
查看Hermes Agent运行日志,排查调用报错,查看API请求返回详情:
hermes logs
Coding Plan与Token Plan如何选型
很多开发者会纠结两套订阅计划该如何选择。Coding Plan以请求次数计费,无论输入输出Token长短,一次请求消耗一次额度,适合短会话、高频代码编写调试场景,性价比高;Token Plan按照实际Token折算Credits扣费,适合百万级长上下文文档读取、图片多模态解析、复杂多步骤长链路Agent任务。如果平时以写代码为主优先Coding Plan;经常处理长文档、截图解析、多模型切换调试,优先选择Token Plan。两套订阅可以随时修改config配置快速切换,不需要重新部署Hermes Agent。
高频踩坑避坑指南
- 密钥混用问题:Coding Plan、Token Plan、普通按量计费API Key不能互相替换,接口地址与密钥必须一一对应,拿到密钥先确认是哪一套订阅生成。
- WebUI打不开:优先检查ECS安全组放行18789端口,服务器本地防火墙是否拦截,确认hermes status状态为running。
- 调用返回鉴权失败:核对base_url地址是否复制完整,检查订阅所在地域,确认订阅状态没有过期,密钥复制不要带入多余空格换行符。
- 进程崩溃OOM:内存不足,关闭浏览器自动化工具,或者升级ECS实例内存规格,浏览器工具会消耗大量内存资源。
- 修改配置之后不生效:修改config.yaml配置文件之后,必须执行
hermes restart重启服务,新配置才会加载。 - 服务器重启服务停止:务必执行
hermes service install注册systemd开机自启服务,否则服务器重启后Agent不会自动运行。 - 容器部署修改配置:容器模式下修改配置,修改宿主机
~/.hermes/config.yaml,重启容器即可生效,不要进入容器内部修改配置文件,挂载目录会覆盖内部修改。 - 公网安全风险:直接暴露WebUI到公网存在安全风险,生产环境建议增加密码访问鉴权,或者配置反向代理增加身份校验,避免被外部恶意访问。
零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程
第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面。








👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。




第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:
- 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
- 实例:内存必须2GiB及以上。
- 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
- 时长:根据自己的需求及预算选择。



第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
- 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
- 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
- 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
- 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。
阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:
创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
- 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。

- 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。

- 在服务器概览页面单击应用详情页签,进入服务器详情页面。

- 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。

- 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。

- 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。


生产环境优化建议
云端长期运行Hermes Agent,建议做几项优化。第一,定期查看日志,监控API调用消耗,及时查看百炼控制台订阅用量,避免额度耗尽任务中断。第二,不要直接裸暴露WebUI公网,增加身份验证机制。第三,开启日志轮转,防止日志文件持续膨胀占用磁盘。第四,定期备份~/.hermes整个目录,保存会话记忆和自定义技能,故障可以快速恢复。第五,不需要使用浏览器工具的时候,在配置内关闭浏览器组件,降低内存消耗。
Hermes Agent部署在ECS云服务器之后,摆脱本地电脑限制,可以全天候运行智能体任务,搭配百炼两套订阅方案,灵活适配代码开发、文档处理、多模态解析等不同业务场景。整套部署流程分为服务器准备、安装Agent、配置订阅密钥、验证连通性、安全加固几个步骤,新手优先使用一键脚本部署,快速跑通业务;有环境隔离需求的开发者使用Docker容器部署。遇到报错优先查看hermes logs日志,区分是服务器网络问题、配置参数错误,还是订阅密钥鉴权问题,分层定位问题,就可以稳定运行云端自主AI智能体。