随着AI智能体技术快速迭代,能够自主完成代码编写、任务拆解、工具调用、记忆沉淀的Hermes Agent已经成为开发者提升研发效率的重要工具。Hermes Agent属于自进化型AI智能体,具备会话持久记忆、任务自动拆解、技能卡片沉淀、多工具编排调度等核心能力,可以依托云服务器7×24小时持续运行,不需要依赖本地电脑开机,适合开发自动化脚本、项目迭代、批量任务处理等多种业务场景。想要让Hermes Agent发挥完整能力,必须对接大模型推理服务,Token Plan订阅方案是适配该智能体的服务模式,通过兼容OpenAI协议接口,让Hermes Agent调用系列大模型完成思考与工具执行。本文将完整讲解在阿里云ECS云服务器环境,从零完成实例准备、环境初始化、Hermes Agent安装、Token Plan订阅开通、命令行参数配置、服务启动验证、后台常驻运行以及各类调试避坑的完整实操流程,所有操作均提供可直接复制的命令,零基础开发者也可以跟着步骤完成部署落地。
一、ECS实例选型与前期准备工作
部署Hermes Agent对硬件资源门槛并不高,该工具本身轻量化,资源消耗主要来自大模型API网络调用,本地仅承担调度、会话存储、任务编排逻辑,不需要本地部署大模型。最低配置选择1核2G内存实例就可以稳定运行,适合个人开发者测试;如果需要长时间高并发执行复杂任务、多会话同时交互,建议选择2核4G及以上配置,系统盘预留至少10GB存储空间,用于存放运行依赖、会话记忆日志、技能卡片数据。操作系统优先选择Ubuntu 22.04 LTS版本,文档中全部命令基于Debian系Linux编写,也兼容Alibaba Cloud Linux、CentOS等主流系统,部分包管理命令需要做对应调整。
零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程
第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面。








👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。




第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:
- 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
- 实例:内存必须2GiB及以上。
- 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
- 时长:根据自己的需求及预算选择。



第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
- 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
- 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
- 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
- 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。
阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:
创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
- 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。

- 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。

- 在服务器概览页面单击应用详情页签,进入服务器详情页面。

- 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。

- 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。

- 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。


创建ECS实例完成之后,重点配置安全组规则,安全组是云服务器的网络访问屏障,必须提前放行必要端口,否则后续SSH远程连接、Web控制台访问会直接失败。入方向需要放行22端口用于SSH终端连接,放行18789端口为Hermes Agent WebUI管理面板默认端口,仅开放业务必需端口,不要设置0.0.0.0全网无限制开放,保障服务器安全。实例创建完成,等待状态变为运行中,记录实例公网IP地址,后续远程登录会使用。
本地终端工具可以使用系统自带SSH客户端,也可以使用Workbench网页终端、Xshell、FinalShell等第三方工具。首次登录服务器,使用root账号,建议后续创建普通业务账号运行Hermes Agent,不直接使用root账号执行业务程序,降低安全风险。
登录服务器之后,首先执行系统更新,安装基础依赖组件,curl用于下载安装脚本,git用于版本拉取,python3相关组件为运行时基础环境,执行下面命令:
apt update -y
apt upgrade -y
apt install curl git python3 python3-pip -y
若是Alibaba Cloud Linux系统,把apt替换为dnf包管理器执行。
执行完成后校验基础环境,确认Python版本满足3.10及以上最低要求:
python3 --version
如果版本低于3.10,需要升级Python环境,版本过低会出现依赖安装报错、程序运行异常等问题。
系统防火墙层面,Ubuntu系统使用ufw,需要放行18789端口,避免系统内部防火墙拦截访问:
ufw allow 22/tcp
ufw allow 18789/tcp
ufw reload
二、Hermes Agent一键安装与安装结果校验
Hermes Agent官方提供一键安装脚本,不需要手动处理复杂依赖,直接在ECS终端执行脚本下载安装命令,脚本会自动完成二进制程序下载、环境变量配置,把hermes命令注册到系统PATH路径下,安装脚本命令如下:
curl -fsSL https://arms-apm-cn-hangzhou-pre.oss-cn-hangzhou.aliyuncs.com/hermes-agent-cms-plugin/hermes-cms.sh | bash
安装脚本执行结束之后,需要校验是否安装成功,输入版本查看命令:
hermes --version
终端输出版本号即代表安装流程顺利完成;如果提示command not found,代表环境变量没有生效,执行下面命令刷新shell环境:
source ~/.bashrc
刷新之后再次执行版本校验。如果依旧无法识别命令,可以查看~/.local/bin目录是否存在hermes二进制文件,该目录是脚本默认安装位置,若存在文件,手动把路径写入环境变量配置文件。
补充说明:除脚本一键安装之外,也可以使用pipx工具隔离虚拟环境安装,pipx可以避免和系统Python包冲突,适合对环境纯净度有要求的场景,安装命令:
pipx install hermes-agent
安装完成之后,可以执行交互式初始化命令,初步进入程序交互界面:
hermes chat
此时还没有配置模型服务,会抛出模型配置缺失报错,属于正常现象,接下来完成Token Plan订阅接入配置即可解决该报错。
三、Token Plan订阅开通与专属API‑Key获取
Hermes Agent本身不提供大模型推理能力,全部对话思考、工具调用逻辑都依赖外部模型接口,Token Plan是专门适配Agent工具的订阅方案,使用该方案需要先完成账号订阅,获取专属sk‑sp‑开头的API‑Key凭证,注意普通按量计费的百炼API密钥不能直接用于Token Plan接入,密钥格式存在明确区分,很多新手踩坑就是混用两种密钥,导致接口调用返回鉴权失败。
登录百炼控制台,进入Token Plan服务页面,根据自身需求选择个人版或者团队版订阅,完成订阅之后,跳转密钥管理页面,创建Token Plan专属API‑Key,密钥只会展示一次,复制保存,丢失之后只能重新生成,旧密钥直接失效。同时确认服务地域,本文示例使用北京地域接口地址,密钥地域和接口访问地域必须保持一致,跨地域调用会返回鉴权拒绝。
拿到密钥之后有两套配置方式,第一种为命令行配置(推荐新手,配置自动写入配置文件,不容易出现yaml格式缩进错误),第二种为手动编辑配置文件,适合高级用户精细化修改参数。
方式一:命令行批量设置参数
直接在ECS终端逐条执行下面配置命令,把YOUR_SK_SP_KEY替换为自己复制得到的Token Plan专属密钥,模型可以根据订阅支持的模型列表自行修改,示例选用qwen3.7‑plus作为默认模型:
# 设置模型提供者为custom兼容OpenAI协议模式
hermes config set model.provider custom
# Token Plan北京地域兼容接口地址
hermes config set model.base_url https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
# 设置Token Plan专属API密钥
hermes config set model.api_key YOUR_SK_SP_KEY
# 设置默认调用大模型名称
hermes config set model.default qwen3.7-plus
全部命令执行完毕,配置会自动保存到~/.hermes/config.yaml路径,不需要手动编辑文件。
方式二:手动编辑配置文件
使用文本编辑器打开配置文件,写入完整yaml配置内容,注意yaml对缩进极其敏感,必须使用空格缩进,禁止使用Tab制表符,编辑命令:
vim ~/.hermes/config.yaml
填入配置内容:
model:
provider: custom
base_url: https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
api_key: YOUR_SK_SP_KEY
default: qwen3.7-plus
保存退出vim编辑器。
配置完成,执行测试调用命令,验证链路是否全部打通:
hermes chat -q "请简单介绍下你自己"
终端正常返回AI回答,代表Token Plan接入全部成功;如果报错,进入后续调试排查章节。
四、WebUI面板启动与systemd后台常驻配置
前面全部是命令行交互,Hermes Agent提供Web可视化管理面板,执行下面命令启动Web服务:
hermes desktop --host 0.0.0.0 --port 18789
参数--host 0.0.0.0代表监听服务器全部网卡,允许外部公网访问,端口18789和安全组放行端口保持一致。浏览器访问地址为http://ECS公网IP:18789,即可打开Web管理界面,查看会话记录、技能卡片、运行日志。
直接前台运行程序,关闭SSH终端窗口服务就会终止,生产环境需要配置systemd托管,实现开机自启、后台常驻、异常自动重启。创建systemd服务单元文件:
sudo tee /etc/systemd/system/hermes-agent.service <<EOF
[Unit]
Description=Hermes‑Agent AI智能体服务
After=network.target
[Service]
User=root
WorkingDirectory=/root
ExecStart=/root/.local/bin/hermes desktop --host 0.0.0.0 --port 18789
Restart=always
RestartSec=10
[Install]
WantedBy=multi‑user.target
EOF
重载systemd配置,设置开机自启并且立刻启动服务:
sudo systemctl daemon‑reload
sudo systemctl enable --now hermes‑agent.service
查看服务运行状态确认是否正常启动:
systemctl status hermes‑agent.service
看到active (running)代表常驻服务运行成功。查看实时运行日志命令:
journalctl -u hermes‑agent.service -f
五、调试避坑指南,高频故障原因与解决方案
部署Hermes Agent整套流程,绝大多数问题集中在密钥错误、接口地址写错、地域不匹配、安全组/防火墙拦截、套餐额度耗尽、配置yaml格式错误、服务器内存不足,下面整理高频报错现象以及对应的排查命令,方便快速定位问题。
故障1:测试对话返回Empty response from model空响应
空响应是最高频报错,常见诱因:API‑Key不是Token Plan专属密钥,混用普通按量密钥;base_url地址复制错误,多空格、换行;模型名称填写错误,订阅套餐并不支持填写的模型。
排查步骤:
- 核对密钥前缀,Token Plan密钥必须sk‑sp‑开头;
- 打印当前全部模型配置,查看已写入参数:
hermes config get model
- 核对base_url完整字符串,不能存在多余空格;
- 确认订阅套餐包含当前default指定模型;
- 重新执行全套config set命令覆盖错误配置,再次测试。
故障2:浏览器无法打开18789Web页面,连接超时
- 检查ECS控制台安全组入方向规则,确认18789端口放行;
- 服务器本机防火墙放行端口,Ubuntu执行:
sudo ufw allow 18789/tcp
sudo ufw reload
- 在服务器内部测试端口监听状态:
ss -tulpn | grep 18789
没有输出代表程序没有正常监听端口,检查systemd服务状态,查看报错日志。
故障3:hermes命令找不到command not found
安装脚本执行成功,但终端识别不到命令,环境变量没有加载,执行:
source ~/.bashrc
echo $PATH
确认~/.local/bin在PATH环境变量列表中,如果不在,写入~/.bashrc:
echo 'export PATH="$HOME/.local/bin:$PATH"' >> ~/.bashrc
source ~/.bashrc
故障4:服务启动瞬间崩溃,systemd状态显示failed
查看详细报错日志定位根因:
journalctl -u hermes‑agent.service -n 100
常见诱因:服务器内存不足,1核1G实例在大任务场景容易OOM被系统杀死;配置文件yaml缩进错误;Python版本过低;依赖包缺失。内存不足需要升级ECS实例规格;yaml错误建议改用命令行config set方式写入配置,避免手动编辑缩进问题。
故障5:返回access denied无权访问模型
- 确认Token Plan订阅状态有效,没有过期;
- API‑Key地域和base_url接口地域保持一致;
- 确认该账号订阅套餐权限包含当前调用模型;
- 密钥不要复制前后多余空格,重新生成密钥替换测试。
故障6:执行任务工具调用失败,智能体无法执行shell命令
Hermes Agent具备权限审批机制,默认执行高危系统操作会请求人工确认。可以修改审批模式,在配置文件增加approvals配置项:
approvals:
mode: smart
timeout: 60
mode可选manual每次询问、smart低风险自动放行、off关闭全部校验,off模式仅可信内网环境使用,公网服务器不建议关闭审批,存在安全风险。也可以在交互式会话输入/yolo临时跳过审批校验。
六、运维与版本更新实操命令
部署完成之后,后续需要对Hermes Agent进行版本升级、配置备份、日志清理等运维操作。
版本更新命令:
curl -fsSL https://arms-apm-cn-hangzhou-pre.oss-cn-hangzhou.aliyuncs.com/hermes-agent-cms-plugin/hermes-cms.sh | bash
更新完成之后,重启systemd服务:
sudo systemctl restart hermes‑agent.service
备份配置文件,防止误操作丢失参数:
cp ~/.hermes/config.yaml ~/.hermes/config.yaml.bak
查看程序内置运行日志:
hermes logs
停止后台常驻服务:
sudo systemctl stop hermes‑agent.service
七、业务场景拓展与使用注意事项
Hermes Agent部署在ECS云服务器之后,除了WebUI、命令行交互,还可以搭配MCP协议接入各类本地工具,实现读取服务器文件、执行脚本、数据库查询等复杂自动化任务。Token Plan订阅方案有使用约束,适合交互式Agent场景,不建议用于大规模离线批处理、压测场景,避免触发接口访问限制。
安全层面,WebUI面板默认没有账号密码认证,公网直接暴露存在风险,正式使用建议增加Nginx反向代理,增加BasicAuth账号密码校验,或者配置仅允许指定IP访问安全组,不要把Web面板直接对公网全量开放。API‑Key属于敏感凭证,禁止提交到代码仓库,做好密钥保管,如果密钥泄露,立刻在控制台删除旧密钥重新生成。
当执行复杂大型任务时,会消耗较多token,需要关注Token Plan套餐余量,余量耗尽会直接导致模型调用全部失败,需要及时续费订阅。同时ECS服务器需要做好监控,观察CPU、内存使用率,当频繁出现OOM终止进程,需要升级实例配置保障智能体稳定运行。
总结
整套部署流程分为ECS实例准备、系统依赖安装、Hermes Agent部署、Token Plan订阅获取专属密钥、命令行配置模型参数、功能连通性测试、配置systemd后台常驻、故障调试排错几个核心环节。很多新手部署失败,大多是混淆普通按量密钥与Token Plan专属密钥、接口地址复制出错、安全组端口没有放行、yaml配置缩进错误,优先使用hermes config set系列命令完成配置,能够规避绝大多数配置文件格式问题。
依托ECS云服务器运行Hermes Agent,摆脱本地电脑限制,可以全天候运行智能体,完成代码开发、脚本编写、文件处理、任务自动化,结合Token Plan订阅服务,能够稳定调用大模型能力,是个人开发者、小团队落地AI智能体的低成本实践方案。在实际使用过程中,遇到异常优先查看日志输出,报错信息基本可以直接定位故障源头,按照调试避坑章节的步骤逐项核对参数,即可快速解决绝大多数接入、运行问题。