保姆级Hermes Agent部署教程:阿里云 ECS 云服务器安装、Token Plan接入与业务验证

简介: 在AI智能体快速普及的当下,很多开发者希望拥有可以自主思考、执行任务、具备长期记忆的AI Agent,Hermes Agent作为一款自进化智能体框架,凭借跨会话持久记忆、工具调用、自主迭代学习的能力,成为开发人员搭建智能体应用的热门选择。传统本地部署会受限于本机硬件性能、网络环境,而使用ECS云服务器部署Hermes Agent,可以实现7×24小时持续运行,不受本地电脑开关机影响。同时搭配Token Plan订阅方案,能够大幅降低大模型调用开销,在大批量执行Agent任务时,有效控制Token消耗成本。本文面向零基础新手,完整讲解从ECS实例创建、服务器环境初始化、Hermes Agent

在AI智能体快速普及的当下,很多开发者希望拥有可以自主思考、执行任务、具备长期记忆的AI Agent,Hermes Agent作为一款自进化智能体框架,凭借跨会话持久记忆、工具调用、自主迭代学习的能力,成为开发人员搭建智能体应用的热门选择。传统本地部署会受限于本机硬件性能、网络环境,而使用ECS云服务器部署Hermes Agent,可以实现7×24小时持续运行,不受本地电脑开关机影响。同时搭配Token Plan订阅方案,能够大幅降低大模型调用开销,在大批量执行Agent任务时,有效控制Token消耗成本。本文面向零基础新手,完整讲解从ECS实例创建、服务器环境初始化、Hermes Agent安装、Token Plan密钥配置、功能测试、后台守护进程部署到常见故障排查的全部步骤,全程附带可直接复制执行的命令,即使是没有Linux操作经验的新手,按照步骤操作也能成功部署可用的Hermes Agent智能体。

一、部署前期准备工作

在正式安装Hermes Agent之前,需要完成两项基础准备:创建ECS云服务器实例,并且开通Token Plan,获取可用的API Key。

1.1 ECS实例选型与创建

ECS实例操作系统推荐选用Ubuntu 22.04或者Ubuntu 24.04,这两个版本对Hermes Agent依赖组件兼容性最好。实例规格最低配置2核4G,若需要长时间运行复杂Agent任务,建议选择4核8G规格;存储盘推荐40G以上云盘,保证系统、容器以及日志文件有充足存储空间。实例网络选择专有网络,安全组需要开放22端口用于SSH远程登录,后续如果需要访问WebUI管理面板,还需要开放对应端口。

零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程

第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png

👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:

  • 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
  • 实例:内存必须2GiB及以上。
  • 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
  • 时长:根据自己的需求及预算选择。

轻量应用服务器OpenClaw镜像.png
bailian1.png
bailian2.png

第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

阿里云百炼密钥管理图.png

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
阿里云百炼密钥管理图2.png

  • 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
  • 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
  • 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
  • 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。

阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:

创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
CodingPlan.png

  • 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。
    image.png
  • 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。
    image.png
  • 在服务器概览页面单击应用详情页签,进入服务器详情页面。
    image.png
  • 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。
    image.png
  • 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。
    image.png
  • 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。
    image.png
    image.png
    实例创建完成之后,获取公网IP地址、登录用户名与密码。推荐使用SSH工具连接服务器,Windows系统可以使用PowerShell或者Xshell,Mac和Linux系统直接使用终端执行ssh命令登录。
    ssh root@你的ECS公网IP
    
    输入服务器登录密码,成功登录之后,就进入服务器终端操作界面。

1.2 获取Token Plan的API Key

登录模型服务控制台,进入API Key管理页面,创建Token Plan对应的API Key。Token Plan分为个人版与团队版,两者在额度、模型池、权限上存在差异,创建密钥之后,务必复制保存API Key,密钥只在创建时完整展示一次,关闭弹窗之后无法再次查看完整密钥。同时做好密钥保管,不要随意公开,一旦密钥泄露,其他人会使用你的Token额度产生消耗。

二、ECS服务器系统环境初始化

刚创建完成的ECS系统,缺少Hermes Agent运行所需要的基础依赖包,第一步先更新系统软件源,安装运行必备组件。执行下面命令更新系统包:

apt update && apt upgrade -y

等待系统软件包更新完成,接着安装基础工具,包含git、curl、wget、python3、pip、nodejs等依赖,Hermes Agent运行需要Python与Node环境支持:

apt install git curl wget python3 python3-pip python3-venv nodejs npm -y

安装完成之后,校验各个组件版本,确认环境安装成功:

python3 --version
node -v
npm -v
git --version

如果都能正常输出版本号,代表基础依赖安装完成。
为了隔离项目依赖,防止和服务器其他程序包冲突,我们创建独立虚拟环境运行Hermes Agent,这是新手避坑的关键操作。

mkdir -p ~/hermes-workspace
cd ~/hermes-workspace
python3 -m venv hermes-env
source hermes-env/bin/activate

执行激活虚拟环境命令之后,终端提示符前面会出现(hermes-env)标识,后续所有Hermes安装配置命令,都必须在这个虚拟环境内执行。退出虚拟环境执行deactivate命令。

升级虚拟环境内pip包管理器,避免安装过程出现网络、版本报错:

pip install --upgrade pip

三、Hermes Agent安装与版本验证

Hermes Agent支持包管理器一键安装,在已经激活的虚拟环境中执行安装命令:

pip install hermes-agent

等待安装包下载、依赖解析完成,安装结束之后,执行版本查看命令,验证是否安装成功:

hermes --version

如果正常输出版本号,说明Hermes Agent安装成功。如果提示command not found,大概率是虚拟环境没有激活,或者pip安装路径没有加入环境变量。

除了pip直接安装,也可以通过源码方式部署,适合想要自定义修改框架源码的开发者:

git clone https://github.com/nousresearch/hermes.git
cd hermes
pip install .

源码安装完成之后,同样执行hermes --version验证。

四、配置Hermes Agent接入Token Plan

这是整个部署流程中最核心的环节,配置模型服务地址、API密钥,让Hermes Agent通过Token Plan调用大模型。Hermes支持直接使用命令行写入配置,也可以手动编辑yaml配置文件。

4.1 命令行快速配置

直接执行下面一组hermes config命令,将配置写入~/.hermes/config.yaml配置文件,把YOUR_API_KEY替换成你复制的Token Plan密钥:

hermes config set model.provider custom
hermes config set model.base_url https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
hermes config set model.api_key YOUR_API_KEY
hermes config set model.default qwen3.8-max

执行完成之后,可以查看配置文件内容,确认参数写入正确:

cat ~/.hermes/config.yaml

配置文件内容示例:

model:
  default: qwen3.8-max
  provider: custom
  base_url: https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
  api_key: YOUR_API_KEY

base_url地址根据Token Plan版本选择,个人版与团队版的接入地址会存在差异,需要核对控制台对应的接入端点。default字段代表Agent默认调用的模型名称,Token Plan套餐支持多款模型,qwen3.8-max、qwen3.8-flash、deepseek-v4.1-flash都可以使用,修改这个字段即可切换默认模型。

4.2 测试对话验证连通性

配置完成,执行对话测试命令,验证Hermes Agent能否正常通过Token Plan调用模型:

hermes chat -q "请简单介绍你自己,说明你可以完成哪些任务"

等待几秒,终端返回Agent的回答,代表接入成功。如果出现报错,优先检查API Key是否复制正确、地域端点是否匹配、Token Plan套餐额度是否充足。

也可以在交互对话模式下,持续和Agent对话,直接输入命令进入交互式会话:

hermes chat

进入交互模式之后,直接输入指令,Hermes Agent会持续响应,支持多轮对话,并且自带记忆能力,记住本次会话上下文。

如果想要临时切换模型,使用-m参数指定模型名称,示例:

hermes chat -m deepseek-v4.1-flash -q "写一段Python代码,读取csv文件并统计数据行数"

五、Hermes Agent后台守护进程部署

当关闭SSH终端窗口,默认运行的Hermes进程会直接终止,想要让Agent持续在后台运行,推荐使用systemd配置守护服务,实现开机自启、进程崩溃自动重启。

创建systemd服务文件:

vim /etc/systemd/system/hermes-agent.service

写入下面服务配置内容,注意替换用户目录为你自己的用户名:

[Unit]
Description=Hermes Agent Service
After=network.target

[Service]
User=root
WorkingDirectory=/root/hermes-workspace
ExecStart=/root/hermes-workspace/hermes-env/bin/hermes chat
Restart=on-failure
RestartSec=10

[Install]
WantedBy=multi-user.target

保存退出,执行命令重载系统服务,启用并启动Hermes服务:

systemctl daemon-reload
systemctl enable hermes-agent
systemctl start hermes-agent

查看服务运行状态,确认服务正常运行:

systemctl status hermes-agent

看到active(running)代表后台服务启动成功。查看运行日志,排查调用报错:

journalctl -u hermes-agent -f

六、WebUI可视化面板部署(可选)

Hermes Agent高版本内置Web可视化面板,通过网页界面管理Agent、查看对话历史、查看任务日志,操作更加直观。启动WebUI命令:

hermes web

默认监听端口,需要在ECS安全组放行对应端口,之后使用浏览器访问http://ECS公网IP:端口,打开Web管理界面。在面板上可以查看Agent版本、配置信息、对话记录,直接发起对话指令,降低命令行操作门槛,适合新手使用。

七、Token Plan计费与额度管理

Token Plan是按量订阅的节省方案,相比普通按量计费,能够实现大幅成本节省,适合长时间运行Hermes Agent这种持续调用大模型的场景。每次Hermes发起思考、工具调用、多轮对话,都会消耗套餐内的Token额度,输入缓存还可以享受额外优惠。

开发者可以通过命令行简单查看调用消耗情况,也可以在模型服务控制台查看调用明细、消耗统计。需要重点注意,Agent类任务会产生大量多轮调用,复杂任务会多次调用模型,Token消耗速度远高于单次问答,建议设置额度告警,避免超额。

八、常见故障排查(新手高频踩坑点)

问题1:hermes命令找不到

绝大多数原因是没有进入Python虚拟环境,每次SSH登录服务器,都需要重新执行source ~/hermes-workspace/hermes-env/bin/activate激活环境。如果激活后依旧找不到,检查pip安装路径,把pip的bin目录添加系统环境变量。

问题2:调用模型返回API鉴权失败

核对API Key是否复制完整,有无多余空格换行;确认base_url地址与Token Plan地域匹配;检查Token Plan套餐状态,套餐是否过期、额度是否耗尽。

问题3:请求超时,连接失败

检查ECS服务器公网出口网络是否正常,测试连通性:

curl https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1

如果curl无法访问,检查服务器网络策略,确认没有出口限制。

问题4:Agent回复卡顿、任务执行缓慢

优先看ECS服务器资源占用,执行命令查看CPU、内存使用率:

top

如果内存占用过高,考虑升级ECS实例规格;也可以更换Flash系列轻量化模型,提升响应速度,降低Token开销。

问题5:后台systemd服务启动失败

执行journalctl -u hermes-agent查看详细报错日志,检查配置文件路径、虚拟环境python解释器路径是否填写正确,配置文件config.yamlyaml格式缩进错误,也会造成Agent启动失败,yaml文件对空格缩进非常敏感,不能使用Tab制表符。

九、Hermes Agent应用场景与生产环境优化建议

部署完成Hermes Agent之后,就可以让智能体执行各类自动化任务,包含代码编写、项目文档整理、批量文件处理、数据解析、自动化运维指令等。Hermes内置工具调用能力,可以读取服务器本地文件、执行shell命令,实现自主完成复杂链式任务。

测试环境和生产环境的部署存在明显区别,本文这套教程适合开发测试场景。如果上线长期业务场景,需要做更多优化:做好服务器防火墙精细化管控,最小化开放端口;配置密钥环境变量,不要明文写在配置文件;增加日志轮转,防止日志文件占满服务器磁盘;增加监控告警,监控Agent进程存活状态与模型调用异常。

新手在使用Hermes的时候,建议循序渐进,先在命令行做简单问答测试,确认Token Plan调用稳定之后,再尝试复杂任务、WebUI面板,最后配置后台守护进程长期运行。不要一次性给Agent分配极高权限,避免Agent执行危险系统命令,建议做好权限隔离,限制Agent能够操作的目录范围。

十、总结

整套流程从ECS实例准备、系统环境初始化、虚拟环境搭建、Hermes Agent安装、Token Plan接入配置、对话测试,再到后台守护进程部署,完整实现了在云服务器上搭建自进化AI智能体。整个流程不需要复杂的硬件设备,依靠ECS算力加上Token Plan订阅方案,就可以快速搭建可用的Agent服务。

Hermes Agent强大的记忆与工具调用能力,给开发者带来了自动化任务的新方式,而Token Plan的订阅模式,有效降低长期运行Agent带来的大模型调用成本。在实际开发过程中,可以不断调整模型参数、切换不同模型,根据业务场景优化Agent的提示词,充分发挥智能体的能力。在遇到报错时,优先查看终端日志、模型调用返回信息,绝大多数新手问题都集中在环境未激活、API密钥配置错误、网络连通性三类问题,按照本文的排错步骤逐一排查,都可以顺利解决。随着对Hermes Agent熟悉之后,还可以扩展消息渠道,对接各类消息平台,实现更多场景下的自动化智能交互。

目录
相关文章
|
7天前
|
人工智能 API 内存技术
刚刚 DeepSeek V4.1 Flash 开启内测,1 分钟教你用上!
刚刚 DeepSeek 内测群发布了 DeepSeek V4.1 Flash 中间版本内测的消息,这次的模型采用了新的结构,原生支持多模态、能力更强、速度更快、且成本更低。
1776 10
|
11天前
|
人工智能 运维 BI
阿里云千问办公QwenWork深度解析:基于Qwen3.8,六大核心能力重构企业全自动化工作流与计费选型指南
传统AI办公工具大多停留在对话问答、文档摘要、简单文案生成层面,只能完成单点碎片化任务,无法自主拆解复杂业务流程,很难串联多工具、多文档、外部业务系统完成端到端完整工作交付。很多企业在落地AI办公的时候,需要组合多款不同工具,来回切换界面,手动复制粘贴中间结果,智能化改造落地门槛居高不下。千问办公QwenWork是整合多款智能体产品能力打造的一体化企业办公智能体平台,底层基座依托Qwen3.8大模型,打通桌面端Agent、云端Agent、企业协同Agent三种运行形态,不再局限简单问答,接收业务目标之后自主拆解任务步骤,调用各类工具,处理文档、表格、浏览器自动化、数据查询,直接输出可交付的办公
1643 3
|
12天前
|
网络协议 Linux iOS开发
【2026实测】Wireshark下载+安装+汉化+使用教程(图文版,巨详细)
Wireshark 是一款免费开源的网络协议分析工具,可实时捕获、解析并可视化数据包,助你诊断网络故障、分析通信协议(如HTTP、DNS、TCP等)。支持Windows/macOS/Linux,含中文界面,新手入门便捷。(239字)
|
8天前
|
SQL 人工智能 前端开发
QoderWake 1.0 正式发布:从桌面里的 Agent,到工作现场的数字员工
QoderWake v1.0正式发布:企业级数字员工团队平台。支持“一句话建岗”,预置10类特训岗位;Waker常驻钉钉/飞书群,@即响应、自动协作、跨任务记忆;具备定时/事件/API多触发方式与统一任务看板;已沉淀27.6万条记忆、12.3万项技能,助力组织实现人机协同增效。
778 2
|
6天前
|
缓存 测试技术 API
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
DeepSeek V4.1 Flash 内测不用申请,base_url 不变、改个模型名就能调,9/10 到期。本文讲清接入、计费限流与多模态注意点。
800 0
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
|
20天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
3963 5
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
11天前
|
人工智能 自然语言处理 安全
阿里云AI数智鉴密:AI 生成内容如何拿到一张"防篡改的身份证"
隐形水印 + C2PA签名:让AI生成内容“持证上岗”。
1155 0
|
13天前
|
缓存 数据可视化 开发工具
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式
DeepSeek Harness 的更新分两层:本体更新(npx 自动最新、npm update -g、源码 git pull)与插件更新(插件市场点更新、命令行覆盖安装)。本文按「准备 → 更新本体 → 更新插件 → 更新后检查」四步走,覆盖新手常见疑问。
1492 1
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式
|
6天前
|
人工智能
千问办公官网入口:阿里AI办公QwenWork产品页和免费网页端链接
千问办公官网含两大入口:一是网页端(qwenwork.cn),即开即用,支持浏览器直接访问;二是阿里云产品页 https://t.aliyun.com/U/JNKJuO 提供免费/付费版详情、功能介绍及使用指南。

热门文章

最新文章