7×24小时运行AI智能体:阿里云 ECS 云服务器搭建Hermes Agent、订阅方案接入与生产避坑完整教程

简介: AI智能体技术快速迭代演进,Hermes Agent作为一款开源执行型智能体框架,擅长复杂任务拆解、工具调用、代码执行、本地文件读写、多步骤自动化工作流。接收自然语言复杂指令之后,能够自主拆分目标,调用各类工具完成程序开发、数据处理、文档分析、信息采集等工作,受到大量开发者与技术爱好者青睐。把Hermes Agent部署在云服务器实例之上,可以实现7×24小时不间断后台运行,不受本地电脑关机、休眠的约束。搭配Token Plan订阅方案,无需在本地下载体积庞大的大模型权重,直接调用平台内部多款高性能推理模型,大幅降低硬件门槛,开箱即可使用大模型推理能力。

AI智能体技术快速迭代演进,Hermes Agent作为一款开源执行型智能体框架,擅长复杂任务拆解、工具调用、代码执行、本地文件读写、多步骤自动化工作流。接收自然语言复杂指令之后,能够自主拆分目标,调用各类工具完成程序开发、数据处理、文档分析、信息采集等工作,受到大量开发者与技术爱好者青睐。把Hermes Agent部署在云服务器实例之上,可以实现7×24小时不间断后台运行,不受本地电脑关机、休眠的约束。搭配Token Plan订阅方案,无需在本地下载体积庞大的大模型权重,直接调用平台内部多款高性能推理模型,大幅降低硬件门槛,开箱即可使用大模型推理能力。

很多新手初次部署Hermes Agent时,常常遇到系统依赖缺失、网关端口无法访问、API鉴权返回401报错、SSH断开进程直接终止、模型调用链路不通、内存OOM崩溃等一系列问题。本文完整覆盖ECS实例前期硬件与网络准备、系统环境初始化、一键脚本部署、Docker容器部署两套实现方案、Token‑Plan凭证接入配置、网关与Web仪表盘验证、后台常驻开机自启配置、高频故障排查全部实操环节,附带大量可以直接复制执行的命令,零基础跟随步骤操作,就能够完成整套云端AI智能体环境落地。
阿里云部署AI Agent:OpenClaw/Hermes Agent全网最简单,只需两步,详情👉访问阿里云OpenClaw/Hermes一键部署专题页面了解。
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png
Token Plan Token 最便宜/支持多模型切换:👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png

一、ECS实例选型、操作系统与安全组前期配置

部署Hermes Agent,首先要完成云服务器实例基础环境准备,硬件规格直接决定智能体运行的稳定性。Hermes Agent程序本体资源占用并不高,但是执行复杂任务、并发调用多工具、批量生成代码时内存消耗会快速上涨。最低测试配置建议2核2GB内存,仅用于简单对话功能验证;日常开发调试场景优先选择2核4GB;如果需要并发执行多项任务、大量文件读写、大规模代码生成,推荐2核8GB配置。操作系统优先选择Ubuntu 22.04 LTS,CentOS Stream 9同样可以完整适配全部部署流程。

实例创建完成,进入控制台编辑安全组规则,Hermes Agent网关默认监听端口8642,Web仪表盘端口9119,需要放行TCP协议8642、9119端口。出于安全防护,个人使用场景源地址填写自己本机公网IP,不要直接配置0.0.0.0/0全网放行,避免网关直接暴露公网,出现密钥泄露、订阅额度被恶意消耗风险。后续如果修改程序监听端口,安全组规则要同步更新。

本地终端连接ECS实例,Windows系统使用PowerShell,MacOS、Linux直接使用系统自带终端,执行SSH连接命令,替换为自己实例公网IP:

ssh root@你的ECS公网IP地址

输入登录密码,登录服务器之后,优先更新系统软件源,升级基础依赖包,规避旧版本软件带来的兼容异常。

# Ubuntu 22.04 LTS系统执行
apt update && apt upgrade -y

# CentOS Stream 9系统执行
dnf update -y

安全重点提醒:Hermes Agent具备服务器文件读写、Shell命令执行能力,服务禁止裸端口直接对公网暴露,必须开启网关鉴权;API‑Key属于高敏感凭证,切勿随意复制分享,一旦密钥泄露,订阅套餐额度会被他人消耗。

二、服务器基础依赖组件安装

Hermes Agent依赖Python3.11运行环境,同时依赖git、curl、wget等基础工具链,系统自带软件版本经常无法满足运行条件,缺少依赖会直接导致安装脚本执行失败。执行命令安装全套基础组件:

# Ubuntu系统
apt install git curl wget python3 python3-pip python3-venv -y

# CentOS Stream9系统
dnf install git curl wget python3 python3-pip -y

安装结束校验Python版本,确认版本符合运行条件:

python3 --version

输出需要为Python3.11.x版本。如果系统自带Python版本不匹配,可以借助pyenv工具管理多Python版本,解决版本过低的问题。

接下来提供两种主流部署方案:方案一官方一键脚本快速安装,上手简单适合调试测试;方案二Docker容器部署,环境隔离,不会污染宿主机,更适合长期稳定的生产业务。

三、方式一:一键脚本安装Hermes Agent

官方提供Linux一键安装脚本,终端直接执行脚本,自动拉取程序、配置运行环境、设置环境变量。

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

脚本执行完毕,重载shell环境变量,系统识别hermes全局命令:

source ~/.bashrc

执行版本查看命令,确认安装成功:

hermes --version

输出版本号,代表程序本体部署完成。此时程序只是安装完毕,还没有配置大模型服务,不能执行对话任务。运行交互式初始化向导:

hermes setup

交互式向导选择参考,这里先跳过模型配置,后续手动接入Token Plan服务:

  1. Choose setup mode:Quick‑start
  2. Model provider:Skip setup for now
  3. Configure gateway service later:Yes
  4. Configure chat channels:No
  5. Finish and exit wizard

Hermes Agent全部配置文件默认存放于~/.hermes/目录,核心配置文件为~/.hermes/config.yaml,后续模型、鉴权参数全部写入这份配置文件。

四、获取Token‑Plan凭证,完成Hermes Agent模型接入配置

登录百炼平台控制台,确认Token Plan订阅套餐已经完成开通,进入密钥管理页面,创建API‑Key,复制sk开头密钥字符串。密钥只展示一次,丢失只能重新生成,妥善保存密钥。Token‑Plan提供两套兼容接口,Anthropic兼容接口地址:https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic,OpenAI兼容接口地址:https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1

Hermes Agent支持命令行快速写入配置,也可以直接编辑yaml配置文件。下面使用命令行写入配置,把YOUR_API_KEY替换成自己复制得到的密钥:

hermes config set model.provider custom
hermes config set model.base_url https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic
hermes config set model.api_mode anthropic_messages
hermes config set model.api_key YOUR_API_KEY
hermes config set model.default qwen3.8-max

参数写入完成,可以手动打开配置文件核对参数:

nano ~/.hermes/config.yaml

model节点完整配置模板参考:

model:
  default: qwen3.8-max
  provider: custom
  base_url: https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic
  api_mode: anthropic_messages
  api_key: "YOUR_API_KEY"

nano编辑器操作:Ctrl+O回车保存,Ctrl+X退出编辑器。

配置修改完成,运行健康检测命令,校验配置文件格式合法性:

hermes doctor

全部检测项显示正常,说明配置格式无误。启动Hermes Agent网关服务:

hermes gateway run

新开一个SSH终端窗口,执行命令行对话测试,验证Token‑Plan模型调用链路是否正常:

hermes chat

输入测试问题,例如:简述Hermes Agent可以完成哪些自动化任务。大模型正常输出回答,说明鉴权、接口调用全部配置成功。

五、方式二:Docker容器部署Hermes Agent(推荐生产环境)

如果希望环境隔离,规避宿主机软件版本冲突,优先选择Docker容器部署。首先在ECS服务器安装Docker运行环境:

# Ubuntu系统
apt install docker.io -y
systemctl start docker
systemctl enable docker

# CentOS Stream9系统
dnf install docker -y
systemctl start docker
systemctl enable docker

拉取官方Hermes Agent镜像,执行docker run启动容器,挂载配置目录持久化配置,映射网关、仪表盘端口:

docker run -d \
--name hermes-agent \
--restart unless‑stopped \
-p 8642:8642 \
-p 9119:9119 \
-v ~/.hermes:/opt/data \
-e HERMES_DASHBOARD=1 \
--memory=3g \
nousresearch/hermes-agent:latest gateway run

参数说明:‑d后台守护进程运行,‑p端口映射,‑v挂载配置目录;--restart unless‑stopped实现服务器重启自动拉起容器。

容器启动之后,修改宿主机~/.hermes/config.yaml填入Token‑Plan相关配置,修改完成重启容器加载新配置:

docker restart hermes-agent

查看容器运行日志,排查启动报错信息:

docker logs hermes-agent --tail 120

日志无报错,代表网关服务启动成功。

六、Web仪表盘访问验证与网关鉴权配置

网关正常运行后,浏览器访问http://ECS公网IP:9119,打开Hermes Agent Web仪表盘。公网部署必须开启网关鉴权,禁止无鉴权裸跑。执行命令生成网关访问令牌:

hermes gateway token generate

复制生成鉴权令牌,访问Web界面时携带令牌参数,没有令牌会拒绝访问网关接口。Web页面新建对话会话,发送测试指令,验证模型调用、工具调用功能。

使用curl命令做网关连通测试,替换YOUR_GATEWAY_TOKEN为生成的网关令牌:

curl http://127.0.0.1:8642/v1/chat/completions \
-H "Authorization: Bearer YOUR_GATEWAY_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"messages":[{"role":"user","content":"简单介绍Hermes Agent"}],
"max_tokens":512
}'

接口返回模型输出,整套服务链路完全通。

七、配置网关后台常驻与开机自启

很多新手直接执行hermes gateway run,关闭SSH终端服务就停止,因为进程依附SSH会话窗口。脚本安装模式执行内置systemd服务安装命令,配置用户级守护进程:

hermes gateway install

执行完成,启用并且启动systemd用户服务:

systemctl --user enable --now hermes-gateway
systemctl --user status hermes-gateway

输出active(running),常驻服务部署完成。服务器重启服务自动启动,断开SSH连接程序持续后台运行。

Docker部署模式,容器参数已经配置--restart unless‑stopped,无需额外配置systemd守护服务。

查看网关实时运行日志,用于排查后续运行异常:

journalctl --user -u hermes-gateway -f

八、高频报错排查与避坑指南

部署调试遇到异常,优先运行官方诊断工具,自动扫描配置、环境、网络问题:

hermes doctor --fix

问题1:浏览器访问8642、9119打不开页面

排查步骤:

  1. 确认ECS安全组放行TCP协议8642、9119端口;
  2. 服务器本机防火墙放行端口;
    Ubuntu执行:
    ufw allow 8642/tcp
    ufw allow 9119/tcp
    ufw reload
    
    CentOS执行:
    firewall‑cmd --add‑port=8642/tcp --permanent
    firewall‑cmd --add‑port=9119/tcp --permanent
    firewall‑cmd --reload
    
  3. 确认网关监听地址为0.0.0.0,而不是仅本地回环127.0.0.1,仅回环监听公网无法访问Web界面。

问题2:接口返回401 Unauthorized鉴权报错

代表Token‑Plan的API‑Key错误、密钥复制携带多余空格换行、密钥已经过期失效。重新复制平台完整密钥写入配置,清除多余空白字符,修改配置之后重启网关服务。同时检查订阅套餐,确认套餐额度没有耗尽。

问题3:网关启动成功,模型接口连接失败

核对base_url接口地址完整无误,区分Anthropic协议、OpenAI协议,api_mode参数必须和接口地址匹配;确认ECS服务器出站网络可以访问外部API;修改配置文件之后必须重启网关,新配置才会加载生效。

问题4:程序运行OOM内存崩溃

并发执行任务内存占用飙升,进程被系统OOM杀死。可以创建swap交换分区缓解内存压力:

fallocate -l 2G /swapfile
chmod 600 /swapfile
mkswap /swapfile
swapon /swapfile

问题5:hermes命令找不到

安装脚本结束没有执行source ~/.bashrc重载环境变量;或者脚本执行失败,需要重新运行一键安装脚本。

问题6:交互式对话可以聊天,但是工具调用失败

部分模型对工具调用格式适配存在差异;优先保证基础对话正常返回,再测试文件读写、命令执行等高级工具能力,可以更换默认模型版本测试。

九、后续扩展与生产环境优化建议

Hermes Agent部署完成之后,可以加载各类MCP工具插件,拓展文件解析、数据库查询、网页检索等能力。用量统计前往百炼控制台查看Token消耗报表。

公网长期生产使用,建议搭配域名部署Nginx反向代理,启用HTTPS加密访问,不要直接对外暴露原始端口,进一步提升服务安全等级。密钥配置文件设置文件权限保护,禁止普通用户读取密钥:

chmod 600 ~/.hermes/.env

定期执行hermes update更新程序版本,获取功能更新与安全补丁;定期查看~/.hermes/logs/运行日志,及时发现异常行为。

Hermes Agent搭配Token‑Plan订阅方案部署在ECS云服务器,不需要本地高性能算力硬件,就可以搭建7×24小时不间断运行的云端执行AI智能体。整套部署关键点在于服务器依赖版本匹配、安全组端口管控、API密钥正确配置、网关鉴权开启、后台常驻服务配置。遇到故障优先使用hermes doctor诊断命令,绝大多数部署问题可以快速定位。

本文完整覆盖ECS前期准备、脚本一键部署、Docker容器部署两套方案、Token‑Plan接入配置、Web仪表盘验证、systemd开机常驻、大量常见故障处理,新手按照完整步骤操作,即可搭建属于自己的云端AI执行智能体服务。

目录
相关文章
|
4天前
|
人工智能 API 内存技术
刚刚 DeepSeek V4.1 Flash 开启内测,1 分钟教你用上!
刚刚 DeepSeek 内测群发布了 DeepSeek V4.1 Flash 中间版本内测的消息,这次的模型采用了新的结构,原生支持多模态、能力更强、速度更快、且成本更低。
1681 6
|
9天前
|
人工智能 运维 BI
阿里云千问办公QwenWork深度解析:基于Qwen3.8,六大核心能力重构企业全自动化工作流与计费选型指南
传统AI办公工具大多停留在对话问答、文档摘要、简单文案生成层面,只能完成单点碎片化任务,无法自主拆解复杂业务流程,很难串联多工具、多文档、外部业务系统完成端到端完整工作交付。很多企业在落地AI办公的时候,需要组合多款不同工具,来回切换界面,手动复制粘贴中间结果,智能化改造落地门槛居高不下。千问办公QwenWork是整合多款智能体产品能力打造的一体化企业办公智能体平台,底层基座依托Qwen3.8大模型,打通桌面端Agent、云端Agent、企业协同Agent三种运行形态,不再局限简单问答,接收业务目标之后自主拆解任务步骤,调用各类工具,处理文档、表格、浏览器自动化、数据查询,直接输出可交付的办公
1622 1
|
6天前
|
SQL 人工智能 前端开发
QoderWake 1.0 正式发布:从桌面里的 Agent,到工作现场的数字员工
QoderWake v1.0正式发布:企业级数字员工团队平台。支持“一句话建岗”,预置10类特训岗位;Waker常驻钉钉/飞书群,@即响应、自动协作、跨任务记忆;具备定时/事件/API多触发方式与统一任务看板;已沉淀27.6万条记忆、12.3万项技能,助力组织实现人机协同增效。
724 1
|
10天前
|
网络协议 Linux iOS开发
【2026实测】Wireshark下载+安装+汉化+使用教程(图文版,巨详细)
Wireshark 是一款免费开源的网络协议分析工具,可实时捕获、解析并可视化数据包,助你诊断网络故障、分析通信协议(如HTTP、DNS、TCP等)。支持Windows/macOS/Linux,含中文界面,新手入门便捷。(239字)
|
17天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
3885 5
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
3天前
|
缓存 测试技术 API
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
DeepSeek V4.1 Flash 内测不用申请,base_url 不变、改个模型名就能调,9/10 到期。本文讲清接入、计费限流与多模态注意点。
702 0
DeepSeek V4.1 Flash 内测接入:改个模型名即可调用(附代码)
|
9天前
|
人工智能 自然语言处理 安全
阿里云AI数智鉴密:AI 生成内容如何拿到一张"防篡改的身份证"
隐形水印 + C2PA签名:让AI生成内容“持证上岗”。
1146 0
|
10天前
|
缓存 数据可视化 开发工具
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式
DeepSeek Harness 的更新分两层:本体更新(npx 自动最新、npm update -g、源码 git pull)与插件更新(插件市场点更新、命令行覆盖安装)。本文按「准备 → 更新本体 → 更新插件 → 更新后检查」四步走,覆盖新手常见疑问。
1292 1
DeepSeek Harness 怎么更新?dsh 更新完整指南:更新本体(npx、npm、源码)与更新插件两种方式

热门文章

最新文章