保姆级教程:阿里云ECS一键部署Hermes Agent,完整配置百炼Coding/Token Plan指南

简介: 随着自主AI智能体技术不断迭代,Hermes Agent凭借记忆持久化、自主技能生成、沙盒命令执行、浏览器自动化、多模型兼容能力,成为开发者搭建本地与云端智能体的主流开源项目。很多开发者本地调试完成之后,希望把Hermes Agent部署至云端服务器,实现7×24小时不间断运行,脱离本地电脑限制。阿里云ECS作为弹性云算力实例,可以提供稳定的云端运行环境,搭配百炼平台Coding Plan、Token Plan两套订阅服务,能够为Hermes Agent提供强大的大模型推理底座,无需反复管理多个模型服务商密钥,统一使用订阅套餐额度完成智能体全部任务调用。

随着自主AI智能体技术不断迭代,Hermes Agent凭借记忆持久化、自主技能生成、沙盒命令执行、浏览器自动化、多模型兼容能力,成为开发者搭建本地与云端智能体的主流开源项目。很多开发者本地调试完成之后,希望把Hermes Agent部署至云端服务器,实现7×24小时不间断运行,脱离本地电脑限制。阿里云ECS作为弹性云算力实例,可以提供稳定的云端运行环境,搭配百炼平台Coding Plan、Token Plan两套订阅服务,能够为Hermes Agent提供强大的大模型推理底座,无需反复管理多个模型服务商密钥,统一使用订阅套餐额度完成智能体全部任务调用。

很多新手在部署过程中会遇到各类问题:服务器环境依赖缺失、安全组端口没有放行、两套订阅计划接口地址混淆、密钥类型混用、配置参数填写错误导致调用报错、WebUI无法公网访问、服务无法开机自启等。本文作为保姆级实操教程,完整覆盖ECS实例准备、一键脚本部署、Docker容器部署两种部署方式,分别讲解Coding Plan、Token Plan两套订阅方案的完整配置命令,包含配置文件示例、服务启停、访问验证、开机自启、故障排查,帮助零基础开发者完成整套云端Hermes Agent环境搭建。阿里云部署AI Agent:OpenClaw/Hermes Agent全网最简单,只需两步,详情👉访问阿里云OpenClaw/Hermes一键部署专题页面了解。
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png
Token Plan Token 最便宜/支持多模型切换:👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

前期准备工作

首先完成ECS服务器实例选型与初始化。Hermes Agent资源消耗和开启的工具能力强相关,如果开启浏览器自动化、网页抓取工具,内存占用会明显提升。最低配置建议2核2G,仅做简单对话任务可以勉强运行;生产环境推荐选择2核4G及以上实例,操作系统选用主流CentOS Stream或者Ubuntu LTS版本。如果内存低于2G,运行浏览器工具时极易出现OOM内存溢出,进程直接崩溃退出。

实例创建完成之后,进入安全组配置页面,必须放行端口18789,该端口为Hermes Agent WebUI默认访问端口;同时开放22端口用于SSH远程连接。不要直接放行全部端口,仅开放业务必要端口,保障服务器安全。

本地终端使用ssh工具连接ECS服务器:

ssh root@你的ECS公网IP地址

输入服务器登录密码,成功登录服务器终端。

订阅层面,需要提前在百炼控制台完成对应订阅。Coding Plan面向编程场景,按照请求次数扣费,适合高频短会话代码任务;Token Plan按照Token折算Credits扣费,适合长文档解析、多模态、复杂Agent任务。两套订阅拥有各自独立专属API Key,不能使用普通按量计费的DashScope密钥代替,密钥页面只会在生成的时候完整展示,务必复制保存,关闭页面之后无法再次查看完整密钥内容。

重要区分:Coding Plan密钥、Token Plan密钥、普通按量API Key三者体系互相独立,混用会直接鉴权失败。

方式一:一键脚本部署Hermes Agent(新手首选)

官方提供一键安装脚本,自动处理系统依赖、二进制下载、环境变量初始化,不需要手动处理复杂编译,适合绝大多数用户。登录ECS服务器终端,直接执行安装脚本:

curl -fsSL https://hermes.aliyun.com/install.sh | bash

脚本执行完成,验证安装结果:

hermes --version

输出版本号即代表安装成功。如果提示command not found,执行source刷新环境变量:

source /root/.bashrc

执行完成之后,Hermes的配置目录位于~/.hermes/,核心配置文件config.yaml所有模型、密钥、运行参数全部保存在该目录,后续升级安装不会覆盖该目录数据,会话记忆、自定义技能都会持久化保存。

接下来启动后台服务,同时开启WebUI面板:

hermes start

查看运行状态确认服务正常:

hermes status

输出running代表服务正常运行。此时浏览器访问http://ECS公网IP:18789,即可打开Hermes Agent网页操作界面。如果打不开页面,优先回到安全组确认18789端口已经放行,同时检查服务器内部防火墙iptables、firewalld是否拦截端口。

设置开机自启,服务器重启之后自动拉起Hermes Agent服务,避免服务器重启后服务中断:

hermes service install

执行完成之后,系统会注册systemd服务,服务器开机自动运行Agent。查看systemd服务日志排查运行异常:

journalctl -u hermes -f

方式二:Docker容器化部署(进阶,环境隔离)

对于追求环境隔离,避免系统包冲突的开发者,推荐使用Docker容器部署Hermes Agent。先在ECS服务器安装Docker运行环境:

# Ubuntu系统
apt update && apt install docker.io docker-compose -y
systemctl enable docker && systemctl start docker

拉取官方稳定镜像:

docker pull hermes-agent/stable:latest

运行容器,做目录挂载持久化配置数据,映射WebUI访问端口,设置上海时区:

docker run -d \
--name hermes-agent \
--restart unless-stopped \
-p 18789:18789 \
-v ~/.hermes:/root/.hermes \
-e TZ=Asia/Shanghai \
hermes-agent/stable:latest

查看容器运行日志,确认启动无报错:

docker logs hermes-agent

进入容器内部执行hermes相关配置命令:

docker exec -it hermes-agent bash

容器部署模式下,所有配置命令和裸机脚本部署完全一致,配置同样保存至挂载目录~/.hermes,删除容器不会丢失会话与技能数据。

配置百炼Coding Plan订阅接入Hermes Agent

Coding Plan专门面向AI编程场景,按照请求次数进行计费,适合大量代码生成、调试、脚本编写的Agent任务,拥有专属Anthropic兼容接口地址。在服务器终端直接使用hermes config系列命令一键写入全部配置,替换下面命令中YOUR_CODING_PLAN_API_KEY为你自己的Coding Plan专属密钥。

# 设置模型提供商类型为custom自定义
hermes config set model.provider custom
# Coding Plan专属接口地址
hermes config set model.base_url https://coding.dashscope.aliyuncs.com/apps/anthropic
# 指定接口兼容模式
hermes config set model.api_mode anthropic_messages
# 填入Coding Plan专属API Key
hermes config set model.api_key "YOUR_CODING_PLAN_API_KEY"
# 设置默认运行模型
hermes config set model.default qwen3.7‑plus

命令执行完成,配置自动写入~/.hermes/config.yaml配置文件。也可以手动编辑配置文件,vi打开文件:

vi ~/.hermes/config.yaml

写入完整配置片段:

model:
  default: qwen3.7‑plus
  provider: custom
  base_url: https://coding.dashscope.aliyuncs.com/apps/anthropic
  api_mode: anthropic_messages
  api_key: "YOUR_CODING_PLAN_API_KEY"

保存退出配置文件,重启Hermes Agent服务让配置生效:

hermes restart

执行测试命令验证链路是否正常连通:

hermes chat -q "写一个shell脚本,遍历目录统计每个文件行数"

如果Agent正常输出脚本代码,说明Coding Plan接入完成,后续所有Agent推理请求都会消耗Coding Plan订阅额度。

配置百炼Token Plan订阅接入Hermes Agent

Token Plan采用Credits统一抵扣机制,支持多模型、多模态调用,适合长文本处理、图像理解、复杂多步骤Agent任务,提供OpenAI兼容接口地址。同样使用hermes config命令快速配置,替换YOUR_TOKEN_PLAN_API_KEY为Token Plan生成的sk‑sp开头专属密钥。

hermes config set model.provider custom
hermes config set model.base_url https://token‑plan.cn‑beijing.maas.aliyuncs.com/compatible‑mode/v1
hermes config set model.api_key "YOUR_TOKEN_PLAN_API_KEY"
hermes config set model.default qwen3.7‑max

手动修改config.yaml完整内容参考:

model:
  default: qwen3.7‑max
  provider: custom
  base_url: https://token‑plan.cn‑beijing.maas.aliyuncs.com/compatible‑mode/v1
  api_key: "YOUR_TOKEN_PLAN_API_KEY"

配置修改完毕重启服务:

hermes restart

执行连通性测试:

hermes chat -q "简单介绍Hermes Agent具备哪些核心能力"

能够正常返回回答,则Token Plan配置生效。

重要提示:Token Plan接口地址和Coding Plan接口地址完全不一样,不要互相复制混用,否则直接鉴权报错。订阅地域必须和接口地址地域保持一致,否则额度无法抵扣调用失败。

WebUI面板使用与功能验证

浏览器访问http://ECS公网IP:18789进入Hermes Agent网页界面。可以在WebUI内切换模型、开启浏览器工具、启用沙盒终端执行代码、创建自定义技能。

执行完整Agent能力测试,发送指令:

请你读取服务器当前目录,列出文件,然后写一段python脚本读取系统内存占用,输出格式化结果。

正常情况下Agent会自主调用终端工具执行命令,编写脚本运行,返回结果,代表云端整套环境完整可用。

查看Hermes Agent运行日志,排查调用报错,查看API请求返回详情:

hermes logs

Coding Plan与Token Plan如何选型

很多开发者会纠结两套订阅计划该如何选择。Coding Plan以请求次数计费,无论输入输出Token长短,一次请求消耗一次额度,适合短会话、高频代码编写调试场景,性价比高;Token Plan按照实际Token折算Credits扣费,适合百万级长上下文文档读取、图片多模态解析、复杂多步骤长链路Agent任务。如果平时以写代码为主优先Coding Plan;经常处理长文档、截图解析、多模型切换调试,优先选择Token Plan。两套订阅可以随时修改config配置快速切换,不需要重新部署Hermes Agent。

高频踩坑避坑指南

  1. 密钥混用问题:Coding Plan、Token Plan、普通按量计费API Key不能互相替换,接口地址与密钥必须一一对应,拿到密钥先确认是哪一套订阅生成。
  2. WebUI打不开:优先检查ECS安全组放行18789端口,服务器本地防火墙是否拦截,确认hermes status状态为running。
  3. 调用返回鉴权失败:核对base_url地址是否复制完整,检查订阅所在地域,确认订阅状态没有过期,密钥复制不要带入多余空格换行符。
  4. 进程崩溃OOM:内存不足,关闭浏览器自动化工具,或者升级ECS实例内存规格,浏览器工具会消耗大量内存资源。
  5. 修改配置之后不生效:修改config.yaml配置文件之后,必须执行hermes restart重启服务,新配置才会加载。
  6. 服务器重启服务停止:务必执行hermes service install注册systemd开机自启服务,否则服务器重启后Agent不会自动运行。
  7. 容器部署修改配置:容器模式下修改配置,修改宿主机~/.hermes/config.yaml,重启容器即可生效,不要进入容器内部修改配置文件,挂载目录会覆盖内部修改。
  8. 公网安全风险:直接暴露WebUI到公网存在安全风险,生产环境建议增加密码访问鉴权,或者配置反向代理增加身份校验,避免被外部恶意访问。

零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程

第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png

👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:

  • 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
  • 实例:内存必须2GiB及以上。
  • 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
  • 时长:根据自己的需求及预算选择。

轻量应用服务器OpenClaw镜像.png
bailian1.png
bailian2.png

第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

阿里云百炼密钥管理图.png

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
阿里云百炼密钥管理图2.png

  • 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
  • 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
  • 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
  • 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。

阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:

创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
CodingPlan.png

  • 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。
    image.png
  • 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。
    image.png
  • 在服务器概览页面单击应用详情页签,进入服务器详情页面。
    image.png
  • 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。
    image.png
  • 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。
    image.png
  • 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。
    image.png
    image.png

生产环境优化建议

云端长期运行Hermes Agent,建议做几项优化。第一,定期查看日志,监控API调用消耗,及时查看百炼控制台订阅用量,避免额度耗尽任务中断。第二,不要直接裸暴露WebUI公网,增加身份验证机制。第三,开启日志轮转,防止日志文件持续膨胀占用磁盘。第四,定期备份~/.hermes整个目录,保存会话记忆和自定义技能,故障可以快速恢复。第五,不需要使用浏览器工具的时候,在配置内关闭浏览器组件,降低内存消耗。

Hermes Agent部署在ECS云服务器之后,摆脱本地电脑限制,可以全天候运行智能体任务,搭配百炼两套订阅方案,灵活适配代码开发、文档处理、多模态解析等不同业务场景。整套部署流程分为服务器准备、安装Agent、配置订阅密钥、验证连通性、安全加固几个步骤,新手优先使用一键脚本部署,快速跑通业务;有环境隔离需求的开发者使用Docker容器部署。遇到报错优先查看hermes logs日志,区分是服务器网络问题、配置参数错误,还是订阅密钥鉴权问题,分层定位问题,就可以稳定运行云端自主AI智能体。

目录
相关文章
|
24天前
|
人工智能 测试技术 开发工具
新版Qoder CN AI编程智能体详解:RepoWiki、Quest2.0与专家团实战教程
在AI辅助开发持续迭代的当下,AI编程工具已经跳出简单代码片段生成的范畴,逐步进化为具备任务规划、多文件修改、自测修复、知识沉淀的编程智能体体系。新版Qoder CN作为面向完整软件研发链路的AI编程智能体平台,完成底层架构与核心能力的大规模升级,不再局限单文件代码补全,面向真实工程级项目打造完整Agent工作流,覆盖需求梳理、方案设计、编码实现、单元测试、缺陷修复、项目文档沉淀全流程。产品形态十分丰富,包含独立Qoder CN IDE、JetBrains系列插件、VSCode扩展组件、Qoder‑CLI命令行工具,同时兼容对接百炼平台Coding Plan、Token Plan订阅计费方案,
729 1
|
10天前
|
存储 运维 监控
阿里云香港轻量应用服务器最新配置价格及实测测评,建站选购避坑完整指南
对于想要搭建面向海外访问站点、开发测试项目,不想做备案流程的开发者、个人站长以及小微企业来说,香港地域的云主机是十分热门的选择。阿里云香港轻量应用服务器作为主打开箱即用的跨境计算产品,凭借套餐打包模式、简单的运维操作、独立公网IP,成为很多跨境项目的首选。但跨境服务器和内地节点产品存在大量差异化规则,网络线路、流量计费、性能上限、产品限制都和内地轻量实例不一样,如果只看低廉的售价盲目下单,后续很容易遇到网络波动、账单异常、业务无法扩容等各类问题。本文结合最新在售套餐配置、实际性能测评数据,搭配实操命令,完整拆解这款产品的价格体系、硬件性能、网络表现、适用边界以及大量实战踩坑点,帮助大家判断自己
195 2
|
24天前
|
弹性计算 人工智能 安全
OpenClaw云端部署实操:阿里云ECS云服务器环境初始化,百炼Coding Plan与Token Plan接入全流程
随着AI智能体自动化能力持续迭代,OpenClaw作为开源AI智能体运行平台,凭借网关消息路由、多工具调用、浏览器自动化、持久化记忆、多消息渠道接入能力,受到大量开发者青睐。它可以自主完成代码编写、文件读写、网页抓取、脚本执行、多步骤复杂任务编排,既可以本地调试运行,也可以部署在云服务器实现7×24小时不间断工作。将OpenClaw部署在ECS实例之上,能够脱离本地电脑限制,提供稳定算力环境,搭配百炼平台Coding Plan、Token Plan两套订阅服务,可以直接使用订阅额度完成智能体全部大模型推理调用,不用维护多服务商密钥,大幅简化开发运维成本。
96 1
|
24天前
|
人工智能 JavaScript API
阿里云百炼CLI全解:命令行工具接入AI Agent实操与完整能力指南
在AI Agent快速迭代的开发环境中,开发者经常会遇到一个现实难题:不同AI智能体框架对接云端大模型、知识库、多模态生成工具时,需要反复编写接口代码,处理鉴权、请求封装、返回解析、异常重试等大量重复逻辑。每切换一套Agent框架,就要重新适配一整套API调用逻辑,不仅消耗大量开发时间,还容易出现鉴权不一致、参数不兼容、多工具能力无法复用等问题。百炼CLI作为官方开源的命令行工具,把平台上百款大模型、知识库检索、联网搜索、图像视频生成、语音处理等能力全部封装为终端可直接调用的指令,原生面向各类AI Agent做适配,支持脚本调用、CI流水线集成、本地Agent框架插件接入,大幅降低AI智能体的
128 1
|
26天前
|
人工智能 测试技术 Shell
Opencode最被低估的6个测试指令:每天帮你省下3小时重复劳动
本文详解Opencode六大自定义指令(如/test、/coverage),助测试工程师30分钟配置、每日省3小时,告别重复Prompt输入,实现测试流程自动化提效。
|
3天前
|
人工智能 运维 BI
阿里云千问办公QwenWork完整实操指南:Qwen3.8基座六大能力、API调用与企业计费选型全解
大模型赋能办公已经进入全新阶段,传统AI工具大多局限于问答对话、文档摘要、简单文案改写,只能完成碎片化单点任务。处理复杂业务的时候,使用者需要在多款软件之间来回切换,手动复制粘贴中间结果,很难实现端到端业务闭环。很多企业想要落地AI办公自动化,却要投入大量时间做工具整合,开发成本高,普通业务人员难以上手。
186 0
|
3天前
|
IDE 安全 测试技术
Agent式编程新工具Qoder CN全解:Quest2.0、专家团、沙箱、Hook与CLI全链路实操教程
Qoder CN依托Quest2.0任务引擎、专家团多智能体协同、Repowiki工程知识库、终端沙箱安全隔离、Hook扩展机制,完成从简单代码补全向工程级自主开发工作台的跨越。提供原生IDE、主流IDE插件、CLI命令行多形态接入,兼容多款主流大模型,兼顾个人开发者与企业团队的研发场景。
100 0
|
26天前
|
人工智能 JavaScript API
#Codex接入DeepSeek-V4-Flash完整实操指南:搭配qwen3-vl-flash补齐图像识别两套落地方案
在AI编程工具快速普及的当下,Codex作为终端与桌面端一体化代码智能体,凭借读写本地文件、执行终端命令、多步骤代码重构、工具调用等能力,成为大量开发者日常开发的核心辅助工具。但原生Codex依赖官方模型订阅,长期使用成本较高,不少开发者开始寻找性价比更高的第三方推理基座,DeepSeek-V4-Flash凭借原生适配Codex所需的Responses API、百万级上下文窗口、低廉的Token计费标准、完善的Agent工具调用能力,成为替换原生模型的最优选择之一。
245 2
|
26天前
|
数据采集 人工智能 算法
45条AI引用源实测:内容平台权重分布与信息块拆解
本文拆解豆包AI的45条引用源,揭示CSDN、头条、搜狐占国内引用近半;剖析被高频引用的CSDN文章结构参数(如数字密度、列表数、H2标题),提出“平台推荐→AI抓取→被引用”链路及可复现的监测方法。
169 1
|
28天前
|
机器学习/深度学习 人工智能 自然语言处理
大语言模型技术深度解析:从海外大模型到千问,LLM原理与应用全解
大语言模型(LLM)是什么?本文从Transformer架构、预训练原理到千问大模型等实际应用,深度解析大语言模型技术全貌,助你快速入门。
159 1