阿里云ECS部署Hermes Agent完整实操:对接百炼Coding Plan与Token Plan配置全流程

简介: 在云原生技术与AI开发深度融合的背景下,把具备自主进化能力的开源AI智能体部署在弹性云服务器,搭配商业化大模型订阅服务,已经成为开发者构建本地专属AI开发工作台的主流路径。Hermes Agent作为一款主打任务复盘、经验沉淀、自我迭代的开源智能体,可以独立完成信息检索、资料整理、代码编写、多步骤复杂任务执行,把它部署在ECS实例中可以实现7×24小时常驻运行,不受本地电脑开关机限制。百炼平台推出的Coding Plan与Token Plan两套订阅服务,可以提供高可用、成本可控的大模型调用能力,适配代码开发、通用任务处理等不同场景。本文完整覆盖服务器选型、环境初始化、Hermes Agent

在云原生技术与AI开发深度融合的背景下,把具备自主进化能力的开源AI智能体部署在弹性云服务器,搭配商业化大模型订阅服务,已经成为开发者构建本地专属AI开发工作台的主流路径。Hermes Agent作为一款主打任务复盘、经验沉淀、自我迭代的开源智能体,可以独立完成信息检索、资料整理、代码编写、多步骤复杂任务执行,把它部署在ECS实例中可以实现7×24小时常驻运行,不受本地电脑开关机限制。百炼平台推出的Coding Plan与Token Plan两套订阅服务,可以提供高可用、成本可控的大模型调用能力,适配代码开发、通用任务处理等不同场景。本文完整覆盖服务器选型、环境初始化、Hermes Agent两种部署方案、百炼订阅开通、API凭证配置、WebUI使用、参数调优以及常见故障排查,帮助开发者完成整套环境落地。

一、前期准备:ECS实例选型与基础环境初始化

1.1 ECS实例规格与参数选择

Hermes Agent会在本地维护任务记忆库、执行工具调用,同时持续和大模型API进行网络交互,对服务器内存有硬性要求,最低配置建议选择2核4G实例,若需要同时运行多子Agent、高频网页抓取,建议升级4核8G规格,避免内存溢出导致服务中断。
阿里云部署AI Agent:OpenClaw/Hermes Agent全网最简单,只需两步,详情👉访问阿里云OpenClaw/Hermes一键部署专题页面了解。
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png
Token Plan Token 最便宜/支持多模型切换:👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png
操作系统优先选用Alibaba Cloud Linux 3,其次兼容CentOS7、CentOS8、Ubuntu20.04及以上版本,这类系统对Docker容器组件、云助手工具兼容性更好。地域优先选择华北2(北京),百炼平台服务部署在此地域,能够降低API调用网络延迟,减少超时报错。

实例创建关键配置项:

  1. 付费模式优先选择按量付费,适合测试环境,正式长期使用可以选择包年包月;
  2. 网络选用专有网络VPC,安全组必须放行22端口用于SSH远程登录,同时开放8080端口,该端口为Hermes Agent WebUI默认访问端口;
  3. 登录凭证推荐使用SSH密钥对,相比密码登录安全性更高;
  4. 创建实例等待1‑3分钟,等待实例状态变更为运行中。

补充选型提示:如果不想手动维护操作系统与Docker环境,也可以选择轻量应用服务器,直接选用预装Hermes Agent或者OpenClaw的应用镜像完成快速部署;轻量实例内存不能低于2G,若需要完整互联网搜索能力,需要关注实例地域,部分国内地域会存在网络访问限制。OpenClaw更适合日常消息应答、IM工具对接,Hermes Agent优势在于复杂多步骤任务、任务经验自动沉淀、自主进化,可根据业务场景选择对应智能体。

1.2 服务器系统环境初始化

实例创建完成,使用Workbench网页终端或者Xshell、FinalShell等SSH工具登录服务器,执行系统更新、依赖工具安装、Docker环境部署。Hermes Agent官方推荐容器化运行,Docker可以隔离运行环境,规避系统依赖冲突问题。

Alibaba Cloud Linux / CentOS系列完整执行脚本:

# 更新系统软件包
sudo yum update -y

# 安装基础工具集
sudo yum install -y wget curl git vim unzip net-tools

# 卸载系统中旧版本Docker组件
sudo yum remove docker docker-client docker-client-latest docker-common docker-latest docker-latest-logrotate docker-logrotate docker-engine -y

# 安装Docker依赖组件
sudo yum install -y dnf-plugins-core

# 添加Docker官方软件仓库
sudo dnf config-manager --add-repo https://download.docker.com/linux/centos/docker-ce.repo

# 安装Docker社区版与配套组件
sudo yum install -y docker-ce docker-ce-cli containerd.io docker-buildx-plugin docker-compose-plugin

# 启动Docker服务,设置开机自动启动
sudo systemctl start docker
sudo systemctl enable docker

# 验证Docker安装,正常会输出Hello from Docker!
sudo docker run hello-world

如果使用Ubuntu操作系统,执行下面命令完成环境准备:

sudo apt update && sudo apt upgrade -y
sudo apt install -y wget curl git vim unzip net-tools

执行完验证命令后输出欢迎语句,代表Docker环境部署完成,可以进入Hermes Agent部署环节。

二、Hermes Agent两种部署方案:一键扩展部署与手动容器部署

Hermes Agent提供两套落地路径,OOS扩展程序一键部署上手速度快,几乎不用手动敲复杂配置;Docker Compose手动部署适合深度自定义,修改挂载目录、环境变量、日志参数,适合需要二次调优的开发者。两套方案二选一即可。

方案一:OOS扩展程序一键部署(新手优先推荐)

OOS即系统运维管理,是官方提供的服务器批量运维工具,公共扩展库内置Hermes Agent安装包,通过云助手远程下发任务,自动完成二进制程序安装、服务注册、开机自启配置,全程不需要手动处理Docker。

操作步骤:

  1. 登录OOS控制台,导航栏选择服务器管理 > 扩展程序
  2. 切换公共扩展程序标签,找到Hermes Agent卡片,点击安装扩展程序;
  3. 在弹窗列表选中刚刚创建好的ECS实例,确认创建任务;
  4. 等待3‑5分钟,在执行历史页面查看任务运行状态,显示执行成功代表安装完毕;
  5. SSH登录服务器,执行版本校验命令确认安装结果。
# 查看Agent版本,正常返回hermes version x.x.x
hermes --version

输出版本号即部署完成,服务已经注册为systemd服务,服务器重启后会自动拉起。

方案二:Docker Compose手动容器部署(自定义场景使用)

当需要修改持久化目录、调整容器资源限制、修改日志级别,推荐手动拉取官方镜像,编写compose配置文件部署。

# 拉取Hermes Agent官方镜像
sudo docker pull nousresearch/hermes-agent:latest

# 创建配置持久化目录,存放配置文件、任务记忆数据
sudo mkdir -p /opt/hermes/config
sudo mkdir -p /opt/hermes/data

# 创建docker‑compose配置文件
sudo vim /opt/hermes/docker-compose.yml

把下面完整配置粘贴写入docker-compose.yml文件:

version: '3.8'
services:
  hermes:
    image: nousresearch/hermes-agent:latest
    container_name: hermes-agent
    restart: always
    ports:
      - "8080:8080"
    volumes:
      - /opt/hermes/config:/app/config
      - /opt/hermes/data:/app/data
    environment:
      - HERMES_PORT=8080
      - HERMES_LOG_LEVEL=info
      - TZ=Asia/Shanghai
    deploy:
      resources:
        limits:
          cpus: '2'
          memory: 4G

保存退出编辑器,启动容器并校验状态:

cd /opt/hermes
# 后台启动容器
sudo docker-compose up -d
# 查看容器运行状态,STATUS列显示Up即为正常运行
sudo docker ps

注意:如果容器反复重启,执行sudo docker-compose logs -f hermes查看详细日志,定位启动失败原因。

三、百炼Coding Plan、Token Plan订阅开通与专属API Key获取

Hermes Agent本身不提供大模型能力,依赖调用外部API完成推理。百炼平台两套订阅服务计费逻辑、API凭证、调用地址完全独立,两套套餐的API Key、Base URL不可混用,混用会直接返回鉴权401错误。

  • Coding Plan:按调用请求次数计费,适合高频代码生成、调试场景,适配代码类大模型;
  • Token Plan:按照Credits额度抵扣Token消耗,支持多款模型自由切换,适合通用任务、资料分析、多模态场景。

3.1 订阅套餐开通流程

  1. 登录百炼控制台,进入订阅计划页面,按需选择Coding Plan或者Token Plan套餐完成订购;
  2. 两套套餐均提供不同档位,可根据每月预估调用量选择版本;
  3. 订购成功后进入对应套餐的「我的订阅」页面,在这里生成套餐专属API Key。

重点提醒:API Key只在生成瞬间完整展示,关闭弹窗之后只能看到脱敏内容,生成务必立刻复制保存,一旦丢失只能重新创建密钥。

3.2 获取两套套餐API Key和Base URL

Coding Plan

  1. 在Coding Plan订阅页面,点击创建API‑Key,权限选择全部权限;
  2. API Key为套餐专属凭证,不能使用普通按量计费的Key;
  3. Anthropic兼容Base URL:https://coding.dashscope.aliyuncs.com/apps/anthropic
  4. OpenAI兼容Base URL:https://coding.dashscope.aliyuncs.com/v1

Token Plan

  1. 在Token Plan我的订阅页面创建专属API‑Key;
  2. OpenAI兼容Base URL:https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
  3. Anthropic兼容Base URL:https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic

关键注意点:API Key和Base URL强绑定,Token Plan的密钥只能搭配Token Plan的调用地址,Coding Plan密钥只能搭配Coding Plan调用地址,地域也要保持统一,全部使用华北2北京接入点。

四、Hermes Agent对接百炼订阅,配置与连通性验证

配置接入凭证有两种方式:交互式命令行配置,适合快速调试;直接修改配置文件,适合自动化批量部署。根据自己的部署方式选择操作。

4.1 交互式配置(推荐)

SSH登录服务器,启动交互式配置工具:

hermes config

跟随终端提示完成参数填写:

  1. 模型提供商输入bailian
  2. 根据自己订购套餐选择coding或者token
  3. 粘贴对应套餐完整API‑Key;
  4. 填入对应套餐的Base URL;
  5. 设置默认模型:Coding Plan可以选择qwen3.7‑plus;Token Plan可以选择qwen3.7‑max;
  6. 输入y确认保存配置。

4.2 直接修改配置文件

OOS一键部署配置文件路径:~/.config/hermes/config.json
Docker容器部署配置文件路径:/opt/hermes/config/config.json

编辑配置文件:

# OOS部署使用
sudo vim ~/.config/hermes/config.json

# Docker容器部署使用
sudo vim /opt/hermes/config/config.json

Coding Plan配置参考示例:

{
   
  "provider": "bailian-coding-plan",
  "api_key": "替换为你的Coding Plan完整API Key",
  "base_url": "https://coding.dashscope.aliyuncs.com/apps/anthropic",
  "default_model": "qwen3.7-plus",
  "max_tokens": 4096,
  "temperature": 0.7
}

Token Plan配置参考示例:

{
   
  "provider": "bailian-token-plan",
  "api_key": "替换为你的Token Plan完整API Key",
  "base_url": "https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
  "default_model": "qwen3.7-max",
  "max_tokens": 8192,
  "temperature": 0.6
}

修改保存完成,重启服务使配置生效:

# OOS一键部署重启服务
sudo systemctl restart hermes

# Docker Compose部署重启容器
cd /opt/hermes && sudo docker-compose restart

4.3 连通性测试,验证模型调用正常

配置完成后执行测试命令,校验整套链路是否打通:

# 基础对话测试
hermes chat -q "简单解释云原生架构的核心概念"

# 指定模型调用测试(Token Plan支持多模型切换)
hermes chat -m qwen3.7-max -q "用Python实现快速排序算法"

# 查看运行日志,排查报错
hermes logs

终端返回通顺的模型输出,没有鉴权、网络报错,说明Agent已经成功对接百炼订阅服务。

五、WebUI可视化访问、高级参数调优与自我进化功能开启

5.1 WebUI面板访问

Hermes Agent内置Web可视化管理界面,可以在浏览器完成对话交互、查看调用日志、修改参数、查看Agent沉淀的任务经验。

  1. 确认ECS安全组已经放行8080端口;
  2. 在浏览器访问地址:http://ECS公网IP:8080
  3. 进入面板之后可以查看历史对话记录,调整模型参数,管理Agent记忆库。

安全提示:公网直接暴露WebUI存在风险,生产环境建议增加身份认证,或者使用SSH隧道访问,不要直接对公网开放无密码的管理页面。

5.2 模型推理参数调优

修改config.json,可以调整模型生成效果,适配不同任务类型。

  • temperature(0‑1):控制输出随机性,代码编写建议设置0.3‑0.7;创意类任务调高至0.7‑0.9;
  • max_tokens:单次最大输出token上限,不要超过模型本身最大上下文窗口;
  • top_p:核采样参数,控制输出多样性;
  • frequency_penalty:频率惩罚,降低文本重复输出概率。

参数示例片段:

{
   
  "temperature":0.7,
  "max_tokens":8192,
  "top_p":0.9,
  "frequency_penalty":0.1,
  "presence_penalty":0.1,
  "timeout":60
}

5.3 开启Hermes自我进化核心能力

Hermes Agent最大特性是闭环自我进化,执行完复杂任务之后,会复盘任务流程,沉淀技能文档,后续遇到同类任务直接复用经验,越使用执行效率越高。在配置文件中开启该功能:

{
   
  "enable_evolution": true,
  "evolution_interval": 3600,
  "evolution_strategy": "task_based"
}

enable_evolution为true开启进化;evolution_interval单位秒,代表触发复盘进化的间隔;task_based代表基于实际执行任务进行经验沉淀。开启后Agent会占用少量CPU、内存用于任务复盘,2核4G配置可以正常运行。

六、常见问题定位与故障排查

故障1:返回Authentication failed鉴权失败

  1. 核对API‑Key是对应套餐专属密钥,不要混用普通按量计费密钥;
  2. Base URL地址复制完整,检查有没有多余空格、换行字符;
  3. 确认密钥没有过期,可到百炼控制台重新生成密钥替换测试;
  4. 确认实例地域与API Key所属地域保持一致,优先使用华北2北京接入点。

故障2:Docker容器启动失败,端口冲突

报错提示端口被占用,排查端口占用进程:

sudo netstat -tuln | grep 8080
  • 如果8080被其他程序占用,可以修改docker‑compose.yml端口映射,改为"8081:8080"
  • 镜像拉取失败,重新执行拉取命令sudo docker pull nousresearch/hermes-agent:latest
  • 确认Docker服务处于running状态:sudo systemctl status docker

故障3:模型请求超时Request timeout

  1. 在服务器终端测试连通性,测试能否访问百炼域名:
    ping token-plan.cn-beijing.maas.aliyuncs.com
    
  2. 检查ECS出站网络策略,没有拦截对外HTTPS访问;
  3. 在配置文件增加"timeout":60,拉长请求超时时间;
  4. 如果实例带宽很小,大上下文任务容易超时,可以升级实例带宽。

故障4:hermes命令无法识别(OOS部署)

查看OOS执行历史,确认扩展程序任务执行成功;如果任务失败,检查实例云助手服务是否正常运行,重启云助手之后重新下发安装任务。

七、后续优化方向

整套环境部署完成之后,还可以进一步做生产级优化:

  1. 对接日志服务,采集Hermes Agent运行日志,监控调用量、报错数量;
  2. 做好配置目录、data目录定时备份,Agent的任务记忆全部保存在data目录,服务器重装前务必备份;
  3. WebUI增加登录鉴权,避免直接暴露公网;
  4. 根据业务负载调整ECS实例规格,任务量大的时候升级CPU内存配置。

Hermes Agent的闭环进化机制搭配百炼两套订阅方案,可以兼顾智能体自主任务能力和稳定的大模型推理服务,适合开发者搭建私有化运行的AI助手,完成资料调研、项目分析、代码辅助、自动化任务等工作。在实际使用过程中,需要关注订阅套餐额度消耗,及时查看调用统计,避免超出预算。

目录
相关文章
存储 弹性计算 人工智能
36 1
弹性计算 Cloud Native Linux
92 4
Windows
407 1
|
29天前
|
人工智能 自然语言处理 文字识别
阿里云通义千问大模型最新功能介绍
阿里云通义千问是通义实验室打造的全栈式大模型家族,覆盖通用对话、长文本处理、多模态理解、代码生成、智能体执行等全场景能力,形成从入门到旗舰的完整产品矩阵。最新迭代的Qwen3系列,以**百万级上下文、原生多模态、全链路智能体**为核心标签,彻底突破传统大模型“对话工具”的局限,转向**自主思考、工具调用、任务执行**的智能体时代。
3618 1
人工智能 弹性计算 开发者
143 0
91 0
|
29天前
|
人工智能 自然语言处理 文字识别
阿里云Qwen3.7 Max与Plus全维度实测对比:多模态能力、架构、资费与选型指南
阿里云百炼平台推出的Qwen3.7系列包含Max、Plus两款商用核心模型,二者共享100万tokens超长上下文窗口、35小时自治执行上限两大核心基础能力,能够一次性承载百万字符文档、完整代码仓库、连续数十小时长流程智能体任务,但在底层架构、模态支持、输出上限、推理速度、计费标准上存在根本性区分,分别面向两类完全不同的AI业务赛道:极致纯文本重度推理场景、多模态图文视频综合业务场景。
377 2
人工智能 弹性计算 运维
165 0
数据采集 人工智能 安全
161 0
|
1月前
|
人工智能 弹性计算 运维
2026年阿里云ECS、轻量、GPU云服务器、百炼大模型配置价格与活动权益详解
2026年阿里云持续加码普惠上云政策,针对个人开发者、学生群体、小微创业团队、中小企业推出覆盖基础算力与AI算力的双维度特惠活动,涵盖轻量应用服务器、ECS云服务器全系梯度机型,以及百炼大模型免费算力、包月订阅、组合购专属权益。本次年度活动最大亮点为长效价格保障、新手零门槛试用、AI与云算力组合优惠,同时延续续费同价核心政策,彻底解决传统上云续费溢价、算力成本不可控、新手试错成本高的行业痛点。整套活动规则清晰、机型梯度完善、算力权益分层,兼顾个人学习测试、轻量建站、小型业务部署、常态化AI研发等全场景需求,是本年度低成本搭建云端业务与AI智能化能力的最优方案。
222 2