阿里云 ECS 部署Hermes Agent+百炼Coding Plan/Token Plan配置流程

简介: Hermes Agent是具备自我进化能力的AI智能体,支持跨会话记忆、经验沉淀与任务自主执行,可深度对接阿里云百炼平台的Coding Plan与Token Plan订阅服务,实现稳定、低成本的大模型调用。在阿里云ECS上部署Hermes Agent并完成百炼订阅计划配置,是搭建个人/团队专属AI编程与智能体服务的核心路径。本文从ECS环境初始化、Hermes Agent安装、百炼Coding Plan与Token Plan开通、API密钥获取、配置文件编写、服务启动与验证、常见问题排查等全环节展开,提供完整可执行的命令与操作步骤,确保零基础用户也能顺利完成部署与配置。

Hermes Agent是具备自我进化能力的AI智能体,支持跨会话记忆、经验沉淀与任务自主执行,可深度对接阿里云百炼平台的Coding Plan与Token Plan订阅服务,实现稳定、低成本的大模型调用。在阿里云ECS上部署Hermes Agent并完成百炼订阅计划配置,是搭建个人/团队专属AI编程与智能体服务的核心路径。本文从ECS环境初始化、Hermes Agent安装、百炼Coding Plan与Token Plan开通、API密钥获取、配置文件编写、服务启动与验证、常见问题排查等全环节展开,提供完整可执行的命令与操作步骤,确保零基础用户也能顺利完成部署与配置。阿里云部署AI Agent:OpenClaw/Hermes Agent全网最简单,只需两步,详情👉访问阿里云OpenClaw/Hermes一键部署专题页面了解。
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png
Token Plan Token 最便宜/支持多模型切换:👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

一、ECS环境准备与基础配置

部署Hermes Agent前,需先完成ECS实例的系统初始化、依赖安装与安全组配置,确保环境稳定、网络通畅。推荐选择Ubuntu 22.04CentOS Stream 9镜像,配置2核4G及以上资源,以保障智能体运行流畅。

1. 登录ECS实例并更新系统

通过SSH登录ECS实例,执行系统更新与基础工具安装:

# Ubuntu系统
sudo apt update && sudo apt upgrade -y
sudo apt install -y wget curl unzip git python3 python3-pip python3-venv build-essential

# CentOS/RockyLinux系统
sudo dnf update -y
sudo dnf install -y wget curl unzip git python3 python3-pip python3-devel gcc gcc-c++
2. 安装Docker(可选,容器化部署)

若采用容器化部署Hermes Agent,需先安装Docker与Docker Compose:

# Ubuntu安装Docker
sudo apt install -y docker.io docker-compose
sudo systemctl start docker
sudo systemctl enable docker
sudo usermod -aG docker $USER
newgrp docker

# CentOS安装Docker
sudo dnf remove -y docker docker-client docker-client-latest
sudo dnf config-manager --add-repo https://download.docker.com/linux/centos/docker-ce.repo
sudo dnf install -y docker-ce docker-ce-cli containerd.io docker-compose-plugin
sudo systemctl start docker
sudo systemctl enable docker
3. 安全组配置

在ECS控制台安全组中放行8090端口(Hermes Agent默认端口)与22端口(SSH),确保外部可访问智能体服务:

  • 入方向:协议TCP,端口8090,源地址0.0.0.0/0(或指定IP)
  • 入方向:协议TCP,端口22,源地址0.0.0.0/0(或指定IP)

二、Hermes Agent安装(两种方式)

Hermes Agent支持本地直接安装OOS扩展程序一键安装两种方式,可根据需求选择。

方式一:本地直接安装(推荐,灵活可控)
  1. 创建虚拟环境并激活

    mkdir -p ~/hermes && cd ~/hermes
    python3 -m venv venv
    source venv/bin/activate  # 激活虚拟环境
    
  2. 安装Hermes Agent
    ```bash

    安装最新版Hermes Agent

    pip install --upgrade hermes-agent

验证安装

hermes --version

输出示例:hermes-agent x.x.x,即安装成功


##### 方式二:OOS扩展程序一键安装(无需手动配置依赖)
1. 登录阿里云OOS控制台,进入**服务器管理 > 扩展程序**
2. 在公共扩展程序中找到**Hermes Agent**,点击**安装扩展程序**
3. 选择目标ECS实例,点击**创建**,等待安装完成
4. 验证安装:SSH登录ECS,执行`hermes --version`

#### 三、阿里云百炼Coding Plan与Token Plan开通与API密钥获取
Hermes Agent需通过百炼平台的订阅计划调用大模型,需先开通Coding Plan或Token Plan并获取专属API密钥。

##### 1. 开通百炼订阅计划
- 登录阿里云百炼控制台,进入**订阅套餐**
- 选择**Coding Plan**(个人开发场景,按调用次数计费)或**Token Plan**(团队/企业场景,按Token消耗计费)
- 选择对应套餐(基础版/专业版/团队版),完成支付开通

##### 2. 获取专属API密钥与Base URL
- **Token Plan**:进入**Token Plan > 我的订阅**,生成API密钥(以`sk-sp-`开头),获取Base URL:
  - OpenAI兼容:`https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1`
  - Anthropic兼容:`https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic`
- **Coding Plan**:进入**Coding Plan > 我的订阅**,生成API密钥(以`sk-cp-`开头),获取Base URL:
  - OpenAI兼容:`https://coding-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1`
  - Anthropic兼容:`https://coding-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic`

> 注意:Token Plan与Coding Plan的API密钥格式不同,不可混用;密钥仅显示一次,需妥善保存。

#### 四、Hermes Agent配置百炼Coding Plan/Token Plan
配置文件是Hermes Agent对接百炼订阅计划的核心,需写入API密钥、Base URL、默认模型等参数。

##### 1. 生成配置文件
```bash
# 创建配置目录
mkdir -p ~/.hermes
cd ~/.hermes

# 编辑.env配置文件(推荐)
vim .env
2. 写入配置内容(二选一:Coding Plan或Token Plan)
配置Token Plan(团队/企业场景)
# 阿里云百炼Token Plan配置
MODEL_PROVIDER=custom
MODEL_BASE_URL=https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
API_KEY=你的Token Plan专属API密钥(sk-sp-开头)
SERVER_PORT=8090
REQUEST_TIMEOUT=180
SESSION_MEMORY=true
DEFAULT_MODEL=qwen3.7-plus
TEMPERATURE=0.7
MAX_TOKENS=4096
LOG_LEVEL=info
配置Coding Plan(个人开发场景)
# 阿里云百炼Coding Plan配置
MODEL_PROVIDER=custom
MODEL_BASE_URL=https://coding-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
API_KEY=你的Coding Plan专属API密钥(sk-cp-开头)
SERVER_PORT=8090
REQUEST_TIMEOUT=180
SESSION_MEMORY=true
DEFAULT_MODEL=qwen3.7-plus
TEMPERATURE=0.7
MAX_TOKENS=4096
LOG_LEVEL=info
3. 命令行配置(替代文件配置,快速生效)
# 配置Token Plan
hermes config set model.provider custom
hermes config set model.base_url https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
hermes config set model.api_key 你的Token Plan API密钥
hermes config set model.default qwen3.7-plus

# 配置Coding Plan
hermes config set model.provider custom
hermes config set model.base_url https://coding-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
hermes config set model.api_key 你的Coding Plan API密钥
hermes config set model.default qwen3.7-plus

# 查看配置
hermes config list

五、启动Hermes Agent并验证服务

配置完成后,启动Hermes Agent并验证服务是否正常运行、能否成功调用百炼模型。

1. 启动Hermes Agent
# 前台启动(测试用)
hermes start

# 后台守护进程启动(生产用)
nohup hermes start > hermes.log 2>&1 &

# 查看进程
ps aux | grep hermes
2. 验证服务与模型调用
方法一:命令行测试
# 测试模型调用
hermes chat "你好,请介绍一下自己"
# 若返回正常响应,说明配置成功

# 测试长文本生成
hermes chat "生成一个Python Flask用户登录接口,使用SQLite数据库"
方法二:API调用测试
# 调用Hermes Agent API(替换为你的ECS公网IP)
curl http://ECS公网IP:8090/api/chat \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": "请解释Token Plan与Coding Plan的区别",
    "model": "qwen3.7-plus",
    "temperature": 0.7
  }'
方法三:WebUI访问(若支持)

浏览器访问http://ECS公网IP:8090,进入Hermes Agent Web界面,发送对话指令验证响应。

六、容器化部署Hermes Agent(进阶)

若需更稳定的部署与管理,可使用Docker Compose容器化部署。

1. 创建docker-compose.yml
version: '3'
services:
  hermes-agent:
    image: hermesagent/hermes:latest
    container_name: hermes-agent
    restart: always
    ports:
      - "8090:8090"
    volumes:
      - ~/.hermes:/root/.hermes
    environment:
      - MODEL_PROVIDER=custom
      - MODEL_BASE_URL=https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
      - API_KEY=你的Token Plan/Coding Plan API密钥
      - DEFAULT_MODEL=qwen3.7-plus
2. 启动容器
docker-compose up -d
docker-compose logs -f  # 查看日志

七、常见问题排查

  1. API密钥错误:检查密钥格式(Token Plan为sk-sp-,Coding Plan为sk-cp-),确保未泄露、未过期。
  2. Base URL错误:确认使用对应订阅计划的Base URL,Token Plan与Coding Plan不可混用。
  3. 端口无法访问:检查ECS安全组是否放行8090端口,防火墙是否拦截。
  4. 模型调用失败:查看Hermes日志(hermes.log),确认订阅计划是否有效、额度是否充足。
  5. 依赖安装失败:更新pip源为阿里云镜像,pip config set global.index-url https://mirrors.aliyun.com/pypi/simple/

零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程

第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png

👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:

  • 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
  • 实例:内存必须2GiB及以上。
  • 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
  • 时长:根据自己的需求及预算选择。

轻量应用服务器OpenClaw镜像.png
bailian1.png
bailian2.png

第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

阿里云百炼密钥管理图.png

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
阿里云百炼密钥管理图2.png

  • 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
  • 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
  • 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
  • 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。

阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:

创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
CodingPlan.png

  • 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。
    image.png
  • 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。
    image.png
  • 在服务器概览页面单击应用详情页签,进入服务器详情页面。
    image.png
  • 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。
    image.png
  • 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。
    image.png
  • 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。
    image.png
    image.png

    八、Hermes Agent高级配置与优化

  1. 多模型切换:在配置文件中修改DEFAULT_MODEL,支持qwen3.7-max、qwen3.7-plus、qwen3.6-flash等模型。
  2. 会话记忆管理:设置SESSION_MEMORY=true开启跨会话记忆,SESSION_TTL调整记忆时长。
  3. 日志级别调整:修改LOG_LEVEL为debug,便于排查问题。
  4. 资源限制:在启动命令中添加--max-memory 4G限制内存使用,避免资源耗尽。

九、总结

在阿里云ECS上部署Hermes Agent并配置百炼Coding Plan/Token Plan,是搭建专属AI智能体服务的完整路径。从ECS环境初始化、Hermes Agent安装、百炼订阅计划开通、API密钥获取、配置文件编写到服务启动与验证,每一步都有明确的命令与操作指引。通过本地安装或OOS一键安装两种方式,可快速部署Hermes Agent;通过Token Plan或Coding Plan两种订阅模式,可灵活适配个人开发与团队协作场景。

Hermes Agent凭借自我进化、跨会话记忆、经验沉淀等核心能力,结合百炼平台稳定的大模型服务,可大幅提升个人与团队的开发效率、自动化能力与智能决策水平。无论是个人开发者搭建专属AI编程助手,还是企业团队部署智能体服务,本教程提供的全流程部署与配置方案,都能确保服务稳定、安全、高效运行。后续可进一步探索Hermes Agent的工具调用、任务规划、多智能体协同等高级功能,释放AI智能体的更大价值。

目录
相关文章
|
5天前
|
人工智能 JSON 安全
|
5天前
|
云安全 人工智能 安全
|
5天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
771 0
|
5天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
814 0
|
3天前
|
自然语言处理 测试技术 API
通义千问Qwen3.8-Max-Preview全功能解析:2.4万亿参数旗舰模型深度使用指南
在大模型技术持续迭代的当下,通义千问推出的Qwen3.8-Max-Preview作为新一代旗舰预览版模型,凭借2.4万亿参数的超大规模、多模态融合能力与全场景适配特性,成为开发者与企业用户探索AI应用的核心工具。该模型采用稀疏混合专家(MoE)架构,是通义千问首个突破万亿参数的多模态模型,可同时处理文本、图像、视频与文档等多种数据形态,在全栈代码开发、复杂逻辑推理、长文档分析与多智能体协作等场景实现跨越式升级。本文将全面拆解Qwen3.8-Max-Preview的核心功能,详解API调用流程与配置方法,覆盖多场景实战技巧,帮助用户快速掌握这款旗舰模型的使用方法,充分释放其性能潜力。
375 1
|
7天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
723 30
|
5天前
|
人工智能 测试技术 语音技术
Qwen-Audio-3.0-TTS 正式发布!AI 语音从 “能说话” 升级到 “会带情绪表达”
阿里云发布Qwen-Audio-3.0-TTS语音合成大模型,支持细粒度标签控制(如[gasp][angry])、freestyle自由风格、16种语言及20种方言,声学鲁棒性强。含Flash(首包延时300ms)和Plus(全球榜单冠军)双版本,已在百炼平台开放调用。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
651 1
|
6天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
572 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南