Hermes Agent ECS云服务器部署实操:阿里云百炼Coding Plan/Token Plan密钥与模型调用配置教程

简介: Hermes Agent作为一款开源自进化AI智能体,具备跨会话记忆、技能沉淀与自主学习能力,可实现任务拆解、代码执行、工具调用与流程自动化,适配个人开发、办公自动化、AI应用落地等多场景。阿里云ECS提供稳定弹性的算力支撑,搭配百炼Coding Plan与Token Plan,可低成本、稳定调用通义千问等大模型,为Hermes Agent提供强大推理能力。本文从ECS实例创建、百炼双计划开通、Hermes Agent部署、模型配置、功能验证到问题排查,提供全流程实操指南,附带可直接运行的命令,帮助零基础用户快速搭建专属AI智能体服务。

Hermes Agent作为一款开源自进化AI智能体,具备跨会话记忆、技能沉淀与自主学习能力,可实现任务拆解、代码执行、工具调用与流程自动化,适配个人开发、办公自动化、AI应用落地等多场景。阿里云ECS提供稳定弹性的算力支撑,搭配百炼Coding Plan与Token Plan,可低成本、稳定调用通义千问等大模型,为Hermes Agent提供强大推理能力。本文从ECS实例创建、百炼双计划开通、Hermes Agent部署、模型配置、功能验证到问题排查,提供全流程实操指南,附带可直接运行的命令,帮助零基础用户快速搭建专属AI智能体服务。

一、部署前准备:账号、权限与环境预检

1. 阿里云账号与实名认证

确保已注册阿里云账号并完成实名认证,未实名认证账号无法开通百炼服务、创建ECS实例及生成API Key,这是所有操作的基础前提。个人用户默认拥有ECS、百炼服务的操作权限,子账号需主账号在RAM控制台授予AliyunECSFullAccessAliyunBSSFullAccess及百炼相关权限。

2. 账户余额准备

ECS实例支持按量付费与包年包月,若选择按量付费,账户余额需大于等于100元,避免因余额不足导致实例创建失败或服务中断。百炼Coding Plan与Token Plan为订阅制,需提前完成支付开通。

3. ECS实例选型与配置建议

Hermes Agent运行需稳定算力,配置建议如下:

  • 实例规格:最低1vCPU+2GiB内存,推荐2vCPU+4GiB内存+40GiB ESSD云盘,保障智能体流畅运行,避免内存溢出;
  • 操作系统:优先选择Ubuntu 22.04 LTS(兼容性最优),或Alibaba Cloud Linux 3(预装云助手,简化运维);
  • 地域:国内选北京、杭州等主流地域,网络稳定;海外选中国香港、新加坡,无需ICP备案,适配跨境场景;
  • 带宽:200Mbps峰值带宽,保障模型调用、Web控制台访问流畅;
  • 安全组:提前规划放行22端口(SSH远程连接)、18789端口(Hermes Agent Web控制台),避免后续访问被拦截。

零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程

第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png

👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:

  • 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
  • 实例:内存必须2GiB及以上。
  • 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
  • 时长:根据自己的需求及预算选择。

轻量应用服务器OpenClaw镜像.png
bailian1.png
bailian2.png

第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

阿里云百炼密钥管理图.png

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
阿里云百炼密钥管理图2.png

  • 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
  • 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
  • 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
  • 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。

阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:

创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
CodingPlan.png

  • 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。
    image.png
  • 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。
    image.png
  • 在服务器概览页面单击应用详情页签,进入服务器详情页面。
    image.png
  • 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。
    image.png
  • 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。
    image.png
  • 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。
    image.png
    image.png

4. 环境预检(必做)

创建ECS实例后,通过Workbench或SSH远程连接,执行环境预检脚本,检查系统、内存、端口是否满足要求:

# 远程连接ECS实例(替换为你的公网IP)
ssh root@你的ECS公网IP
# 下载并执行预检脚本
curl -fsSL https://gitee.com/hermes-agent-team/script/raw/main/ecs_precheck.sh | bash

预检通过会显示系统适配、内存/存储达标、18789端口未占用等结果,若出现异常(如端口占用、内存不足),需先修复再部署。

二、阿里云ECS实例创建与基础配置

1. 登录ECS控制台创建实例

登录阿里云控制台,搜索“云服务器ECS”,进入实例管理页面,点击“创建实例”。按以下步骤配置:

  • 基础配置:选择“按量付费”或“包年包月”,地域选北京/杭州/中国香港,实例规格选2vCPU+4GiB,镜像选Ubuntu 22.04 LTS,存储选40GiB ESSD云盘;
  • 网络配置:选择默认VPC与交换机,公网IP选“分配公网IP”,带宽选200Mbps;
  • 安全组配置:新建安全组,放行22(SSH)、18789(Hermes Web)端口,来源设为0.0.0.0/0(测试环境,生产环境需限制IP);
  • 登录设置:设置root密码(或选择密钥对登录,安全性更高);
  • 确认订单:核对配置,同意服务协议,点击“立即创建”,等待3-5分钟,实例状态变为“运行中”。

2. 获取ECS公网IP与登录凭证

实例创建完成后,在实例列表中复制公网IP,记录root密码(或密钥对),用于后续远程连接与配置。

三、开通阿里云百炼Coding Plan与Token Plan

1. 开通百炼基础服务

登录阿里云控制台,搜索“百炼”,进入大模型服务平台,点击“立即开通”,完成基础服务开通(免费)。

2. 开通Token Plan(推荐个人/团队通用)

Token Plan以Credits为计费单位,支持个人版与团队版,适配多场景模型调用:

  • 进入百炼控制台,左侧导航栏选“计费管理→Token Plan”;
  • 选择套餐:个人版Lite(39元/月,2亿Credits)、Standard(99元/月,5亿Credits)、Pro(199元/月,12亿Credits);团队版按需选择更高额度套餐;
  • 点击“立即开通”,完成支付,开通后在“我的订阅”页面生成专属API Key(格式sk-开头);
  • 获取Token Plan Base URL:
    • OpenAI兼容:https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
    • Anthropic兼容:https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic

3. 开通Coding Plan(代码开发专用)

Coding Plan为固定月费订阅,按模型调用次数计量,适配代码生成、调试等开发场景:

  • 进入百炼控制台,左侧导航栏选“计费管理→Coding Plan”;
  • 选择Pro套餐(月费299元,含无限次代码模型调用),完成支付;
  • 获取Coding Plan专属API Key(格式sk-sp-开头,与Token Plan Key不可混用);
  • 获取Coding Plan Base URL:
    • OpenAI兼容:https://coding.dashscope.aliyuncs.com/v1
    • Anthropic兼容:https://coding.dashscope.aliyuncs.com/apps/anthropic

4. API Key安全保存

API Key是调用百炼模型的核心凭证,仅生成时完整显示一次,需立即复制并妥善保存,严禁公开或泄露,避免资金损失。

四、ECS实例部署Hermes Agent(一键脚本+手动配置)

1. 远程连接ECS实例

使用SSH工具连接ECS公网IP,输入root密码登录:

ssh root@你的ECS公网IP

2. 一键安装Hermes Agent(推荐)

执行官方一键安装脚本,自动下载程序、配置环境变量、安装依赖,全程无需手动干预:

# 下载并执行Hermes Agent官方一键安装脚本
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

脚本执行约3-5分钟,完成后会提示安装成功,并自动配置全局环境变量。

3. 安装验证

执行以下命令,查看Hermes版本,输出版本号(如0.14.0+)即安装成功:

# 查看Hermes Agent版本
hermes --version

4. 服务启动与状态查看

# 启动Hermes Agent服务
hermes start
# 查看服务运行状态(显示running即正常)
hermes status
# 查看服务日志(排查问题时使用)
hermes logs

五、配置Hermes Agent对接百炼Coding Plan/Token Plan

方案A:命令行配置Token Plan(推荐)

通过hermes config命令快速配置,无需手动编辑文件,配置自动写入~/.hermes/config.yaml

# 1. 设置模型提供商为custom(兼容OpenAI协议)
hermes config set model.provider custom
# 2. 设置Token Plan专属Base URL(北京地域)
hermes config set model.base_url https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
# 3. 设置Token Plan API Key(替换为你的密钥)
hermes config set model.api_key sk-xxxxxxxxxxxxxxxxxxxxxxxx
# 4. 设置默认模型(推荐qwen3.8-max,支持长文本与推理)
hermes config set model.default qwen3.8-max
# 5. 配置模型最大Token长度(适配大模型能力)
hermes config set model.max_tokens 128000
# 6. 查看配置是否生效
hermes config get

方案B:命令行配置Coding Plan(代码开发专用)

# 1. 设置模型提供商为custom
hermes config set model.provider custom
# 2. 设置Coding Plan专属Base URL
hermes config set model.base_url https://coding.dashscope.aliyuncs.com/v1
# 3. 设置Coding Plan API Key(替换为你的sk-sp-开头密钥)
hermes config set model.api_key sk-sp-xxxxxxxxxxxxxxxxxxxxxxxx
# 4. 设置默认代码模型(qwen3.8-max)
hermes config set model.default qwen3.8-max
# 5. 配置代码生成专属参数
hermes config set model.temperature 0.7
# 6. 查看配置
hermes config get

方案C:手动编辑配置文件(进阶自定义)

若需批量修改参数,直接编辑Hermes配置文件:

# 编辑Hermes配置文件
vi ~/.hermes/config.yaml

写入以下内容(二选一,替换API Key):

Token Plan配置

model:
  default: qwen3.8-max
  provider: custom
  base_url: https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
  api_key: sk-xxxxxxxxxxxxxxxxxxxxxxxx
  max_tokens: 128000
  temperature: 0.8
gateway:
  port: 18789
  token: 自定义网关令牌(如my-hermes-token)

Coding Plan配置

model:
  default: qwen3.8-max
  provider: custom
  base_url: https://coding.dashscope.aliyuncs.com/v1
  api_key: sk-sp-xxxxxxxxxxxxxxxxxxxxxxxx
  max_tokens: 128000
  temperature: 0.7
gateway:
  port: 18789
  token: 自定义网关令牌

编辑完成后,按Esc,输入:wq保存退出,重启Hermes服务使配置生效:

hermes restart

六、启动Hermes Web控制台与功能验证

1. 启动Web网关

# 启动Hermes Web控制台网关
hermes gateway start

命令执行后,会显示Web访问地址:http://你的ECS公网IP:18789?token=自定义网关令牌

2. 访问Web控制台

在浏览器打开上述地址,进入Hermes Agent Dashboard,左侧包含Chat、Agent、Settings、Logs等模块,可直观管理智能体。

3. 模型调用验证(CLI方式)

SSH连接ECS,直接运行hermes进入交互模式,测试模型调用:

# 进入Hermes交互模式
hermes
# 输入测试问题,验证百炼模型是否正常响应
你好,请介绍一下自己
# 测试代码生成功能(Coding Plan专属)
编写一个Python函数,计算斐波那契数列前20项

若返回正常回答与代码,说明模型配置成功。

4. 功能测试(智能体任务执行)

在Web控制台或CLI中,让Hermes执行复杂任务,验证自进化能力:

# 任务:分析日志文件并生成报告
请分析/var/log/syslog中的错误日志,生成一份简要报告
# 任务:自动化代码部署
编写一个Shell脚本,自动部署Nginx服务并配置静态网站

Hermes会自动拆解任务、调用模型、执行代码,完成后返回结果,验证智能体功能正常。

七、常见问题排查与避坑指南

1. Hermes服务启动失败

  • 原因:内存不足、端口占用、依赖缺失;
  • 解决:升级ECS实例规格至2核4G以上;执行lsof -i:18789查看端口占用程序,关闭后重启;重新执行一键安装脚本补全依赖。

2. 模型调用失败(API Key错误)

  • 原因:API Key与Base URL不匹配、Key输入错误、计划类型混用(Token Plan与Coding Plan Key不可互换);
  • 解决:核对百炼控制台的API Key与Base URL,重新配置并重启Hermes服务。

3. Web控制台无法访问

  • 原因:ECS安全组未放行18789端口、防火墙拦截、网关未启动;
  • 解决:进入ECS控制台,安全组添加18789端口放行规则;执行hermes gateway start启动网关;关闭服务器防火墙(测试环境)。

4. Token/Credits额度不足

  • 原因:Token Plan Credits耗尽、Coding Plan调用次数超限;
  • 解决:进入百炼控制台,查看剩余额度,升级套餐或充值;Coding Plan需等待额度滚动恢复(每5小时)或周期重置。

5. 智能体响应缓慢

  • 原因:ECS带宽不足、模型选择不当、网络延迟;
  • 解决:升级ECS带宽至500Mbps;选择qwen3.8-max等高性能模型;选择就近地域(如北京)的ECS实例。

八、Hermes Agent+百炼应用场景扩展

1. 个人开发助手

配置Coding Plan,Hermes可实现代码生成、调试、重构、单元测试编写,提升开发效率,支持Python、Java、Go等多语言。

2. 办公自动化RPA

通过Hermes的任务拆解能力,配置自动化流程,如邮件处理、数据录入、报表生成、文件整理,搭配Token Plan稳定调用模型,实现7×24小时自动化办公。

3. AI应用快速落地

基于Hermes Agent开发自定义智能体,接入飞书、微信、Telegram等多端,快速落地智能客服、内容生成、数据分析等AI应用,无需从零搭建模型服务。

4. 科研与数据分析

调用百炼大模型的推理能力,Hermes可辅助科研数据处理、文献解读、实验方案设计,提升科研效率。

九、总结

阿里云ECS为Hermes Agent提供了稳定弹性的算力基础,一键部署脚本简化了环境搭建流程,零基础用户也能快速完成安装。阿里云百炼的Coding Plan与Token Plan则为Hermes Agent提供了低成本、稳定的大模型调用能力,分别适配代码开发与通用场景需求。通过本文的全流程实操,从ECS创建、百炼双计划开通、Hermes部署、模型配置到功能验证,可快速搭建专属自进化AI智能体。后续可根据业务需求,扩展智能体功能、接入多端平台,充分发挥Hermes Agent与百炼大模型的能力,实现个人效率提升与业务自动化落地。

目录
相关文章
|
2天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1313 108
|
9天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1931 8
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
3天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
507 112
|
7天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
686 111
|
3天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
|
17天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2611 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
15天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2064 2
|
4天前
Qoder 一周年 × Qwen3.8-Max 正式上线,多重好礼限时领
8月3日,Qwen3.8-Max 正式上线Qoder,迎来Qoder一周年。新老用户可领800次免费调用,下单再赠2000次;夜间(22:00–08:00)调用5折;邀请好友双方得积分与调用额度。
319 0
|
17天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
1494 3