阿里云ECS + Hermes Agent部署详解:Coding Plan与Token Plan参数、命令汇总

简介: 在AI智能体工程落地领域,Hermes Agent是一款面向自主任务编排、闭环开发、工具调用的开源智能体框架,支持长周期任务拆解、多文件读写、日志复盘、代码迭代,非常适合研发自动化、知识库巡检、项目工程交付场景。而百炼推出的Coding Plan、Token Plan两类订阅套餐,分别面向高频代码开发场景和通用大模型调用场景,和Hermes Agent具备原生兼容能力,依托Anthropic兼容接口即可完成对接。很多开发者在实操时容易混淆两套订阅的接口地址、专属API密钥、模型池差异,同时在ECS环境部署时容易遇到端口、安全组、内存不足、环境依赖缺失、配置文件不生效等问题。本文为完整落地教程,

在AI智能体工程落地领域,Hermes Agent是一款面向自主任务编排、闭环开发、工具调用的开源智能体框架,支持长周期任务拆解、多文件读写、日志复盘、代码迭代,非常适合研发自动化、知识库巡检、项目工程交付场景。而百炼推出的Coding Plan、Token Plan两类订阅套餐,分别面向高频代码开发场景和通用大模型调用场景,和Hermes Agent具备原生兼容能力,依托Anthropic兼容接口即可完成对接。很多开发者在实操时容易混淆两套订阅的接口地址、专属API密钥、模型池差异,同时在ECS环境部署时容易遇到端口、安全组、内存不足、环境依赖缺失、配置文件不生效等问题。本文为完整落地教程,以ECS云服务器作为运行载体,从实例选购、安全组配置、环境初始化、Hermes Agent安装、Coding Plan与Token Plan两套方案配置、连通性验证、后台常驻、日志排查、套餐选型对比,完整覆盖全流程,所有操作命令均可直接复制执行,新手跟着步骤即可完成一套可用的自进化智能体服务。

首先明确两套订阅方案核心定位差异,这是部署前最关键的选型环节,选错套餐会出现模型调用失败、计费异常、能力不匹配等问题。Coding Plan是面向代码工程场景的订阅方案,主打程序开发、项目重构、单元测试、脚本调试,内置经过代码专项优化的模型池,计费模式以调用次数计量,适合以代码生成、工程迭代为主的Hermes Agent任务;Token Plan分为个人版与团队版,属于通用型订阅,按Token消耗抵扣套餐内额度,覆盖文档分析、逻辑推理、多轮规划、通用工具调用,适合非代码类长周期Agent任务。二者拥有独立控制台、独立专属API Key、独立接口访问地址,密钥不能混用,接口地址不可直接替换,这也是绝大多数部署报错的根源。在正式部署Hermes Agent之前,需要先完成ECS实例创建与网络安全配置,这一步决定后续能否正常远程连接、对外交互。

零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程

第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面
OpenClaw1.png
OpenClaw2.png
OpenClaw02.png
openClaw3.png
OpenClaw031.png
OpenClaw03.png
OpenClaw04.png
OpenClaw5.png
Openclaw6.png

👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。
tokenplan1.png
tokenplan1.png
tokenplan2.png
tokenplan3.png
tokenplan4.png

第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:

  • 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
  • 实例:内存必须2GiB及以上。
  • 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
  • 时长:根据自己的需求及预算选择。

轻量应用服务器OpenClaw镜像.png
bailian1.png
bailian2.png

第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

阿里云百炼密钥管理图.png

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
阿里云百炼密钥管理图2.png

  • 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
  • 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
  • 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
  • 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。

阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:

创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
CodingPlan.png

  • 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。
    image.png
  • 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。
    image.png
  • 在服务器概览页面单击应用详情页签,进入服务器详情页面。
    image.png
  • 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。
    image.png
  • 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。
    image.png
  • 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。
    image.png
    image.png
    ECS实例选型与安全组配置环节,推荐个人测试最低规格2核4GiB内存,磁盘选用40GiB以上ESSD云盘;团队长期稳定运行建议4核8GiB,避免Hermes在执行多步骤任务、读写大量工程文件时出现内存溢出、进程崩溃。操作系统优先选用主流CentOS Stream、Ubuntu、OpenEuler等Linux发行版,不建议使用精简版最小镜像,避免缺失基础工具包。实例创建完成后,进入安全组配置页面,放行22号SSH远程端口,若后续需要WebUI管理,同步放行Hermes对应管理端口,入方向策略仅开放自身办公公网IP,降低服务器被扫描攻击的风险。服务器创建完成后,使用Workbench网页终端或者SSH客户端连接实例,推荐Workbench,无需本地配置密钥,开箱即用,适合零基础用户。

连接ECS服务器之后,先执行系统基础环境更新,安装git、curl、python3等前置依赖,Hermes Agent自动化安装脚本依赖这些基础组件,缺少会直接中断部署。执行下面系统初始化命令:

# Ubuntu / Debian系列
apt update && apt upgrade -y
apt install -y curl git python3 python3-pip python3-venv

# CentOS / OpenEuler系列
dnf update -y
dnf install -y curl git python3 python3-pip

环境就绪之后,直接使用官方一键安装脚本部署Hermes Agent,脚本会自动拉取源码、创建虚拟环境、注册系统命令,无需手动处理Python依赖冲突,执行命令:

curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

脚本执行结束后,必须重载Shell环境变量,否则终端无法识别hermes全局命令,根据自己使用的Shell执行对应指令:

# bash 用户
source ~/.bashrc
# zsh 用户
source ~/.zshrc

重载完成后,执行版本验证命令,输出版本号即代表Hermes Agent安装成功:

hermes --version

安装成功之后,核心环节就是接入百炼订阅套餐,两套方案分开配置,命令参数不通用,下面先讲解Coding Plan配置流程。首先登录百炼控制台,进入Coding Plan订阅页面完成订阅,在密钥管理界面生成Coding Plan专属API Key,妥善保存,密钥只展示一次,丢失无法找回。在ECS终端依次执行hermes config set系列指令,写入服务商类型、接口地址、接口模式、密钥、默认模型:

# Coding Plan 配置命令
hermes config set model.provider custom
hermes config set model.base_url https://coding.dashscope.aliyuncs.com/apps/anthropic
hermes config set model.api_mode anthropic_messages
hermes config set model.api_key "替换为你的Coding Plan专属API Key"
hermes config set model.default qwen3.7-plus

执行完毕后,配置自动写入~/.hermes/config.yaml,也可以手动编辑文件固化配置,适合批量管理、版本留存:

model:
  default: qwen3.7-plus
  provider: custom
  base_url: https://coding.dashscope.aliyuncs.com/apps/anthropic
  api_mode: anthropic_messages
  api_key: "替换为你的Coding Plan专属API Key"

配置写入完成,执行快速连通性测试,下发简单代码任务,验证Hermes能否正常调用Coding Plan模型:

hermes run "编写一个Python脚本,实现日志按日期切割,附带异常捕获与单元测试"

如果可以正常输出代码、Agent自主完成任务拆解,代表Coding Plan链路调试成功。

接下来讲解Token Plan接入配置,同样先在百炼控制台订阅Token Plan个人版或团队版,生成Token Plan专属API Key,注意和上面Coding Plan密钥区分。终端执行下面一组配置命令,修改base_url为Token Plan专属接入地址,替换对应密钥:

# Token Plan 配置命令
hermes config set model.provider custom
hermes config set model.base_url https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic
hermes config set model.api_mode anthropic_messages
hermes config set model.api_key "替换为你的Token Plan专属API Key"
hermes config set model.default qwen3.7-plus

手动写入配置文件参考模板:

model:
  default: qwen3.7-plus
  provider: custom
  base_url: https://token-plan.cn-beijing.maas.aliyuncs.com/apps/anthropic
  api_mode: anthropic_messages
  api_key: "替换为你的Token Plan专属API Key"

配置保存后,执行通用任务验证链路,适合文档分析、方案推演类测试:

hermes run "整理一份项目风险清单,划分高、中、低风险,附带应对策略"

日常使用中,如果需要在Coding Plan和Token Plan两套套餐之间快速切换,只需要重新执行对应套餐的hermes config set命令覆盖参数,不需要重装Hermes,切换完成建议再次执行一次简单run任务验证链路,避免缓存配置干扰调用。

很多用户部署完成后需要Hermes Agent后台常驻运行、开机自启,适合长期驻机自动化任务,这里提供systemd托管方案,实现进程守护、异常自动重启。创建systemd服务单元文件:

vim /etc/systemd/system/hermes-agent.service

写入下面服务配置内容:

[Unit]
Description=Hermes Agent Service
After=network.target

[Service]
User=root
ExecStart=/root/.local/bin/hermes daemon
Restart=on-failure
RestartSec=10

[Install]
WantedBy=multi-user.target

保存退出后,重载systemd配置、设置开机自启并启动服务:

systemctl daemon-reload
systemctl enable hermes-agent
systemctl start hermes-agent
# 查看运行状态
systemctl status hermes-agent
# 实时查看运行日志
journalctl -u hermes-agent -f

至此整套ECS部署+百炼订阅接入流程全部完成,接下来梳理高频故障排查清单,覆盖新手最容易踩坑的问题。第一,执行hermes命令提示command not found,大多是没有重载shell环境变量,重新执行source加载环境;第二,调用时报鉴权失败,优先核对API Key归属,确认当前配置的Key属于Coding Plan还是Token Plan,两套密钥不能混用,同时确认订阅状态有效、没有欠费;第三,请求超时、连接失败,检查ECS安全组出站策略、服务器是否可以公网访问模型接口,可以先用curl单独测试接口连通性,示例命令:

curl https://coding.dashscope.aliyuncs.com/apps/anthropic -I

第四,内存占用过高、Agent任务中途崩溃,优先升级ECS实例内存规格,长周期代码工程任务对内存消耗更高;第五,模型返回结果不符合预期,核对default模型名称,确认所选模型在当前订阅套餐支持列表内,不在池内的模型标识会直接调用失败。

在套餐选型策略上,大家可以根据业务目标直接取舍:如果Hermes Agent核心用途是自主写代码、重构项目、调试脚本、生成测试用例、管理Git仓库,优先选择Coding Plan,按调用次数计费更划算,模型针对代码做专项优化;如果主要用来做长文档拆解、业务方案推演、多轮自主规划、通用知识库问答、多模态资料梳理,选择Token Plan,按Token抵扣额度,通用性更强。同时建议分开管理两套套餐的API密钥,不要混写配置,正式业务环境中,可准备两套config.yaml配置文件,编写一键切换脚本,快速在代码任务和通用智能体任务之间切换。

从架构价值来看,这套方案把Hermes自主智能体的任务编排、工具调用、闭环复盘能力,和百炼订阅套餐的模型算力封装结合在一起,不需要自研模型调度层,依托兼容协议即可快速打通。ECS作为私有化运行载体,所有Agent执行过程、本地文件读写、日志数据都托管在自己的云服务器内,相比纯网页端Agent,可控性更强,适合企业内部项目、私有代码仓库自动化、涉密文档分析等场景。开发者可以基于这套基础链路继续扩展,增加向量知识库对接、本地代码仓库授权、定时任务触发器、Web可视化管理面板,把Hermes改造成专属研发自动化平台。

在安全规范上有几点必须重视:API密钥属于高敏感凭证,禁止硬编码写入公开脚本、提交到代码仓库,尽量使用环境变量注入密钥,避免泄露产生非预期扣费;ECS安全组最小权限开放,不要放行全部IP访问22端口;定期查看百炼控制台调用用量、ECS服务器资源占用,设置额度告警,防止脚本异常循环调用产生超额消耗;Agent自动执行文件修改、命令调用任务时,前期建议先在测试环境验证行为逻辑,再投入正式项目使用,避免智能体误操作修改线上业务文件。

整体来看,整套落地流程分为实例准备、系统依赖、Hermes安装、订阅密钥获取、两套方案参数配置、连通测试、进程常驻七个核心环节,最容易出错的就是混淆Coding Plan和Token Plan的接口地址、专属密钥,只要严格区分两套订阅的配置命令,按照本文提供的指令依次执行,即可稳定跑通Hermes Agent对接百炼模型服务的全链路。对于想要落地自主迭代AI智能体、研发自动化工具的技术团队和独立开发者,该方案上手门槛适中、链路简洁、可扩展性强,是兼顾可控性与算力成本的实用落地方案,后续可以基于Hermes丰富的插件生态,持续拓展文件检索、数据库查询、接口调用等更多能力,打造适配自身业务流程的专属智能工作流。

目录
相关文章
|
9天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1869 119
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
|
10天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
1428 13
|
15天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1964 10
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
7天前
|
编解码 弹性计算 云计算
MiniMax-H3 视频生成模型 — 一键部署与使用指南
MiniMax-H3是MiniMax开源的33B全模态视频生成模型,支持文生视频、图生视频、参考生视频三种模式,原生输出2K/15秒带立体声音频视频,已原生适配ComfyUI,并可通过阿里云计算巢一键部署。(239字)
|
10天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
8天前
|
人工智能 API 开发工具
2026 零基础本地 AI 漫剧完整实操教程(8G 笔记本显卡可用|附可直接复制命令与代码)
本方案提供完全离线、本地运行的漫剧全自动制作流程:RTX3060/4050 8G显卡即可驱动,涵盖Qwen写分镜→ComfyUI统一角色绘图→LTX2.3图生微动画→Qwen3-TTS本地配音→FFmpeg自动合成,全程无水印、免API、不限次。专为低显存优化,解决变脸、闪烁、爆内存三大痛点。(239字)
|
22天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
3358 5
|
9天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
555 113