在AI智能体的生态当中,Hermes Agent凭借自我进化、自动提炼技能、多层持久记忆的核心特性,成为深度任务处理、资料搜集、多步骤复杂工作流场景非常热门的开源智能体框架。它区别于侧重多渠道消息接入的Agent项目,更加重视任务拆解、经验沉淀,在反复使用过程中可以自动生成、迭代工具技能,越使用越贴合使用者的工作习惯。阿里云计算巢提供了模板化一键部署能力,把云实例创建、操作系统初始化、依赖包安装、Hermes Agent环境初始化全部封装自动化流程,不用手动处理大量环境编译工作。百炼平台的Coding Plan面向代码开发场景,Token Plan面向通用问答、长文档、多模态推理,两套订阅服务可以为Hermes Agent提供稳定的大模型推理底座。本文完整讲解部署前置准备、计算巢模板部署、轻量预装镜像部署两种实施方案,订阅开通、API密钥获取、Hermes配置文件编写、服务验证、安全优化、高频故障排查,附带可直接复制的命令与YAML配置片段,帮助使用者快速完成从资源开通到自进化智能体正式可用的完整链路。
一、部署前期准备:账号、服务开通与权限配置
正式部署Hermes Agent之前,需要完成账号实名认证、相关服务开通、账号权限分配,避免部署、调用模型的时候出现鉴权报错。
账号注册与实名认证
完成账号注册登录,必须完成实名认证,没有完成实名认证的账号无法正常使用计算巢、百炼大模型相关服务。推荐支付宝授权扫码完成实名认证,流程简单高效。使用按量付费模式时,建议账户余额保持100元以上,防止部署阶段余额不足,造成资源创建失败。开通百炼大模型服务
控制台搜索百炼,进入大模型服务平台,点击立即开通。开通本身不会产生任何费用,开通完成之后,才可以访问密钥管理、订阅管理页面,后续Coding Plan、Token Plan的购买、API‑Key生成都依赖该服务。详情👉访问阿里云百炼大模型服务平台页面 了解。


RAM子账号授权(可选)
如果日常工作使用RAM子账号操作,主账号需要前往RAM控制台,给子账号授予AliyunBSSFullAccess、AliyunComputeNestUserFullAccess、AliyunDashScopeFullAccess权限。缺少任意一项权限,子账号会出现计算巢部署失败、无法读取订阅密钥、调用模型鉴权失败等各类问题。
选型提示:Hermes Agent有两种主流部署路径。第一种是轻量应用服务器预装镜像,适合零基础使用者,大部分操作在控制台图形界面完成;第二种是计算巢官方模板部署,适合需要自定义实例规格、后续二次开发的团队。硬件最低内存要求2GiB,入门推荐2核4G,高并发、复杂任务建议4核8G。如果需要完整的网页联网搜索能力,实例地域可以选择海外地域;国内地域联网搜索功能存在一定限制。
二、方案一:轻量应用服务器预装镜像快速部署
阿里云部署AI Agent:OpenClaw/Hermes Agent全网最简单,只需两步,详情👉访问阿里云OpenClaw/Hermes一键部署专题页面了解。








Token Plan Token 最便宜/支持多模型切换:👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。




轻量应用服务器提供预制Hermes Agent的应用镜像,运行环境全部预置完毕,大量配置工作通过控制台图形化完成,适合个人开发者快速上手。
实例购买参数设置
进入轻量应用服务器购买页面,应用镜像选择Hermes Agent镜像;内存不低于2GiB;地域根据业务需求选择,需要完整网页抓取搜索优先海外地域;购买时长按照预算选择。如果已经拥有轻量实例,也可以重置系统盘,重新选择Hermes Agent预制镜像。百炼控制台生成套餐专属API‑Key
进入百炼控制台,打开密钥管理页面。注意:Coding Plan、Token Plan、普通按量付费生成的API‑Key互相独立,不能混用。使用哪一套订阅,就生成对应套餐的专属密钥,复制保存密钥字符串。控制台图形化初始化Hermes Agent
进入轻量实例详情页面,切换至应用详情标签页。
- 执行端口放通命令,开放WebUI以及Agent服务所需端口;
- 执行API‑Key配置命令,粘贴从百炼复制得到的套餐API‑Key;
- 执行初始化命令,完成Hermes Agent基础初始化;
- 执行获取访问地址命令,拿到WebUI访问链接。
浏览器打开访问链接,即可进入Hermes Agent交互界面。
三、方案二:计算巢模板一键部署Hermes Agent
计算巢将ECS实例创建、操作系统初始化、全套依赖包安装、Hermes Agent部署封装成标准化模板,5‑10分钟完成整套环境,适合追求自定义配置、后续二次开发的使用者。
搜索官方部署模板
登录阿里云控制台,进入计算巢服务,搜索Hermes Agent官方社区部署模板。模板内置操作系统、Python运行环境、全部依赖包以及基础配置,不需要手动编译源码。填写部署参数
- 服务名称:自定义,例如
Hermes‑Agent‑Dev; - 地域:优先网络延迟低的华北、华东地域;
- 实例规格:入门选择2核4G,复杂任务4核8G;
- 设置管理员登录密码,妥善保管,用于SSH远程登录;
- 安全组:模板会自动放行WebUI所需端口;
其余参数全部保持默认。
确认订单,勾选服务协议,点击立即创建。系统自动创建云服务器、初始化环境、部署Hermes Agent,等待数分钟,实例状态变更为部署完成。
- 远程登录实例,验证Hermes Agent安装状态
在实例详情页,使用Workbench远程连接,输入管理员密码进入终端,执行下面命令:
能够正常进入TUI交互终端,就说明基础部署完成,输入#切换root用户 sudo su root #查看Hermes Agent版本,确认安装成功 hermes --version #进入Hermes交互终端,测试基础启动 hermesexit退出交互界面,继续后续模型对接配置。
四、百炼两套订阅计划开通与API密钥获取
Coding Plan、Token Plan两套订阅定位完全不同,根据业务场景选择。Coding Plan按照请求次数计费,更加适合代码生成、脚本调试、编程助手;Token Plan按照Credits折算Token消耗,适配通用问答、长文档解析、多模态图像视频推理。两套订阅的API‑Key、BaseURL完全隔离,不能互相混用。
4.1 Coding Plan订阅与密钥获取
- 在百炼控制台,计费管理栏目进入Coding Plan订阅页面,选择对应套餐档位完成支付;
- 进入API密钥管理,创建套餐专属API‑Key,格式一般为
sk‑sp‑xxxx; - 记录Coding Plan兼容OpenAI协议BaseURL:
https://coding.dashscope.aliyuncs.com/v1。
重要提醒:Coding Plan套餐密钥仅限交互式编程场景,禁止用于后端大规模自动化批量调用,违规使用会造成API‑Key被封禁。
4.2 Token Plan订阅与密钥获取
- 计费管理进入Token Plan订阅页面,选择个人或者团队版,选择档位完成订阅;
- 团队版订阅需要先分配账号席位,之后才可以生成专属API‑Key;
- 记录Token Plan兼容接口BaseURL:
https://token‑plan.cn‑beijing.maas.aliyuncs.com/compatible‑mode/v1。
五、Hermes Agent对接百炼Coding Plan、Token Plan配置
部署完成之后,修改Hermes Agent的models.yaml配置文件,接入两套订阅的模型服务,两套方案可以同时共存,业务中按需切换模型。
远程登录服务器,进入配置目录
sudo su root cd ~/.hermes ls目录内可以找到核心模型配置文件
models.yaml。配置Coding Plan,面向代码开发场景
编辑models.yaml,新增bailian_coding提供商配置:models: mode: merge providers: bailian_coding: baseUrl: "https://coding.dashscope.aliyuncs.com/v1" apiKey: "sk-sp-xxxxxxxxxxxxxxxxxxxxxxxx" models: - qwen-coder-turbo - qwen-turbo timeout: 30配置Token Plan,面向通用AI、多模态场景
在providers节点同级位置,继续添加Token Plan配置,和coding配置并列:bailian_token: baseUrl: "https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1" apiKey: "sk-sp-xxxxxxxxxxxxxxxxxxxxxxxx" models: - qwen-max - qwen-long timeout: 30修改顶层
config.yaml,设置默认模型和调用优先级default_model: qwen-coder-turbo model_priority: - bailian_coding - bailian_token重载配置,使全部修改生效
hermes config reload
安全优化建议:不要直接把密钥明文写进配置文件,优先使用环境变量保存密钥。设置环境变量命令示例:
#当前会话临时生效 export DASHSCOPE_API_KEY_CODING="sk‑sp‑xxxxxx" export DASHSCOPE_API_KEY_TOKEN="sk‑sp‑xxxxxx" #写入bashrc永久保存环境变量 echo "export DASHSCOPE_API_KEY_CODING=sk‑sp‑xxxxxx" >> ~/.bashrc echo "export DASHSCOPE_API_KEY_TOKEN=sk‑sp‑xxxxxx" >> ~/.bashrc source ~/.bashrc配置文件中apiKey字段改为
{"source":"env","id":"DASHSCOPE_API_KEY_CODING"},从系统环境变量读取密钥,避免配置文件泄露造成额度被盗刷。
六、功能验证、WebUI与消息网关配置
配置修改重载完毕,需要验证模型调用是否正常,同时可以开启Web可视化界面、第三方消息网关。
进入Hermes Agent交互终端,做模型调用验证
hermes #测试Coding Plan代码生成能力 请写一个Python快速排序算法,附带注释 #测试Token Plan通用问答能力 请简单介绍Hermes Agent智能体框架的核心特性模型可以正常返回输出,说明订阅套餐对接成功。输入
exit退出交互模式。启动WebUI可视化管理界面
hermes webui start --port 8080浏览器访问
http://服务器公网IP:8080,就可以打开Web管理界面,管理会话、技能、切换模型。开启第三方消息网关(可选)
Hermes Agent支持对接多款IM消息网关,示例开启telegram网关:hermes gateway start --provider telegram设置服务开机自启,服务器重启之后自动运行
systemctl enable hermes-agent #查看开机自启状态,输出enabled代表配置成功 systemctl is-enabled hermes-agent
七、高频故障排查避坑指南
部署失败提示资源不足
更换资源充足的地域,实例规格最低2核4G;检查账户余额是否充足。调用模型返回鉴权报错
确认API‑Key是对应订阅套餐生成,Coding Plan密钥不能给Token Plan使用;核对BaseURL地址;RAM账号确认已经授予全套权限;复制密钥的时候不要带入多余空格换行符。Hermes Agent无法启动,提示依赖缺失
重新运行计算巢部署模板,或者手动补齐依赖包:pip install hermes-agent dashscope openai订阅套餐额度耗尽,调用直接失败
前往百炼订阅管理页面查看剩余Credits/请求次数,升级套餐档位,或者临时切换按量付费接口过渡。WebUI浏览器无法访问
确认安全组已经放行8080端口;执行systemctl status hermes‑agent确认后台服务处于running状态。重载配置之后效果没有变化
检查yaml配置文件语法,缩进、冒号格式错误会导致配置解析失败,修正配置再执行hermes config reload。Coding Plan被封禁API‑Key
Coding Plan仅限交互式使用,不要用于脚本批量循环调用;出现封禁,重置API‑Key,调整调用业务逻辑。
八、选型总结
Hermes Agent主打自我进化、自动生成技能、多层持久记忆,适合复杂多步骤任务、资料搜集、研究型工作。部署有轻量预装镜像、计算巢模板两套路径,零基础优先轻量预装镜像,追求自定义、二次开发选择计算巢模板。
Coding Plan适配代码脚本、编程助手,按请求次数计费;Token Plan适配通用问答、长文档、多模态任务,按Credits消耗计费。两套订阅可以同时配置到Hermes Agent,根据业务需求随时切换模型。
整套落地关键要点:区分两套订阅的API‑Key与BaseURL、完整授予RAM权限、yaml配置文件语法校验、做好密钥安全防护,定期监控订阅套餐剩余额度。部署完成之后,持续观察Agent运行日志,根据实际业务负载升级服务器配置,就可以拥有一套具备自我学习进化能力的私有化AI智能体。