在AI智能体开发与部署领域,Hermes Agent凭借自主进化、多场景适配的特性,成为开发者与企业构建专属AI助手的热门选择。阿里云计算巢提供一键式部署能力,可快速完成Hermes Agent的环境搭建与服务启动,而阿里云百炼的Coding Plan与Token Plan则为其提供稳定、高性价比的大模型推理能力。本文将从部署前准备、计算巢一键部署、百炼Coding Plan/Token Plan开通与API Key获取、Hermes Agent配置对接、功能验证与优化等环节,提供保姆级全流程实操指南,帮助用户快速完成从部署到可用的全链路配置。
一、部署前准备:账号、服务与权限配置
在开始部署前,需完成阿里云账号、百炼服务、计算巢权限的基础配置,确保后续流程无阻碍。
- 阿里云账号注册与实名认证
- 访问阿里云官网,完成手机号注册与登录,未实名认证账号无法使用计算巢与百炼服务。
- 推荐通过支付宝授权完成实名认证,10秒内即可完成,确保账号具备云资源使用权限。
- 为账号充值,按量付费模式下账户余额需≥100元,避免部署过程中因余额不足导致服务中断。
- 开通阿里云百炼服务
- 登录阿里云控制台,搜索“百炼”进入大模型服务平台,点击“立即开通”完成服务激活,开通无需额外费用。
- 百炼平台内置通义千问系列、代码专用模型等,可作为Hermes Agent的核心推理引擎。
- RAM子账号授权(可选)
- 若使用子账号操作,需主账号在RAM控制台授予
AliyunBSSFullAccess、AliyunComputeNestUserFullAccess、AliyunDashScopeFullAccess权限,确保子账号具备计算巢部署与百炼API调用权限。
- 若使用子账号操作,需主账号在RAM控制台授予
零基础部署AI Agent:OpenClaw/Hermes Agent喂饭级步骤流程
第一步:👉点击打开访问阿里云OpenClaw/Hermes Agent一键部署专题页面。








👉访问订阅阿里云百炼Token Plan AI大模型服务 。支持多模型切换,用于多模态模型灵活调用,实现多模型、多工具、多场景下的额度共享与统一管理,兼顾灵活性、稳定性与安全性,大幅降低企业使用大模型的门槛与成本。




第二步:👉打开选择阿里云轻量应用服务器,配置参考如下:
- 镜像:OpenClaw(或Hermes Agent)镜像(已经购买服务器的用户可以重置系统重新选择镜像)
- 实例:内存必须2GiB及以上。
- 地域:默认美国(弗吉尼亚),目前中国内地域(除香港)的轻量应用服务器,联网搜索功能受限。
- 时长:根据自己的需求及预算选择。



第三步:打开访问阿里云百炼大模型控制台,找到密钥管理,单击创建API-Key。

前往轻量应用服务器控制台,找到安装好OpenClaw的实例,进入「应用详情」放行18789端口、配置百炼API-Key、执行命令,生成访问OpenClaw的Token。
- 端口放通:需要放通对应端口的防火墙,单击一键放通即可。
- 配置百炼API-Key,单击一键配置,输入百炼的API-Key。单击执行命令,写入API-Key。
- 配置OpenClaw/Hermes:单击执行命令,生成访问OpenClaw/Hermes的Token。
- 访问控制页面:单击打开网站页面可进入OpenClaw/Hermes对话页面。
阿里云百炼Coding Plan API-Key 获取、配置保姆级教程:
创建API-Key,推荐访问订阅阿里云百炼Coding Plan,阿里云百炼Coding Plan每天两场抢购活动,从按tokens计费升级为按次收费,可以进一步节省费用!
- 购买后,在控制台生成API Key。注:这里复制并保存好你的API Key,后面要用。

- 回到轻量应用服务器-控制台,单击服务器卡片中的实例 ID,进入服务器概览页。

- 在服务器概览页面单击应用详情页签,进入服务器详情页面。

- 端口放通在OpenClaw使用步骤区域中,单击端口放通下的执行命令,可开放获取OpenClaw 服务运行端口的防火墙。

- 这里系统会列出我们第一步中创建的阿里云百炼 Coding Plan的API Key,直接选择就可以。

- 获取访问地址单击访问 Web UI 面板下的执行命令,获取 OpenClaw WebUI 的地址。


二、阿里云计算巢一键部署Hermes Agent
计算巢将服务器创建、环境配置、依赖安装封装为自动化流程,仅需填写参数即可完成部署,全程5-10分钟。
- 进入计算巢Hermes Agent部署模板
- 登录阿里云控制台,进入计算巢服务目录,搜索“Hermes Agent”,选择官方社区版部署模板。
- 该模板由阿里云官方适配,内置完整运行环境、依赖包与基础配置,无需二次修改。
- 配置部署参数
- 服务名称:自定义,如“Hermes-Agent-Prod”。
- 地域选择:推荐华北2(北京)、华东1(杭州),网络延迟低、资源充足。
- 实例规格:入门选2核4G(轻量应用服务器/ECS),企业级选4核8G,AI推理场景可选GPU实例。
- 登录凭证:设置管理员密码,妥善保存用于后续远程连接。
- 其他参数:保持默认配置,系统自动完成安全组端口放行、服务自启动配置。
- 提交部署并等待完成
- 确认参数无误后,点击“下一步:确认订单”,勾选服务协议,点击“立即创建”。
- 系统自动创建云服务器、初始化环境、安装Hermes Agent,部署时长约3-5分钟,可在服务实例详情页查看进度。
- 状态显示“部署完成、运行正常”后,即可进行后续配置。
- 远程连接实例
- 在计算巢服务实例详情页,找到对应ECS实例,点击“远程连接”,选择Workbench方式登录。
- 输入设置的管理员密码,进入服务器终端,执行以下命令验证Hermes Agent安装:
# 切换至root用户 sudo su root # 查看Hermes Agent版本 hermes --version # 启动Hermes Agent交互模式 hermes - 若成功启动并进入TUI交互界面,代表基础部署完成。
三、阿里云百炼Coding Plan/Token Plan开通与API Key获取
Hermes Agent需通过百炼API调用大模型,Coding Plan适合代码开发场景,Token Plan适合通用AI推理,二者需分别开通并获取专属API Key。
(一)开通百炼Coding Plan
- 订阅Coding Plan套餐
- 进入百炼控制台,左侧导航栏选择“计费管理→Coding Plan”,进入订阅页面。
- 选择适合的套餐档位(基础版/专业版/企业版),确认计费规则后完成支付。
- 主账号可直接订阅,子账号需主账号完成权限授权后操作。
- 获取Coding Plan专属API Key与Base URL
- 订阅成功后,在Coding Plan页面点击“API密钥管理”,点击“创建API Key”。
- 选择归属业务空间,权限设为“全部”,点击确定生成专属API Key(格式为
sk-sp-xxxxxx)。 - 记录Coding Plan专属Base URL:
https://coding.dashscope.aliyuncs.com/v1(OpenAI兼容协议)。 - 注意:Coding Plan API Key与按量付费、Token Plan的Key完全隔离,不可混用。
(二)开通百炼Token Plan
- 订阅Token Plan套餐
- 进入百炼控制台,左侧导航栏选择“计费管理→Token Plan”,进入团队版订阅页面。
- 选择Token额度档位与订阅周期,完成支付,系统自动分配专属Token额度。
- 子账号需主账号授予
AliyunTokenPlanFullAccess权限后订阅。
- 获取Token Plan专属API Key与Base URL
- 在Token Plan控制台“成员管理”页面,为账号分配席位,点击“生成API Key”。
- 生成专属API Key(
sk-sp-xxxxxx),仅创建时完整显示,需立即复制保存。 - 记录Token Plan专属Base URL(OpenAI兼容):
https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1。
四、Hermes Agent对接百炼Coding Plan/Token Plan配置
部署完成后,需在Hermes Agent中配置百炼API信息,实现模型调用对接,支持Coding Plan与Token Plan双方案配置。
- 进入Hermes Agent配置目录
- 远程连接ECS实例,执行以下命令进入配置文件目录:
# 切换至root用户 sudo su root # 进入Hermes Agent配置目录 cd ~/.hermes # 查看配置文件列表 ls
- 远程连接ECS实例,执行以下命令进入配置文件目录:
- 配置百炼Coding Plan(代码开发场景)
- 编辑模型配置文件
models.yaml,添加百炼Coding Plan配置:models: mode: merge providers: bailian_coding: baseUrl: https://coding.dashscope.aliyuncs.com/v1 apiKey: sk-sp-xxxxxxxxxxxxxxxxxxxxxxxx # 替换为Coding Plan专属API Key models: - qwen-coder-turbo # 代码专用模型 - qwen-turbo timeout: 30 - 保存文件并退出,执行命令重载配置:
hermes config reload
- 编辑模型配置文件
- 配置百炼Token Plan(通用AI场景)
- 编辑
models.yaml,添加百炼Token Plan配置(可与Coding Plan共存):models: mode: merge providers: bailian_token: baseUrl: https://token-plan.cn-beijing.maas.aliyuncs.com/compatible-mode/v1 apiKey: sk-sp-xxxxxxxxxxxxxxxxxxxxxxxx # 替换为Token Plan专属API Key models: - qwen-max - qwen-long timeout: 30 - 保存并重载配置,实现双Plan同时可用。
- 编辑
- 配置默认模型与优先级
- 编辑
config.yaml,设置默认调用的百炼模型与Plan优先级:default_model: qwen-coder-turbo # Coding Plan优先时设置 # default_model: qwen-max # Token Plan优先时设置 model_priority: - bailian_coding - bailian_token - 重载配置后,Hermes Agent将按优先级调用对应Plan的模型。
- 编辑
五、功能验证与优化:确保服务稳定可用
配置完成后,需验证模型调用功能,并进行性能与安全优化。
- 模型调用验证
- 启动Hermes Agent交互模式,发送测试指令:
# 启动交互 hermes # 测试Coding Plan代码生成 请生成一个Python快速排序算法 # 测试Token Plan通用问答 请介绍阿里云百炼的核心功能 - 若成功返回结果,代表Coding Plan/Token Plan对接成功。
- 启动Hermes Agent交互模式,发送测试指令:
- 开启WebUI与消息网关(可选)
- 执行命令启动WebUI,通过浏览器访问管理界面:
hermes webui start --port 8080 - 开启Telegram/Discord/飞书等消息网关,实现多平台交互:
hermes gateway start --provider telegram
- 执行命令启动WebUI,通过浏览器访问管理界面:
- 安全与性能优化
- 配置API Key环境变量,避免明文存储:
# 临时设置(会话有效) export DASHSCOPE_API_KEY_CODING=sk-sp-xxxxxx export DASHSCOPE_API_KEY_TOKEN=sk-sp-xxxxxx # 永久设置(写入环境变量文件) echo "export DASHSCOPE_API_KEY_CODING=sk-sp-xxxxxx" >> ~/.bashrc echo "export DASHSCOPE_API_KEY_TOKEN=sk-sp-xxxxxx" >> ~/.bashrc source ~/.bashrc - 调整实例规格,高并发场景升级至4核16G,AI推理场景切换至GPU实例。
- 配置安全组,仅放行必要端口(8080、18789),限制IP访问白名单。
- 配置API Key环境变量,避免明文存储:
六、常见问题与避坑指南
- 部署失败:资源不足
- 解决方案:切换至华北2、华东1等资源充足地域,或调整实例规格为推荐配置。
- 模型调用失败:API Key错误
- 解决方案:确认使用Coding Plan/Token Plan专属API Key,而非按量付费Key,检查Base URL是否正确。
- Hermes Agent无法启动:依赖缺失
- 解决方案:重新执行部署模板,或手动安装依赖:
pip install hermes-agent dashscope openai
- 解决方案:重新执行部署模板,或手动安装依赖:
- Token Plan额度不足
- 解决方案:在百炼Token Plan控制台升级套餐档位,或切换至按量付费模式。
七、总结与选型建议
阿里云计算巢部署Hermes Agent,搭配百炼Coding Plan/Token Plan,实现了AI智能体从部署到推理的全链路自动化,大幅降低开发与运维成本。Coding Plan适合代码开发、编程助手场景,固定月费、调用次数计量;Token Plan适合通用AI推理、智能问答场景,按Token消耗计费,灵活适配不同业务需求。
个人开发者与小型团队可选择轻量应用服务器+Token Plan入门,企业级用户可选择ECS高规格实例+Coding Plan/Token Plan组合,满足大规模AI应用部署需求。通过本文的全流程配置,可快速拥有一个自主进化、多场景适配的专属AI智能体,释放AI生产力。