阿里云 PAI-EAS 怎么部署?
版权声明:本文内容由阿里云实名注册用户自发贡献,版权归原作者所有,阿里云开发者社区不拥有其著作权,亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容,填写侵权投诉表单进行举报,一经查实,本社区将立刻删除涉嫌侵权内容。
本文由云服务器代理商:翼龙云yilongcloud撰写
前置准备:
登录阿里云国际控制台,切换新加坡 / 法兰克福业务地域
开通机器学习 PAI,一键授权服务角色,自动生成默认工作空间
进入目标工作空间 → 左侧【模型部署】→【模型在线服务 EAS】
步骤 1:进入 LLM 场景化部署
页面点击部署服务,选择【LLM 大语言模型部署】场景模板(零代码,自动填充环境)
步骤 2:选择公共开源模型
模型配置勾选公共模型,搜索 Qwen3-8B、Qwen3.8 等官方预训练权重,无需自行上传模型文件
步骤 3:核心参数最简配置(其余全部默认)
推理引擎:选 vLLM(兼容 OpenAI 接口,长文本推理提速)
部署模板:单机模板,系统自动匹配对应 GPU 实例规格
资源组:公共资源组(测试用);生产选抢占式实例降低成本
服务名称:自定义英文名称,地域内唯一
步骤 4:提交部署
确认参数后点击部署,等待 3–5 分钟启动实例
步骤 5:调用验证
服务状态变为运行中即部署完成:
复制服务公网调用地址、鉴权 Token
用 Postman / 代码发送 POST 请求测试对话推理
控制台查看监控、推理日志排查报错
低成本运维极简操作
弹性扩缩容:服务详情页调整最小 / 最大实例数,大促自动扩容、闲时缩容
服务关停:测试完成直接停止服务,停止后不再产生算力费用
日志排查:推理报错在服务日志查看 CUDA 显存、文件路径、接口异常