机器学习平台PAI支持抢占型实例,模型服务最高降本90%

本文涉及的产品
模型训练 PAI-DLC,100CU*H 3个月
交互式建模 PAI-DSW,每月250计算时 3个月
模型在线服务 PAI-EAS,A10/V100等 500元 1个月
简介: 助力模型推理服务降本增效,适用于推理成本敏感场景,如:AIGC内容生成异步推理、批量图像处理、批量音视频处理等。

在AI开发及服务不断追求效率的背景下,阿里云机器学习平台 PAI 宣布支持抢占型实例(Spot Instance)。在模型推理环节,用户可以通过 PAI-EAS 模型在线服务平台灵活选择抢占型实例来运行推理时延相对不敏感的任务,进而节省服务成本,同等机型的抢占型实例与按量付费实例相比,最高可实现90%的成本优化

1. 什么是抢占型实例

抢占型实例(Spot Instance)是计算资源的一种购买方式。与传统的包年包月实例、按量付费实例不同,抢占型实例的售价跟随市场需求与库存的供需关系实时浮动。PAI-EAS 抢占型实例基于公共资源组内空闲的计算资源提供服务,可以为用户提供低价资源,价格最低可至按量付费实例的10%。各类实例购买方式的单价比较为:

  • 无保护抢占型实例 < 有保护抢占型实例 < 预付费实例 < 按量付费实例


用户在使用 PAI-EAS 抢占型实例前,首先需要设置出价上限,并选定是否设置1小时保护期。当成功部署服务时,PAI-EAS 会自动竞价抢占相应资源。

  • 购买抢占型实例:
  • 当实例库存充足且用户配置的出价上限不低于当前抢占型实例市场价,则成功抢占资源。
  • 使用抢占型实例:
  • 若用户设置1小时保护期,购买抢占型实例成功后,默认至少保障使用1小时该实例资源。在1小时保护期内,若实例市场价超出用户设定的出价上限,仍将按照出价上限计费。超过1小时后,当出现实例库存不足或出价上限低于市场价的情况,实例会立刻释放。
  • 若用户未设置1小时保护期,购买抢占型实例成功后,当出现实例库存不足或出价上限低于市场价的情况,实例会立刻释放。
  • 多实例部署
  • 在使用抢占型实例部署服务时,若只指定单一规格的计算资源,会出现由于出价不高或库存不足导致服务长时间无法拉起的情况;或者因spot价格上浮导致资源释放,从而造成服务处于pending。针对该问题,PAI-EAS 部署环节支持多规格实例选择通过遍历服务资源配置中的规格列表来拉起资源,从而极大降低因抢占型实例释放带来的部署风险,保证服务的稳定运行


通过这张图对 PAI-EAS 抢占型实例(Spot Instance)的计价规则进行简要示意。如图所示,该实例按量付费实例价格为13.98元/小时,用户的出价上限为5元/小时并设置了1小时保护期。通过抢占型实例,用户得以以较低的价格使用计算资源。

1.png

(注:以 2023年4月23日 PAI-EAS 公共资源组抢占型实例价格进行示例,机型为8vCPU+30GB+1*A10)

2. PAI-EAS 抢占型实例适用场景

PAI-EAS 抢占型实例(Spot Instance)适用于对价格非常敏感、但对推理服务实时性及稳定性相对不敏感的场景,如:

  • AIGC内容生成的异步推理场景
  • 图像识别、OCR等批量后处理的图像分析
  • 视频分割、视频分类等批量后处理的视频分析
  • 语音分割、语音转文字等异步推理或批量推理的的语音分析
  • Stable Diffusion等AI绘画的异步批量处理场景

当用户不需要实时拿到推理返回的结果,而是可以接受一段时间(例如1小时内)的延迟,这些情况就适合采用抢占型实例优化服务成本。


在实际业务场景中,您可以先购买一定量的预付费资源作为保底资源,保障服务可以顺利运行;而对于弹性部分,可以根据业务场景搭配使用不同机型的抢占型实例,并通过 PAI-EAS 提供的自动弹性伸缩功能来自动扩缩抢占型实例,当因价格原因无法通过抢占型实例扩容时,PAI-EAS 也提供多规格实例选择让用户使用普通按量付费实例进行扩容,从而以较低的组合成本保障服务稳定运行。

3. 如何配置使用 PAI-EAS 抢占型实例

(1) 进入 PAI-EAS 控制台,点击“部署服务”,进入详细配置界面;

(2) 在 “资源部署信息”区块,“资源组种类”勾选“公共资源组”,“资源配置方法”切换至“高级资源配置”,即可配置模型服务部署的抢占型实例资源(spot instance);

2.png

(3) 选择抢占型实例的保留时长:

  • 设置1小时保护期:部署成功后,默认至少可以使用1小时,即抢占成功后有1小时的保护期,保护期内可以保障您可以使用资源。超过1小时的保护期后,如抢占式资源实例库存充足,且您之前设置出价上限不低于当前抢占式实例市场价,您也可以继续使用抢占式实例。
  • 无确定保护期:不保证有固定时长的保护期来保障资源使用。如抢占式资源实例库存充足,且您设置出价上限不低于当前抢占式实例市场价,您也可以继续使用抢占式实例。价格上也会比有1小时保护器的更便宜。

(4)选择机器型号。可以看到当前该机型抢占型的价格和原价的对比,从而进行出价。当抢占型资源的价格低于出价且库存充足时,您可以一直保有该机型的使用。

  • 点击“+”新增实例规格,服务上线后 PAI-EAS 会通过遍历服务资源配置中的规格列表来拉起资源,降低因抢占型实例释放带来的风险。

(5) 完成其他配置后,点击“部署”按钮即可上线服务。

4. 参考文档

相关实践学习
使用PAI-EAS一键部署ChatGLM及LangChain应用
本场景中主要介绍如何使用模型在线服务(PAI-EAS)部署ChatGLM的AI-Web应用以及启动WebUI进行模型推理,并通过LangChain集成自己的业务数据。
机器学习概览及常见算法
机器学习(Machine Learning, ML)是人工智能的核心,专门研究计算机怎样模拟或实现人类的学习行为,以获取新的知识或技能,重新组织已有的知识结构使之不断改善自身的性能,它是使计算机具有智能的根本途径,其应用遍及人工智能的各个领域。 本课程将带你入门机器学习,掌握机器学习的概念和常用的算法。
相关文章
|
机器学习/深度学习 JSON 运维
如何在 PAI-EAS 定时自动部署模型服务|学习笔记
快速学习如何在 PAI-EAS 定时自动部署模型服务。
236 0
如何在 PAI-EAS 定时自动部署模型服务|学习笔记
|
8月前
|
机器学习/深度学习 存储 搜索推荐
利用机器学习算法改善电商推荐系统的效率
电商行业日益竞争激烈,提升用户体验成为关键。本文将探讨如何利用机器学习算法优化电商推荐系统,通过分析用户行为数据和商品信息,实现个性化推荐,从而提高推荐效率和准确性。
259 14
|
8月前
|
机器学习/深度学习 算法 数据可视化
实现机器学习算法时,特征选择是非常重要的一步,你有哪些推荐的方法?
实现机器学习算法时,特征选择是非常重要的一步,你有哪些推荐的方法?
143 1
|
8月前
|
机器学习/深度学习 算法 搜索推荐
Machine Learning机器学习之决策树算法 Decision Tree(附Python代码)
Machine Learning机器学习之决策树算法 Decision Tree(附Python代码)
|
8月前
|
机器学习/深度学习 数据采集 算法
解码癌症预测的密码:可解释性机器学习算法SHAP揭示XGBoost模型的预测机制
解码癌症预测的密码:可解释性机器学习算法SHAP揭示XGBoost模型的预测机制
365 0
|
8月前
|
机器学习/深度学习 数据采集 监控
机器学习-特征选择:如何使用递归特征消除算法自动筛选出最优特征?
机器学习-特征选择:如何使用递归特征消除算法自动筛选出最优特征?
1036 0
|
8月前
|
机器学习/深度学习 人工智能 算法
探索机器学习中的支持向量机(SVM)算法
【2月更文挑战第20天】 在数据科学与人工智能的领域中,支持向量机(SVM)是一种强大的监督学习算法,它基于统计学习理论中的VC维理论和结构风险最小化原理。本文将深入探讨SVM的核心概念、工作原理以及实际应用案例。我们将透过算法的数学原理,揭示如何利用SVM进行有效的数据分类与回归分析,并讨论其在处理非线性问题时的优势。通过本文,读者将对SVM有更深层次的理解,并能够在实践中应用这一算法解决复杂的数据问题。
106 0
|
8月前
|
机器学习/深度学习 分布式计算 算法
大模型开发:你如何确定使用哪种机器学习算法?
在大型机器学习模型开发中,选择算法是关键。首先,明确问题类型(如回归、分类、聚类等)。其次,考虑数据规模、特征数量和类型、分布和结构,以判断适合的算法。再者,评估性能要求(准确性、速度、可解释性)和资源限制(计算资源、内存)。同时,利用领域知识和正则化来选择模型。最后,通过实验验证和模型比较进行优化。此过程涉及迭代和业务需求的技术权衡。
133 2
|
8月前
|
机器学习/深度学习 数据采集 存储
使用机器学习算法进行文本分类的方法与实践
本文将介绍使用机器学习算法进行文本分类的方法与实践。通过分析文本特征、选择合适的机器学习算法和构建有效的训练模型,可以实现准确和高效的文本分类任务。我们还将探讨如何处理文本数据预处理、特征提取和模型评估等方面的关键问题,以帮助读者更好地应用机器学习技术解决文本分类挑战。
|
8月前
|
机器学习/深度学习 人工智能 算法
利用Python实现简单的机器学习算法——线性回归
本文介绍了如何使用Python语言和相关库,通过实现线性回归算法来进行简单的机器学习模型训练和预测。通过详细的代码示例和解释,帮助读者了解机器学习中的基础概念和实践操作。

热门文章

最新文章

相关产品

  • 人工智能平台 PAI