云原生社区 > 容器服务 > 正文

首批!阿里云容器服务 ACK 顺利通过信通院云原生混部项目评估

简介: 云原生混部解决方案依托容器、微服务、编排调度等云原生技术,可以帮助用户将业务应用与大数据分析、人工智能计算等不同类型和不同优先级的应用混合部署到共享的基础设施上,提高资源利用率,实现“降本增效”。
+关注继续查看

作者:OSCAR


为了分享过去一年云原生产业联盟(CNIA)在标准建设、评估认证、技术研究、实践合作等方面的工作成果、探索行业最新趋势动态,云原生产业联盟于 2023 年 1 月举办了 2022 年度线上年会,并发布了“云原生混部”首批评测结果,阿里云容器服务ACK顺利通过首批“云原生混部”项目评估。


云原生混部解决方案依托容器、微服务、编排调度等云原生技术,可以帮助用户将业务应用与大数据分析、人工智能计算等不同类型和不同优先级的应用混合部署到共享的基础设施上,提高资源利用率,实现“降本增效”。


1.png


中国信通院联合阿里云等企业单位,经过多轮研讨,形成了《云原生混部技术能力要求》标准。标准内容涉及基础设施能力要求、平台混部能力要求、业务应用能力要求,以及混部效果评价共四个部分,具体从资源隔离、资源复用、干扰检测、负载反馈、任务调度、资源预测、应用服务质量等不同维度,对混部产品及解决方案进行全面评估。


2.png


阿里云容器服务 Kubernetes 版(Alibaba Cloud Container Service for Kubernetes,简称容器服务ACK)是全球首批通过 Kubernetes 一致性认证的服务平台,提供高性能的容器应用管理服务,支持企业级 Kubernetes 容器化应用的生命周期管理。

阿里巴巴早在 2016 年就启动了云原生混部技术研发,历经多轮技术架构升级、多年双11锤炼,目前已实现全业务规模超千万核的云原生混部,日常 CPU 利用率在 50% 左右。ACK 在“公共云”和“专有云”场景下提供不同的产品形态,可以让各行业的用户轻松高效地在云端运行 Kubernetes 容器化应用。在 ACK 产品中,一个重要理念是支持多种工作负载同时运行在一个集群中,通过弹性和混部技术满足各类工作负载的资源效率、稳定性和成本优化诉求。


3.png


针对不同类型工作负载混部场景,ACK 提供了一套完整的混部调度增强的能力,主要包含三个部分:


  • 任务调度
  • 差异化 SLO
  • QoS 感知调度、重调度


任务调度,主要解决工作负载运行在 Kubernetes 之上的问题。ACK 针对微服务、大数据任务、AI 任务类型的负载提供了非常丰富的调度扩展,解决负载之间资源精细化的隔离与共享,具体包括:


  • 延迟敏感服务的调优、CPU 绑核、CPU burst、Memory QoS 等
  • 弹性额度控制,支持任务类型典型的弹性资源调度(min/max 模型)
  • 任务协同调度,AllorNothing
  • 异构设备的拓扑感知,GPU share,NvLink拓扑感知等


4.png


差异化 SLO,主要提供一套提供部署密度和整体资源利用率的资源模型,用于支持资源调度的 overcommit。ACK 提供了在阿里内部被广泛验证使用的差异化 SLO 技术能力,支持用户在 Kubernetes 之上以资源超卖的方式运行混部任务,进一步提高资源利用率。其核心的包含两部分内容:


  • 资源分级调度,根据 Pod 真实负载运行情况进行资源画像,并将模型预估可用的资源进行二次分配,以满足具备容灾能力的计算任务的资源诉求
  • 资源隔离与干扰抑制,对于二次分配的任务,提供 CPU、Memory、Disk、Network 多个维度配套的资源隔离保障机制,将计算任务对原延迟敏感任务的干扰控制在非常小的范围


5.png


QoS 感知调度、重调度,主要解决高水位状态下工作负载对运行质量的敏感的问题。ACK 提供了一套增强的负载感知调度与重调度框架:


  • 负载感知调度,在调度打分阶段引入对于节点运行时状态的判断,避免节点负载过高导致机器出现热点响应慢等影响稳定性的问题
  • 重调度,提供了具备资源确定性、腾挪安全保护的重调度器,支持用户在特定时间段执行设定的重调度策略,持续的调整集群资源编排以达到理想状态


6.png


基于 ACK 上提供的混部解决方案,阿里云于 2022 年 4 月正式开源 Koordinator 项目,帮助企业更快速获取云原生混部带来的资源效率红利,实现公共云、混合云一致的云原生混部架构,降低系统运维成本,保持长期可持续发展的健康形态。


随着企业数字化转型工作深入推进,精细化的资源管理、跨集群跨地域资源协同、灵活快捷的资源编排调度,以及异构资源共享复用等能力,正在帮助企业实现更加灵活的弹性资源供给、更加智能的应用自动部署,以及更大规模节点的算力协同。


自 2022 年 4 月开源以来,Koordinator 已在阿里自研业务、小红书、爱奇艺、360、趣丸网络等企业生产系统中得到应用,得到来自业界十几个企业优秀工程师的贡献。


后续,阿里云云原生团队将持续在云原生混部方向的投入,推进更多的负载类型融入 Koordinator 生态,不断丰富容器服务 ACK 任务混部解决方案,帮助企业取得更好的资源运行效率。同时,持续参与到中国信通院开展的“云原生混部”相关评估和研究工作中,助力混部技术发展和行业创新应用。欢迎大家加入 Koordinator 社区钉钉群,共同推进混部的标准化进程。


7.png

钉钉扫码


点击此处,快速了解如何使用 ack-koordinator 搭建在离线混部环境

版权声明:本文内容由阿里云实名注册用户自发贡献,版权归原作者所有,阿里云开发者社区不拥有其著作权,亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容,填写侵权投诉表单进行举报,一经查实,本社区将立刻删除涉嫌侵权内容。

相关文章
阿里云加入“一云多芯”应用创新计划,首批通过金融专有云能力评估
阿里云亮相首届算云融合产业大会,加入由中国信通院云大所牵头发起的“一云多芯”应用创新计划,并首批获得中国信通院“金融专有云能力综合水平评估”检验证书,携手行业推动算力时代下云服务的创新发展。
209 0
阿里云马小婷:ECS使用成熟度评估与洞察(Insight)分享
2022年3月22日,【全新升级 阿里云ECS CloudOps 2.0来啦!】发布会正式播出,本次发布会上阿里云宣布CloudOps(云上自动化运维)套件全新升级,并发布了CloudOps云上自动化运维白皮书2.0版本。
318 0
阿里云首家通过《可信云·云成本优化工具能力要求》评估
2022年5月19日,由中国信息通信研究院(以下简称“中国信通院”)和中国通信标准化协会联合主办的“2022云管和云网大会”通过线上直播的形式成功召开。会上发布了《可信云•云成本优化工具能力要求 - 第1部分 原生工具》标准及首批评测结果。阿里云凭借在云上成本管理的产品能力,以满分的成绩通过了全部33个能力指标,成为国内首家通过该项评估的云服务商。 企业用云程度加深,云成本优化诉求日益迫切全球数字经济背景
152 0
阿里云入选 Forrester 2021 年第一季度 FaaS 平台评估报告
阿里云入选 Forrester 2021 年第一季度 FaaS 平台评估报告自制脑图
40 0
阿里云商标注册流程及费用(一键查询及风险评估)
阿里云商标注册分为智能注册申请、顾问注册和安心注册:顾问注册和安心注册会有阿里云商标顾问提供一对一服务,所以价格相对智能注册要贵一些,智能注册价格275元、商标顾问注册申请680元、商标安心注册申请1580元,安心注册比顾问注册多了一个不成功全额退款服务,所以安心注册费用相对更高一些。
141 0
2022年,阿里云基础产品通过了一系列权威评估和奖项认证
2022年,阿里云基础产品通过了一系列权威评估和奖项认证, 昨天在其他平台发现的,想发到阿里云平台上,感觉阿里云总是那么低调,我帮忙宣传宣传。
33 0
首批认证!阿里云E2 BizWorks产品通过中国信通院业务中台建设和运营能力评估认证!
8月12日,“2022数字化转型发展高峰论坛”在北京落下帷幕,主办单位为中国信息通信研究院、中国通信标准化协会。作为数字化转型领域的权威行业盛会,本届论坛给业界带来了一场数字化转型的思想盛宴、技术盛宴和成果盛宴。在本届峰会上,阿里云E2 BizWorks成为首批通过中国信通院业务中台建设与运营认证的产品。
748 0
阿里云首批通过中国信通院可信政务云安全能力评估
信通院公布了最新一批数字政府评估结果,阿里云专有云通过中国信通院首批可信政务云安全能力评估。
251 0
首评 | 阿里云顺利完成国内首个云原生安全成熟度评估
从互联网到零售、金融、制造、交通等,越来越多的行业在利用云原生技术解决实际业务问题。阿里云丰富的云原生安全产品家族保障了阿里巴巴自身的大规模云原生化实践,确保应用全生命周期的云原生安全。同时这些云原生安全能力也支撑了云上百万企业,从基础设施、云原生基础架构、云原生应用、云原生研发运营到云原生安全运维,提升了全链路的安全性及企业安全治理的效率,加速企业的云原生化架构升级,助力企业打造更安全可控、更先进智能的业务体系。
249 0
阿里云首家通过《可信云·云成本优化工具能力要求》评估,云原生企业 IT 成本治理方案助力企业 FinOps 落地
5 月 19 日,由中国信息通信研究院(以下简称“中国信通院”)和中国通信标准化协会联合主办的“2022 云管和云网大会”通过线上直播的形式成功召开。会上发布了《可信云•云成本优化工具能力要求 - 第1部分 原生工具》标准及首批评测结果。
320 0
阿里云首家通过《可信云·云成本优化工具能力要求》评估
阿里云首家通过《可信云·云成本优化工具能力要求》评估,阿里云FinOps云上成本管理,助力企业实现高效经济用云。
536 0
喜报!阿里云首个通过应用多活“先进级”能力评估
2022 年 4 月 26 日,由中国信通院主办的“稳保计划”——首届云系统稳定性大会”在京召开。会上,中国信通院公布了“应用多活架构能力”最新的评估成果,阿里云成为首个通过应用多活“先进级”能力评估的企业,并由中国信通院副院长魏亮、中国信通院云计算与大数据研究所所长何宝宏为阿里云颁发了证书。
228 0
最多高质量云主机可用区,阿里云多项产品服务通过信通院可信云评估
7月27-28日,由中国信息通信研究院、中国通信标准化协会联合主办的“2021可信云大会”盛大开幕,发布可信云完整评估体系及通过评估企业名单。
130 0
容器服务
+关注
国内唯一 Forrester 公共云容器平台领导者象限。
+关注
阿里云云原生小助手
技术工作者
文章
问答
视频
相关电子书
更多
阿里云认证的解析与实战-数据仓库ACP认证
立即下载
低代码开发师(初级)实战教程
立即下载
阿里巴巴DevOps 最佳实践手册
立即下载
相关实验场景
更多