TCL 拥抱云原生,实现 IT 成本治理优化

简介: TCL 拥抱云原生,实现 IT 成本治理优化

作者:行疾


TCL 工程师团队基于阿里云企业云原生 IT 成本治理方案沉淀了一套成熟的 IT 企业成本治理流程与系统,通过阿里云容器服务提供的开箱即用的成本洞察、资源智能画像等功能,进行业务成本拆分、闲置资源可视化发现,并制定弹性伸缩与混部等优化策略,为集团优化了 10% 闲置的资源, 各类业务降低了 30% 的配额, 每年节省近百万的 IT 成本投入。


客户简介

image.png

TCL 创立于 1981 年,总部设于中国广东省惠州市,目前已形成 TCL 实业和 TCL 科技两大主体,布局智能终端、半导体显示、新能源光伏三大核心产业,成长为一家具有全球竞争力的智能科技产业集团。TCL 目前拥有 13 万名员工,在全球布局 43 个研发中心和 32 个制造基地,业务遍及 160 多个国家和地区,全球累计服务用户超 9.6 亿。


客户痛点


整体资源利用率较低,成本洞察粒度不足,无法驱动策略优化。在早期上云的过程中,TCL 通过给不同的事业部分配独立云账号的方式,实现成本单元的规划与核算。但是当工程师团队希望去洞察整体的资源使用、浪费情况的时候,单纯从服务器等云资源的利用率情况来衡量业务的容量规划浪费情况是不够合理的。因为从单个业务的视角,容量规划需要根据业务的峰值情况来规划。


业务高速发展,传统容量规划的周期无法满足, 影响业务使用。TCL 上云的过程经历了上云迁移期、业务增长期、业务稳定期等多个阶段,在上云迁移期和业务增长期中,发现传统按照月度、 季度甚至是年度的 IT 成本治理的周期,无法跟上业务增长的速度,造成很多业务处于无资源可用 或者超预算使用的情况。


临时作业 / 突发任务等短周期作业较多,对容量规划带来巨大挑战。TCL 压测平台是一个被重点关注的业务, 因为压测任务具有短时间、大规模、低成本的的要求,是传统企业 IT 成本管理中最难以处理和解决的资源类型,但也是上云按需使用的最佳场景。


业务容量、 成本预估困难, 缺少数字化指标支撑降本增效。在 TCL 工程师团队定下降本增效的目标后,如何数字化衡量和评估应用的容量和成本情况,成为了最大的挑战。只有当一个应用的资源成本画像可以被准确绘制的时候,才能够有针对性的建立优化策略。


方案亮点

image.png

△ 阿里云云原生企业 IT 成本治理方案


洞察资源使用量, 调控周期性业务成本, 提高集群利用率。先根据应用的具体类型进行分类,选择合适的机型、CPU/内存的配置;与业务团队协商业务容量上限,并对业务进行全链路压测确定容量的画像和水位的情况。在压测的过程中,通过阿里云容器服务提供的成本洞察功能,可以查看应用在当前容量规划的方案下的真实利用率;对于存在明显的周期性业务,采用定时伸缩的模型,降低在波谷时的资源成本;调整生产环境和测试环境的超卖比配置,将测试环境的超卖比调整为 300%,提高集群利用率。


精细化成本管理,合理规划容量,应对突发业务。定时查看、巡检集群中应用的利用率、资源水位的情况,汇总成本报表;通过云原生企业IT成本治理方案中,阿里云容器服务成本洞察功能,对业务进行集群 - 部门 - 应用维度的成本实时预估,让部门可以时刻关注自身成本的趋势变化;开启 HPA 等自动伸缩策略与报警,保障业务在流量突增的场景的鲁棒性。


快速预估成本, 基于数字化指标精准绘制资源成本画像。通过阿里云云原生企业 IT 成本治理方案中提供的费用分摊等功能,定期将拆分后的成本分析数据推送给事业部 IT 负责人、部门负责人、业务负责人等不同角色,并建立复盘机制,协同技术、财务、业务团队迭代优化成本画像的合理性。

image.png

通过成本洞察,形成资源成本画像后,最终制定了兼具稳定性、成本优化的 HPA 自动扩缩策略

建设成果


通过阿里云云原生企业 IT 成本治理方案,TCL 工程师团队可以非常便捷地提供 Kubernetes 集群中的业务、组织等维度的成本数据,大大提升了部门之间的成本通晒的效率,配合技术、业务、财务“战略同频”的云原生 IT 成本治理流程,为集团优化了 10%  闲置的资源, 各类业务降低了 30% 的配额, 每年节省近百万的 IT 成本投入。

相关文章
|
运维 Cloud Native Java
从 IDC 到云原生:稳定性提升 100%,成本下降 50%,热联集团的数字化转型与未来展望
热联集团在进行了云原生架构的升级与探索后,显著提升了业务系统的稳定性和敏捷性。这一转变不仅为公司冲击更高的销售目标奠定了坚实的技术基础,也标志着热联在数字化转型道路上迈出了关键一步。通过采用微服务、容器化等先进技术手段,热联能够更加灵活地响应市场变化,快速迭代产品和服务,满足客户日益增长的需求。
796 154
|
存储 弹性计算 Cloud Native
云原生成本精细化管理实践:企迈科技的成本中心建设之路
企迈实施成本中心建设的项目核心目标不仅是实现云资源的优化配置,还要为管理层提供清晰、实时的成本数据分析,帮助管理层做出更加精准的决策。通过精细化的云成本管控,逐步实现成本降低、资源合理分配和更加高效的云产品使用。
云原生成本精细化管理实践:企迈科技的成本中心建设之路
|
人工智能 缓存 Cloud Native
用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略
《Higress AI 网关挑战赛》正在火热进行中,Higress 社区邀请了目前位于排行榜 top5 的选手杨贝宁同学分享他的心得。本文是他整理的参赛攻略。
1397 191
|
消息中间件 运维 Cloud Native
云原生架构下的微服务优化策略####
本文深入探讨了云原生环境下微服务架构的优化路径,针对服务拆分、通信效率、资源管理及自动化运维等核心环节提出了具体的优化策略。通过案例分析与最佳实践分享,旨在为开发者提供一套系统性的解决方案,以应对日益复杂的业务需求和快速变化的技术挑战,助力企业在云端实现更高效、更稳定的服务部署与运营。 ####
|
人工智能 Cloud Native Java
云原生技术深度解析:从IO优化到AI处理
【10月更文挑战第24天】在当今数字化时代,云计算已经成为企业IT架构的核心。云原生作为云计算的最新演进形态,旨在通过一系列先进的技术和实践,帮助企业构建高效、弹性、可观测的应用系统。本文将从IO优化、key问题解决、多线程意义以及AI处理等多个维度,深入探讨云原生技术的内涵与外延,并结合Java和AI技术给出相应的示例。
490 1
|
Cloud Native API 持续交付
利用云原生技术优化微服务架构
【10月更文挑战第13天】云原生技术通过容器化、动态编排、服务网格和声明式API,优化了微服务架构的可伸缩性、可靠性和灵活性。本文介绍了云原生技术的核心概念、优势及实施步骤,探讨了其在自动扩展、CI/CD、服务发现和弹性设计等方面的应用,并提供了实战技巧。
|
Kubernetes 监控 Cloud Native
Cluster Optimizer:一款云原生集群优化平台
**Cluster Optimizer** 是一款云原生集群优化平台,旨在通过自动化和智能化工具帮助企业降低云成本,解决云原生架构中的成本管理难题。面对资源闲置、配置不当和缺乏自动化优化机制等挑战,Cluster Optimizer能够深入分析云资源、应用和用户行为,精准识别优化机会,并给出具体建议,涵盖节点组、节点、GPU 节点、磁盘、持久卷和应用等多个维度。通过优化实例类型、自动扩缩容和资源分配,帮助企业降低成本、提升性能和效率。[点击此处](https://www.wiseinf.com.cn/docs/setup/) 免费安装和试用 **Cluster Optimizer 社区版**。
426 9
|
运维 Cloud Native 容灾
核心系统转型问题之云原生分布式核心运维成本如何降低
核心系统转型问题之云原生分布式核心运维成本如何降低
314 0
|
存储 Cloud Native 数据处理
从嵌入式状态管理到云原生架构:Apache Flink 的演进与下一代增量计算范式
本文整理自阿里云资深技术专家、Apache Flink PMC 成员梅源在 Flink Forward Asia 新加坡 2025上的分享,深入解析 Flink 状态管理系统的发展历程,从核心设计到 Flink 2.0 存算分离架构,并展望未来基于流批一体的通用增量计算方向。
701 0
从嵌入式状态管理到云原生架构:Apache Flink 的演进与下一代增量计算范式
|
11月前
|
运维 监控 Cloud Native
从本土到全球,云原生架构护航灵犀互娱游戏出海
本文内容整理自「 2025 中企出海大会·游戏与互娱出海分论坛」,灵犀互娱基础架构负责人朱晓靖的演讲内容,从技术层面分享云原生架构护航灵犀互娱游戏出海经验。
931 15