"Flink+Paimon:阿里云大数据云原生运维数仓的创新实践,引领实时数据处理新纪元"

本文涉及的产品
实时计算 Flink 版,5000CU*H 3个月
云原生数据仓库AnalyticDB MySQL版,基础版 8ACU 100GB 1个月
日志服务 SLS,月写入数据量 50GB 1个月
简介: 【8月更文挑战第2天】Flink+Paimon在阿里云大数据云原生运维数仓的实践

随着大数据产品云原生化的加速推进,云原生集群的规模和数量急剧增加,这给运维工作带来了前所未有的挑战。为了有效应对这些挑战,阿里云大数据团队结合Apache Flink与自研的Paimon数据湖解决方案,构建了一套实时云原生运维数仓,显著提升了运维能力和数据处理的实时性。本文将通过实际案例分析,详细阐述Flink+Paimon在阿里云大数据云原生运维数仓中的应用。

背景与挑战
随着云原生集群的广泛应用,资源审计、资源拓扑和资源趋势分析成为运维工作的关键需求。传统的运维方式已难以满足实时性和精准性的要求,迫切需要一种能够实时反映集群状态并提供高效数据分析能力的解决方案。因此,阿里云大数据团队决定采用Flink+Paimon的流式数仓方案,以应对这些挑战。

解决方案概述
Flink作为实时计算的标准解决方案,以其高吞吐、低延迟的特性在大数据处理领域占据重要地位。而Paimon则是阿里云开源大数据团队推出的低成本数据湖解决方案,为海量数据的存储和分析提供了强有力的支持。两者结合,形成了Flink+Paimon的实时数仓解决方案,为云原生运维数仓提供了强大的实时数据处理和低成本存储能力。

实践案例分析
数据采集与同步
在数据采集阶段,团队研发了exporter-operator工具,该工具嵌入Kubernetes集群中,实时监听Kubernetes API Server中的workload数据变化。通过配置Informer中的自定义资源(CR),exporter-operator能够灵活启用多个workload-informer实例,实现对各类工作负载的监控。捕获到的数据通过阿里云日志服务(SLS)或Apache Kafka进行实时传输,确保数据的实时性和完整性。

数据处理与存储
在数据处理阶段,团队采用Flink作为计算引擎,结合Paimon进行数据存储。Flink作业通过实时读取SLS或Kafka中的数据流,进行复杂的计算处理,如资源聚合、排序和维表join等。处理后的数据直接写入Paimon ODS表中,供后续分析和查询使用。示例代码如下:

sql
CREATE TABLE IF NOT EXISTS abm-exporter-paimon.abm_exporter_db.ods_realtime_exporter_lakehouse (
sls_time bigint,
cluster varchar,
content varchar
) PARTITIONED BY (cluster)
WITH (
'orc.write.batch-size' = '128',
'file.format' = 'avro',
'bucket' = '8'
);

INSERT INTO abm-exporter-paimon.abm_exporter_db.ods_realtime_exporter_lakehouse
SELECT __timestamp__ as sls_time,
__topic__ as cluster,
content
FROM source_k8s_meta;
数据分析与展示
在数据分析阶段,团队利用DataWorks进行数据清洗和预处理,确保数据的准确性和一致性。配置完成后,Paimon表的元数据会自动同步到DataWorks中,用户可以直接在DataWorks中进行数据分析。最终,数据报表通过FBI进行展示,资源拓扑数据则写入到CMDB中,供运维系统使用。

总结
通过Flink+Paimon的实时数仓解决方案,阿里云大数据团队成功构建了高效的云原生运维数仓。该方案不仅满足了实时性和精准性的要求,还显著降低了存储成本,为云原生集群的运维工作提供了强有力的支持。未来,随着技术的不断发展和优化,该方案有望在更多场景中发挥重要作用。

相关实践学习
AnalyticDB MySQL海量数据秒级分析体验
快速上手AnalyticDB MySQL,玩转SQL开发等功能!本教程介绍如何在AnalyticDB MySQL中,一键加载内置数据集,并基于自动生成的查询脚本,运行复杂查询语句,秒级生成查询结果。
阿里云云原生数据仓库AnalyticDB MySQL版 使用教程
云原生数据仓库AnalyticDB MySQL版是一种支持高并发低延时查询的新一代云原生数据仓库,高度兼容MySQL协议以及SQL:92、SQL:99、SQL:2003标准,可以对海量数据进行即时的多维分析透视和业务探索,快速构建企业云上数据仓库。 了解产品 https://www.aliyun.com/product/ApsaraDB/ads
相关文章
|
2天前
|
SQL DataWorks 数据可视化
阿里云DataWorks评测:大数据开发治理平台的卓越表现
阿里云DataWorks是一款集数据集成、开发、分析与管理于一体的大数据平台,支持多种数据源无缝整合,提供可视化ETL工具和灵活的任务调度机制。其内置的安全体系和丰富的插件生态,确保了数据处理的高效性和安全性。通过实际测试,DataWorks展现了强大的计算能力和稳定性,适用于中小企业快速搭建稳定高效的BI系统。未来,DataWorks将继续优化功能,降低使用门槛,并推出更多灵活的定价方案,助力企业实现数据价值最大化。
|
2天前
|
分布式计算 大数据 数据处理
技术评测:MaxCompute MaxFrame——阿里云自研分布式计算框架的Python编程接口
随着大数据和人工智能技术的发展,数据处理的需求日益增长。阿里云推出的MaxCompute MaxFrame(简称“MaxFrame”)是一个专为Python开发者设计的分布式计算框架,它不仅支持Python编程接口,还能直接利用MaxCompute的云原生大数据计算资源和服务。本文将通过一系列最佳实践测评,探讨MaxFrame在分布式Pandas处理以及大语言模型数据处理场景中的表现,并分析其在实际工作中的应用潜力。
15 2
|
1月前
|
SQL 流计算 关系型数据库
基于OpenLake的Flink+Paimon+EMR StarRocks流式湖仓分析
阿里云OpenLake解决方案建立在开放可控的OpenLake湖仓之上,提供大数据搜索与AI一体化服务。通过元数据管理平台DLF管理结构化、半结构化和非结构化数据,提供湖仓数据表和文件的安全访问及IO加速,并支持大数据、搜索和AI多引擎对接。本文为您介绍以Flink作为Openlake方案的核心计算引擎,通过流式数据湖仓Paimon(使用DLF 2.0存储)和EMR StarRocks搭建流式湖仓。
358 4
基于OpenLake的Flink+Paimon+EMR StarRocks流式湖仓分析
|
29天前
|
存储 分布式计算 大数据
【赵渝强老师】阿里云大数据生态圈体系
阿里云大数据计算服务MaxCompute(原ODPS)提供大规模数据存储与计算,支持离线批处理。针对实时计算需求,阿里云推出Flink版。此外,阿里云还提供数据存储服务如OSS、Table Store、RDS和DRDS,以及数据分析平台DataWorks、Quick BI和机器学习平台PAI,构建全面的大数据生态系统。
68 18
|
1月前
|
分布式计算 Java 开发工具
阿里云MaxCompute-XGBoost on Spark 极限梯度提升算法的分布式训练与模型持久化oss的实现与代码浅析
本文介绍了XGBoost在MaxCompute+OSS架构下模型持久化遇到的问题及其解决方案。首先简要介绍了XGBoost的特点和应用场景,随后详细描述了客户在将XGBoost on Spark任务从HDFS迁移到OSS时遇到的异常情况。通过分析异常堆栈和源代码,发现使用的`nativeBooster.saveModel`方法不支持OSS路径,而使用`write.overwrite().save`方法则能成功保存模型。最后提供了完整的Scala代码示例、Maven配置和提交命令,帮助用户顺利迁移模型存储路径。
|
2月前
|
Kubernetes Cloud Native 流计算
Flink-12 Flink Java 3分钟上手 Kubernetes云原生下的Flink集群 Rancher Stateful Set yaml详细 扩容缩容部署 Docker容器编排
Flink-12 Flink Java 3分钟上手 Kubernetes云原生下的Flink集群 Rancher Stateful Set yaml详细 扩容缩容部署 Docker容器编排
91 3
|
3月前
|
人工智能 分布式计算 DataWorks
连续四年!阿里云领跑中国公有云大数据平台
近日,国际数据公司(IDC)发布《中国大数据平台市场份额,2023:数智融合时代的真正到来》报告——2023年中国大数据平台公有云服务市场规模达72.2亿元人民币,其中阿里巴巴市场份额保持领先,占比达40.2%,连续四年排名第一。
256 12
|
2月前
|
存储 运维 监控
实时计算Flink版在稳定性、性能、开发运维、安全能力等等跟其他引擎及自建Flink集群比较。
实时计算Flink版在稳定性、性能、开发运维和安全能力等方面表现出色。其自研的高性能状态存储引擎GeminiStateBackend显著提升了作业稳定性,状态管理优化使性能提升40%以上。核心性能较开源Flink提升2-3倍,资源利用率提高100%。提供一站式开发管理、自动化运维和丰富的监控告警功能,支持多语言开发和智能调优。安全方面,具备访问控制、高可用保障和全链路容错能力,确保企业级应用的安全与稳定。
51 0
|
3月前
|
SQL 人工智能 大数据
首个大数据批流融合国家标准正式发布,阿里云为牵头起草单位!
近日,国家市场监督管理总局、国家标准化管理委员会正式发布大数据领域首个批流融合国家标准 GB/T 44216-2024《信息技术 大数据 批流融合计算技术要求》,该标准由阿里云牵头起草,并将于2025年2月1日起正式实施。
|
2月前
|
人工智能 自然语言处理 关系型数据库
阿里云云原生数据仓库 AnalyticDB PostgreSQL 版已完成和开源LLMOps平台Dify官方集成
近日,阿里云云原生数据仓库 AnalyticDB PostgreSQL 版已完成和开源LLMOps平台Dify官方集成。

热门文章

最新文章

下一篇
DataWorks