StarRocks x Fluss x Paimon 湖流一体方案:构建秒级响应、湖流一体的实时数据引擎
StarRocks x Fluss x Paimon 湖流一体方案通过将 Apache Fluss(面向分析场景的实时流存储)与 Apache Paimon(高性能湖格式表)深度融合,以 StarRocks 作为统一查询入口,构建了一套具备秒级新鲜度、十倍成本降低、一份数据一次查询的全新实时数据引擎。本文将介绍该方案的核心架构、技术优势、查询模式以及在阿里云 EMR Serverless StarRocks 上的产品化落地。
阿里云开源大数据平台E-MapReduce对接使用完全指南
本文系统性地介绍阿里云开源大数据平台E-MapReduce(EMR)的对接与使用方法。文章从EMR的三种产品形态(on ECS、on ACK、Serverless Spark)入手,详细讲解集群创建前的账号授权与网络规划、控制台创建集群的关键配置项、多种数据源(OSS、Tablestore、RDS等)的对接方式、Spark SQL与Flink任务的开发示例、RAM权限管理体系、集群监控告警配置,以及计算与存储分离架构下的成本优化最佳实践。全文包含完整的代码示例和配置参数说明,帮助读者从零开始掌握EMR的核心使用技能。
迅雷基于阿里云 EMR Serverless Spark 实现数仓资源效率与业务提升
迅雷基于阿里云 EMR Serverless Spark 实现数仓资源效率与业务提升,在迁移到 EMR Serverless Spark 之后,TCO 明显下降,平台按作业生命周期弹性拉起与回收,只为实际消耗付费;同时,托管化带来了稳定性与调度效率提升;更关键的是交付确定性提升,大作业整体可提速约 1 小时,报表链路从长尾波动变成更可控的出数节奏。