开源大数据平台 E-MapReduce的搜索结果_热门

扬流

|

博文

|

来自：大数据与机器学习

技术内幕 | 阿里云EMR StarRocks 极速数据湖分析

本文为作者在 StarRocks Summit Asia 2022 上的分享

# 开源大数据平台 E-MapReduce # 对象存储 # 存储 # SQL # 缓存 # Kubernetes # 数据挖掘 # Apache # 调度 # 对象存储 # HIVE # 容器

扬流

|

博文

|

来自：大数据与机器学习

阿里云 EMR Serverless StarRocks3.x，极速统一的湖仓新范式

EMR StarRocks 线上公开课第1期，直播主题：EMR Serverless StarRocks3.x，极速统一的湖仓新范式。

# 云原生数据仓库AnalyticDB MySQL版 # 大数据开发治理平台 DataWorks # 开源大数据平台 E-MapReduce # 弹性伸缩 # 函数计算 # 云原生数据仓库 AnalyticDB PostgreSQL版 # 对象存储 # 存储 # SQL # 数据可视化 # OLAP # 对象存储

bigdatatang

|

博文

|

来自：大数据与机器学习

大数据上云存算分离演进思考与探讨-2022

当前大数据上云与存算分离的技术趋势越来越成为行业标准与发展方向。作为大数据商业化的践行者，从存算分离的演进/定义/价值/架构应用/实践/对比等多个维度来分析与探讨其发展历程与组成体系。为大数据存算分离技术整体发展添砖加瓦。

# 云原生大数据计算服务 MaxCompute # 函数计算 # 实时计算 Flink版 # 对象存储 # 云原生数据仓库 AnalyticDB PostgreSQL版 # 弹性伸缩 # 资源管理 # 数据管理 # 容器服务Kubernetes版 # 云原生数据仓库AnalyticDB MySQL版 # 开源大数据平台 E-MapReduce # 存储 # 运维 # 大数据 # 对象存储 # 混合部署

阿里云大数据Al技术

|

博文

|

来自：大数据与机器学习

阿里云 EMR 基于 Apache DolphinScheduler 产品技术实践和社区贡献

本文整理自阿里云 EMR 数据开发团队负责人孙一凡（Evans 忆梵），在 Apache Spark & DS Meetup 的分享

# 开源大数据平台 E-MapReduce # 云原生大数据计算服务 MaxCompute # 存储 # 分布式计算 # Cloud Native # 数据可视化 # IDE # 大数据 # 测试技术 # 调度 # 开发工具 # Spark

阿里云E-MapReduce团队

|

博文

|

来自：大数据与机器学习

Spark Operator浅析

Spark Operator浅析本文介绍Spark Operator的设计和实现相关的内容. Spark运行时架构经过近几年的高速发展,分布式计算框架的架构逐渐趋同. 资源管理模块作为其中最通用的模块逐渐与框架解耦,独立成通用的组件.

# 开源大数据平台 E-MapReduce # 容器服务Kubernetes版 # 资源管理 # 可观测监控 Prometheus 版 # 分布式计算 # Spark # 容器 # Kubernetes # Perl

阿里云大数据

|

8月前

|

博文

|

来自：大数据与机器学习

千万级数据秒级响应！碧桂园基于 EMR Serverless StarRocks 升级存算分离架构实践

碧桂园服务通过引入 EMR Serverless StarRocks 存算分离架构，解决了海量数据处理中的资源利用率低、并发能力不足等问题，显著降低了硬件和运维成本。实时查询性能提升8倍，查询出错率减少30倍，集群数据 SLA 达99.99%。此次技术升级不仅优化了用户体验，还结合AI打造了“一看”和“—问”智能场景助力精准决策与风险预测。

# 函数计算 # 开源大数据平台 E-MapReduce # 存储 # 运维 # Serverless # BI # OLAP

阿里云E-MapReduce团队

|

博文

|

来自：大数据与机器学习

Spark 3.0 对于 DATE 和 TIMESTAMP 的改进

本文将会深入介绍DATE和TIMESTAMP

# 开源大数据平台 E-MapReduce # 云解析DNS # SQL # 存储 # 分布式计算 # Java # API # Scala # Apache # 数据库 # Spark # Python

扬流

|

博文

|

来自：大数据与机器学习

关于 Data Lake 的概念、架构与应用场景介绍

本文详细介绍了 Data Lake 的概念、架构与应用场景介绍。

# 开源大数据平台 E-MapReduce # 数据管理 # 实时计算 Flink版 # 对象存储 # 云原生大数据计算服务 MaxCompute # 数据湖构建 # 大数据开发治理平台 DataWorks # 云原生数据仓库AnalyticDB MySQL版 # 存储 # 数据采集 # 运维 # 分布式计算 # 大数据 # 数据管理 # MaxCompute # 对象存储 # 流计算 # 数据格式

开发者说

|

博文

|

来自：大数据与机器学习

限免首发 | Spark 企业级实战集锦，国内Spark开发者的进阶指南！

《Apache Spark 中文实战攻略》上下两册电子书重磅来袭，本书集结国内外顶级大厂技术专家，汇集多年实战经验，带你走进全球顶级开源社区之一 Apache Spark，探秘时下最流行的开源分布式内存式大数据处理引擎。

# 开源大数据平台 E-MapReduce # 容器服务Kubernetes版 # 云原生大数据计算服务 MaxCompute # 分布式计算 # Spark # Apache # 大数据 # 容器 # Kubernetes # 数据挖掘 # 机器学习/深度学习 # 算法框架/工具 # 知识图谱

阿里云E-MapReduce团队

|

博文

|

来自：大数据与机器学习

百草味基于“ EMR+Databricks+DLF ”构建云上数据湖的最佳实践

本文介绍了百草味大数据平台从 IDC 自建 Hadoop 到阿里云数据湖架构的迁移方案和落地过程。重点从 IDC 自建集群的痛点分析，云上大数据方案的选型以及核心模块的建设过程几个方面做了详细的介绍，希望给想了解和实践数据湖架构的企业和朋友一个参考。

# 开源大数据平台 E-MapReduce # 数据湖构建 # 云数据库 RDS MySQL 版 # 云原生大数据计算服务 MaxCompute # 对象存储 # 数据安全中心 # 存储 # SQL # 分布式计算 # 运维 # 大数据 # Hadoop # 调度 # 对象存储 # 数据安全/隐私保护 # Spark

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

开源大数据平台 E-MapReduce