AtomData结合阿里云分布式存储实现海量数据分析(一)

本文涉及的产品
Serverless 应用引擎 SAE,800核*时 1600GiB*时
云消息队列RocketMQ,TPS总和2000次/秒
简介: AtomData结合阿里云分布式存储实现海量数据分析(一)
+关注继续查看

云原生实时数仓-AtomData结合阿里云分布式存储实现海量数据分析(一)

嘉宾信息

王博

杭州石原子科技AtomData技术负责人


AtomData结合阿里云分布式存储实现海量数据分析(一)


内容介绍

一、 AtomData产品定位

二、 AtomData产品架构

三、 AtomData三大优势

四、AtomData产品特点

五、AtomData的技术架构

六、 适用场景

七、 高弹性、高性能海量数据存储方案

八、 适配阿里云分布式存储收益

九、AtomData 23年路标


研究背景:

我是石原子科技公司的技术负责人研究的是技术的架构和适用的场景,包括如何云阐述分析场景下的优势。


一、AtomData产品定位

image.png

第一个,我们产品的定位在常规的大数据,我们一般把数仓分为三层,第一层是处理层,它一般是由hadoop和这种大数据存储和计算组件的产,他承担着主数据的存储和计算功能,另外还分为负责对于速度的存取,包括一些实时数据的实数据的存储和更新,还分为了服务层,它负责对于企业在实时数据查询的需求,一般是由和es来承接,对这这种三层架构的这种大数据体系来说,整个架构是比较复杂的,它的灵活性和它的这个实施的敏捷度是比较低的。一般来说是t加一的模式,做好之后,把数据导入到层去,做数据的支持的服务,生命层一般有多种数据库可以用户去,比如,可以去处理场景下面的数据的多分析的问题,去处理k的数据结构的点的问题,去做了基于画像的分析,这种多维多维度的数据报表聚合的查询,对于这种复杂的大数据体系,可以作为大数据体系上面的服务层的这种解决方案能够去实时的,去实时的去存储用户的实时写入的数据和实时更新的数据,能够实时的为企业去做查询和分析,还可以去作为数据库去同时替换,包括速度,服务在用户体量在pb级别到p级别以内,在他没有非常强的这种结构处理处理需求的时候的业务逻辑相对比较简单的时候,以通过替换掉层去做数据离线数据的处理和加工塔,Mysql和双写的,它可以用mysql协议去接入用户的数据的需求,数据需求也可以利用大数据计算框架去利用协议去接入数据库,去做大规模的数据计算。

另外,它还可以支持纯算耦合的式分部署方式,这两种方式可以针对两种用户场景,在用户在用户的数据存储和数据计算需求比较固定的情况下,它可以用存上耦合的方式去部署数据库,去做数据的存储和计算。

当用户的数据存储需求和计算需求是浮动的时候,它可以用存算分离的方式去部署,利用新的能力去应对存算和计算的不同时段的需求。

另外,它还可以支持结构化和数据的存储,存储和分析,支持时空的数据,支持从到p级的数据的分析和存储需求景架构。


二、AtomData产品架构

image.png

 我们可以把它点燃的分为几块,从底层的就设施来看,它适配了业界主流的,配了主流的一些国产的一些操作系统,也适配了阿里云,华为云,腾讯云之类的这种云平台,从核心组件来看,它分成引擎层,任务管理层和通信协议层,在引擎层,我们有自己的列表引擎以及外表引擎。外表引擎,可以去连接像os hfql短的外表引擎,

是我们一个纯引擎,我们后面讲解会详细的讲到,这种管理层,包括可以去管理数据上的数据的采样,包括离线作业的这个调度,包括构建的一些管理和资源的一些管理,在通协议层,我们支持mysl协议,企业级特性里面我们做了蛮多的功课,包括我们可以用户可以去支持自定义的这个副数量,以及去对接以对接分布式文件存储,这储设已经去支持,可以去实现层的这个高可用,包括我们可以在前面去前置一个,负展均衡,去实现r c阶层的连接,连接的均衡包括可以支持量的以及增量的这种实施备份包括说容同层。另外我我们做了一个可视化的一套界面,帮助用户去更好的去管理,运维它的的集群可视化管理,今天我们可做库表级别的管理,这个对标一般常见的系统可以去做管理,数据库的管理以及用户的管理,包括可以通过我们的可视化理工具做数据恢复,以常规常规运维和巡高塔具有明显的优势。


三、AtomData三大优势

image.png

第一个是复杂分析能力比较强,另外一个块是他的性价比较高,我们的整体的部署集群和部署组件来说是比较紧凑的,不需要投入过多的外部,不需要投入的过多的工程师。
另外,同时具备能力使得数据加工的过程比较短,整个仓的建设周期比较短,另外产品是比较维护,综合成本比较低,另外一个特是使用我们是兼q,l协议的所有的标准的数据库连接工具,数据库管理工具,包括数据的抽取,加工,调度以及di的工具都可以很轻易的连接到我们数据库。支持对多种的数据源,包括我们有深度的配了hs os以及myq,这我们都支持,另外就是由我们的金融mysql生态,所以说上下游的这个生态,上下游工具我们接的比较多,像常见的工具我们都是有兼容的。

相关实践学习
简单用户画像分析
本场景主要介绍基于海量日志数据进行简单用户画像分析为背景,如何通过使用DataWorks完成数据采集 、加工数据、配置数据质量监控和数据可视化展现等任务。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
5天前
|
存储 关系型数据库 大数据
Hologres是阿里云自研的HSAP(Hybrid Serving/Analytical Processing)服务/分析一体化系统
Hologres是阿里云自研的HSAP(Hybrid Serving/Analytical Processing)服务/分析一体化系统
26 2
|
1月前
|
存储 监控 安全
奇安信基于阿里云数据库 SelectDB 版内核 Apache Doris 升级日志安全分析系统,查询平均提速 700%
Apache Doris 助力奇安信建设全新日志存储分析平台,提升系统安全性与快速响应能力!
奇安信基于阿里云数据库 SelectDB 版内核 Apache Doris 升级日志安全分析系统,查询平均提速 700%
|
2月前
|
Kubernetes 监控 Python
阿里云kubernetes(ACK)pod异常问题分析辅助工具-pod生命周期及事件可观测一览图
阿里云kubernetes(ACK)pod异常问题分析辅助工具-pod生命周期及事件可观测一览图
|
2月前
|
SQL 存储 分布式计算
TIS借力阿里云 JindoFS 快速实现云上数据集成分析
利用TIS 借力阿里云 Jindo 快速实现云上数据集成分析,为用户提供免维护、费用低廉、稳定、高效的数仓服务。
223 0
|
3月前
|
存储 缓存 OLAP
阿里云 X Apache Doris X Zilliz沙龙回顾|大模型时代的数据存储与分析
9月16日,阿里云存储和云原生联合两个热门的数据分析项目 Apache Doris 和 Zilliz 共同探讨非结构化数据处理和分析的最佳实践
|
3月前
|
Kubernetes 安全 Linux
|
3月前
|
存储 缓存 数据挖掘
AtomData结合阿里云分布式存储实现海量数据分析(三)
AtomData结合阿里云分布式存储实现海量数据分析(三)
48 0
|
3月前
|
存储 数据挖掘 大数据
AtomData结合阿里云分布式存储实现海量数据分析(二)
AtomData结合阿里云分布式存储实现海量数据分析(二)
52 0
|
3月前
|
存储 SQL 监控
阿里云“玩转云上 StarRocks3.0 湖仓分析”训练营火热报名中,开启数据分析新范式
阿里云 EMR OLAP 团队与 StarRocks 社区联合出品,玩转云上 StarRocks3.0 湖仓分析训练营,围绕 StarRocks3.0 系列解读、EMR Serverless StarRocks 存算分离功能与应用场景介绍,开启数据分析新范式!
679 0
|
3月前
|
存储 自然语言处理 数据挖掘
阿里云邀您参加《大模型时代下的数据存储与分析》沙龙
阿里云将联合Doris和Zilliz举办《大模型时代下的数据存储与分析》技术沙龙。带你了解数据智能存储分析与向量特征提取Serverless架构实践、场景搭建与动手实践,现场签到即送限量好礼!
阿里云邀您参加《大模型时代下的数据存储与分析》沙龙
热门文章
最新文章
相关产品
云消息队列 MQ
微服务引擎
函数计算
推荐文章
更多