开发者社区 > 大数据与机器学习 > 开源大数据平台 E-MapReduce > 正文

数据仓库的优劣是什么?

数据仓库的优劣是什么?

展开
收起
游客lmkkns5ck6auu 2022-07-28 15:57:20 585 0
1 条回答
写回答
取消 提交回答
  • 优势:数据仓库从上世纪80年代开始发展和兴起,它的初衷是为了支持BI系统和报表系统,而它的优势也就在于此。结构化的数据可以通过[TL来导入数据仓库,用户可以方便地接入报表系统以及BI系统。同时,它的数据管控能力也比较强。

    劣势:数据仓库对于数据:chema的要求非常严格,很多数据仓库甚至也实现了acid事务等能力。但是数据仓库对于半结构化数据比如时序数据和日志,以及非结构化数据比如图片、文档等的支持是非常有限的,因此它不适用于类似于机器学习的应用场景。而且一般情况下,数据仓库都是专有系统,使用成本比较高,数据迁移和同步的灵活性比较低。

    以上内容摘自《Databricks数据洞悉》电子书,点击https://developer.aliyun.com/topic/download?id=8545可下载完整版

    2022-07-29 10:24:58
    赞同 展开评论 打赏

阿里云EMR是云原生开源大数据平台,为客户提供简单易集成的Hadoop、Hive、Spark、Flink、Presto、ClickHouse、StarRocks、Delta、Hudi等开源大数据计算和存储引擎,计算资源可以根据业务的需要调整。EMR可以部署在阿里云公有云的ECS和ACK平台。

相关电子书

更多
实时计算产品案例-实时数据仓库 立即下载
PostgresChina2018_陶征霖_新一代数据仓库OushuDB架构剖析 立即下载
数据在PG中的升华:流计算、OLTP、OLAP、轻学习 立即下载