云数据仓库+Serverless大数据的更新场景分别是什么?

云数据仓库+Serverless大数据的更新场景分别是什么?

展开
收起
游客hkipy4pok6j4i 2021-12-10 11:19:41 673 分享
分享
版权
举报
1 条回答
写回答
取消 提交回答
  • 一种是 CDC ( Change Data Capture) 的更新,尤其在电商的场景下,将 binlog 中的更新删除同步到 HDFS 上。另一种是延迟数据带来的聚合后结果的更新。目前 HDFS 只支持追加写,不支持更新。因此业界很多公司引入了 Kudu。但是 Kudu 本身是有一些局限的,比如计算存储没有做到分离。这样整个数仓系统中引入了 HDFS、Kafka 以及 Kudu,运维成本不可谓不大。

    2021-12-10 11:20:14 举报
    赞同 评论

    评论

    全部评论 (0)

    登录后可评论

快速交付实现商业价值。

热门讨论

热门文章

还有其他疑问?
咨询AI助理
AI助理

你好,我是AI助理

可以解答问题、推荐解决方案等