云数据仓库+Serverless大数据的更新场景分别是什么?

云数据仓库+Serverless大数据的更新场景分别是什么?

展开
收起
游客hkipy4pok6j4i 2021-12-10 11:19:41 687 分享 版权
1 条回答
写回答
取消 提交回答
  • 一种是 CDC ( Change Data Capture) 的更新,尤其在电商的场景下,将 binlog 中的更新删除同步到 HDFS 上。另一种是延迟数据带来的聚合后结果的更新。目前 HDFS 只支持追加写,不支持更新。因此业界很多公司引入了 Kudu。但是 Kudu 本身是有一些局限的,比如计算存储没有做到分离。这样整个数仓系统中引入了 HDFS、Kafka 以及 Kudu,运维成本不可谓不大。

    2021-12-10 11:20:14
    赞同 展开评论

快速交付实现商业价值。

还有其他疑问?
咨询AI助理