美团 Flink 大作业部署问题之RocksDBStateBackend 的增量 Checkpoint 要怎么制作-阿里云开发者社区

美团 Flink 大作业部署问题之RocksDBStateBackend 的增量 Checkpoint 要怎么制作

2024-08-26 313

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 美团 Flink 大作业部署问题之RocksDBStateBackend 的增量 Checkpoint 要怎么制作

问题一：如何避免跨存储系统 Checkpoint 副本不可用的问题？

如何避免跨存储系统 Checkpoint 副本不可用的问题？

参考回答：

要避免跨存储系统 Checkpoint 副本不可用的问题，可以将所有被直接和间接引用的文件都复制到新的存储系统上。但这会极大增加副本制作的复杂度。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671938

问题二：RocksDBStateBackend 的增量 Checkpoint 是如何制作的？

RocksDBStateBackend 的增量 Checkpoint 是如何制作的？

参考回答：

RocksDBStateBackend 制作增量 Checkpoint 时，会先将数据刷盘，然后将 DB 实例中所有文件上传到指定的 Checkpoint storage 中（如 HDFS）。对于增量 Checkpoint，只需上传新增的文件和 metadata 文件，已存在的 shared 文件只需在 metadata 中记录引用，无需重复上传。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671939

问题三：RocksDB 数据文件（SST 文件）的特点是什么？

RocksDB 数据文件（SST 文件）的特点是什么？

参考回答：

RocksDB 的数据文件（SST 文件）一旦产生就不会再被修改，只会随着数据的不断写入和 compaction 而不断地产生和删除。这些 SST 文件包含了数据内容、索引等，是 RocksDB 持久化数据的关键部分。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671940

问题四：为什么在制作 Checkpoint 时，有些 SST 文件会被放到 shared 目录下？

为什么在制作 Checkpoint 时，有些 SST 文件会被放到 shared 目录下？

参考回答：

在制作 Checkpoint 时，如果 DB 实例中的某些 SST 文件在后续的增量 Checkpoint 中可能会被直接使用，这些文件就会被放到 shared 目录下，以避免重复上传，节省存储空间和传输时间。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671941

问题五：Checkpoint 序号为什么不连续，比如从 Checkpoint3 直接到 Checkpoint5？

Checkpoint 序号为什么不连续，比如从 Checkpoint3 直接到 Checkpoint5？

参考回答：

Checkpoint 序号不连续（如从 Checkpoint3 直接到 Checkpoint5）的原因可能是期间插入了 Savepoint，而 Savepoint 会占用 Checkpoint 序号。Savepoint 通常用于更持久化的状态保存，其制作和恢复过程与普通的 Checkpoint 有所不同。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671942

相关实践学习

基于Hologres+Flink搭建GitHub实时数据大屏

通过使用Flink、Hologres构建实时数仓，并通过Hologres对接BI分析工具（以DataV为例），实现海量数据实时分析.

实时计算 Flink 实战课程

如何使用实时计算 Flink 搞定数据处理难题？实时计算 Flink 极客训练营产品、技术专家齐上阵，从开源 Flink功能介绍到实时计算 Flink 优势详解，现场实操，5天即可上手！欢迎开通实时计算 Flink 版： https://cn.aliyun.com/product/bigdata/sc Flink Forward Asia 介绍： Flink Forward 是由 Apache 官方授权，Apache Flink Community China 支持的会议，通过参会不仅可以了解到 Flink 社区的最新动态和发展计划，还可以了解到国内外一线大厂围绕 Flink 生态的生产实践经验，是 Flink 开发者和使用者不可错过的盛会。去年经过品牌升级后的 Flink Forward Asia 吸引了超过2000人线下参与，一举成为国内最大的 Apache 顶级项目会议。结合2020年的特殊情况，Flink Forward Asia 2020 将在12月26日以线上峰会的形式与大家见面。

美团 Flink 大作业部署问题之RocksDBStateBackend 的增量 Checkpoint 要怎么制作

问题一：如何避免跨存储系统 Checkpoint 副本不可用的问题？

问题二：RocksDBStateBackend 的增量 Checkpoint 是如何制作的？

问题三：RocksDB 数据文件（SST 文件）的特点是什么？

问题四：为什么在制作 Checkpoint 时，有些 SST 文件会被放到 shared 目录下？

问题五：Checkpoint 序号为什么不连续，比如从 Checkpoint3 直接到 Checkpoint5？

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

美团 Flink 大作业部署问题之RocksDBStateBackend 的增量 Checkpoint 要怎么制作

问题一：如何避免跨存储系统 Checkpoint 副本不可用的问题？

问题二：RocksDBStateBackend 的增量 Checkpoint 是如何制作的？

问题三：RocksDB 数据文件（SST 文件）的特点是什么？

问题四：为什么在制作 Checkpoint 时，有些 SST 文件会被放到 shared 目录下？

问题五：Checkpoint 序号为什么不连续，比如从 Checkpoint3 直接到 Checkpoint5？

热门文章

最新文章

相关课程

相关电子书

相关实验场景