美团 Flink 大作业部署问题之新启动作业的 Checkpoint 跨作业文件引用的问题要如何避免-阿里云开发者社区

美团 Flink 大作业部署问题之新启动作业的 Checkpoint 跨作业文件引用的问题要如何避免

2024-08-26 190

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 美团 Flink 大作业部署问题之新启动作业的 Checkpoint 跨作业文件引用的问题要如何避免

问题一：制作 Checkpoint5 时如何知道 02.sst 和 03.sst 已经上传过了？

制作 Checkpoint5 时如何知道 02.sst 和 03.sst 已经上传过了？

参考回答：

制作 Checkpoint5 时，通过 previous-sst-list 来记录上次成功的 Checkpoint 中所有 SST 文件信息，从而知道 02.sst 和 03.sst 已经上传过了。这个列表帮助实现增量 Checkpoint 的制作。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671943

问题二：为什么新启动作业的 Checkpoint 可能会引用它所 restore 的 Checkpoint 中的文件？

为什么新启动作业的 Checkpoint 可能会引用它所 restore 的 Checkpoint 中的文件？

参考回答：

新启动作业的 Checkpoint 可能会引用它所 restore 的 Checkpoint 中的文件，因为即使作业重启，也会尝试基于之前恢复的 Checkpoint 进行增量制作，如果恢复的是跨作业实例的 Checkpoint，就会导致文件引用跨作业。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671945

问题三：如何避免新启动作业的 Checkpoint 跨作业文件引用的问题？

如何避免新启动作业的 Checkpoint 跨作业文件引用的问题？

参考回答：

在恢复 previous-sst-list 之前，判断 restore Checkpoint 所属的作业是否是当前作业。如果不是，则不恢复 previous-sst-list，这样作业启动后的第一个 Checkpoint 就会上传所有文件，之后的 Checkpoint 再基于前面的 Checkpoint 进行增量制作，从而避免跨作业文件引用。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671946

问题四：Checkpoint metadata 中如何获取到作业 ID？

Checkpoint metadata 中如何获取到作业 ID？

参考回答：

Checkpoint metadata 中本身不包含作业 ID，但可以通过修改 IncrementalRemoteKeyedStateHandle 的实现，增加一个 jobID 字段，并在制作 Checkpoint 时将 ID 字段序列化到 meta 文件中。这样在 restore 时就可以通过解析 meta 文件来获取 Checkpoint 所属的作业 ID。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671947

问题五：Checkpoint metadata 中文件路径的问题是什么？如何解决？

Checkpoint metadata 中文件路径的问题是什么？如何解决？

参考回答：

Checkpoint metadata 中记录的文件路径是绝对路径，当 Checkpoint 被复制到其他目录时，这些引用会失效。解决方法是将绝对路径换成相对路径，根据 Checkpoint 的 exclusive 目录和文件的相对路径计算出文件的具体位置，从而实现 Checkpoint 的 relocatable。

关于本问题的更多回答可点击原文查看：

https://developer.aliyun.com/ask/671948

相关实践学习

基于Hologres+Flink搭建GitHub实时数据大屏

通过使用Flink、Hologres构建实时数仓，并通过Hologres对接BI分析工具（以DataV为例），实现海量数据实时分析.

实时计算 Flink 实战课程

如何使用实时计算 Flink 搞定数据处理难题？实时计算 Flink 极客训练营产品、技术专家齐上阵，从开源 Flink功能介绍到实时计算 Flink 优势详解，现场实操，5天即可上手！欢迎开通实时计算 Flink 版： https://cn.aliyun.com/product/bigdata/sc Flink Forward Asia 介绍： Flink Forward 是由 Apache 官方授权，Apache Flink Community China 支持的会议，通过参会不仅可以了解到 Flink 社区的最新动态和发展计划，还可以了解到国内外一线大厂围绕 Flink 生态的生产实践经验，是 Flink 开发者和使用者不可错过的盛会。去年经过品牌升级后的 Flink Forward Asia 吸引了超过2000人线下参与，一举成为国内最大的 Apache 顶级项目会议。结合2020年的特殊情况，Flink Forward Asia 2020 将在12月26日以线上峰会的形式与大家见面。

美团 Flink 大作业部署问题之新启动作业的 Checkpoint 跨作业文件引用的问题要如何避免

问题一：制作 Checkpoint5 时如何知道 02.sst 和 03.sst 已经上传过了？

问题二：为什么新启动作业的 Checkpoint 可能会引用它所 restore 的 Checkpoint 中的文件？

问题三：如何避免新启动作业的 Checkpoint 跨作业文件引用的问题？

问题四：Checkpoint metadata 中如何获取到作业 ID？

问题五：Checkpoint metadata 中文件路径的问题是什么？如何解决？

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

美团 Flink 大作业部署问题之新启动作业的 Checkpoint 跨作业文件引用的问题要如何避免

问题一：制作 Checkpoint5 时如何知道 02.sst 和 03.sst 已经上传过了？

问题二：为什么新启动作业的 Checkpoint 可能会引用它所 restore 的 Checkpoint 中的文件？

问题三：如何避免新启动作业的 Checkpoint 跨作业文件引用的问题？

问题四：Checkpoint metadata 中如何获取到作业 ID？

问题五：Checkpoint metadata 中文件路径的问题是什么？如何解决？

热门文章

最新文章

相关课程

相关电子书

相关实验场景