开发者社区> 问答> 正文

如果checkpoint时间过长,offset未提交到kafka重启之后的重复消费如何保证呢?

如果checkpoint时间过长,offset未提交到kafka重启之后的重复消费如何保证呢?

展开
收起
游客qzzytmszf3zhq 2021-12-07 20:22:44 919 0
1 条回答
写回答
取消 提交回答
  • 首先开启checkpoint时offset是flink通过状态state管理和恢复的,并不是从kafka的offset位置恢复。在checkpoint机制下,作业从最近一次checkpoint恢复,本身是会回放部分历史数据,导致部分数据重复消费,Flink引擎仅保证计算状态的精准一次,要想做到端到端精准一次需要依赖一些幂等的存储系统或者事务操作。

    2021-12-07 20:36:20
    赞同 展开评论 打赏
问答排行榜
最热
最新

相关电子书

更多
Java Spring Boot开发实战系列课程【第16讲】:Spring Boot 2.0 实战Apache Kafka百万级高并发消息中间件与原理解析 立即下载
MaxCompute技术公开课第四季 之 如何将Kafka数据同步至MaxCompute 立即下载
消息队列kafka介绍 立即下载