【Azure 事件中心】Flink消费Event Hub中事件, 使用Azure默认示例代码，始终获取新产生的事件，如何消费旧事件呢？

2024-08-25 177

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 【Azure 事件中心】Flink消费Event Hub中事件, 使用Azure默认示例代码，始终获取新产生的事件，如何消费旧事件呢？

问题描述

根据Azure Event Hub示例文档，[将 Apache Flink 与适用于 Apache Kafka 的 Azure 事件中心配合使用]，配置好 consumer.config 文件后，为什么不能自动消费Event Hub中存储的旧数据呢？

如果发送端(生产者)没有任何消息输出，这消费端的信息也是一片空白，如：

问题分析

在 Kafka 中，每当消费者组内的消费者查找不到所记录的消费位移或发生位移越界时，就会根据消费者客户端参数 auto.offset.reset 的配置来决定从何处开始进行消费，这个参数的默认值为 “latest” 。

auto.offset.reset 的值可以为 earliest、latest 和 none 。关于 earliest 和 latest 的解释，真实情况如下所示：

earliest ：当各分区下存在已提交的 offset 时，从提交的 offset 开始消费；无提交的 offset 时，从头开始消费。
latest ：当各分区下存在已提交的 offset 时，从提交的 offset 开始消费；无提交的 offset 时，消费该分区下新产生的数据。
none ：topic 各分区都存在已提交的 offset 时，从 offset 后开始消费；只要有一个分区不存在已提交的offset，则抛出异常

使用Flink消费端以Kafka方式消费Event Hub中的事件，当消费端第一次运行时，因为默认配置，所以消费端只消费新产生的数据。

如果需要消费旧的数据，需要在 consumer.config 中添加 auto.offset.reset = earliest 。

修改后的测试效果为：

参考资料

Flink消费kafka的offset设置：https://blog.csdn.net/pageniao/article/details/124279617

Seeking to a Specific Offset：https://docs.spring.io/spring-kafka/docs/current/reference/html/#seek

相关实践学习

基于Hologres+Flink搭建GitHub实时数据大屏

通过使用Flink、Hologres构建实时数仓，并通过Hologres对接BI分析工具（以DataV为例），实现海量数据实时分析.

实时计算 Flink 实战课程

如何使用实时计算 Flink 搞定数据处理难题？实时计算 Flink 极客训练营产品、技术专家齐上阵，从开源 Flink功能介绍到实时计算 Flink 优势详解，现场实操，5天即可上手！欢迎开通实时计算 Flink 版： https://cn.aliyun.com/product/bigdata/sc Flink Forward Asia 介绍： Flink Forward 是由 Apache 官方授权，Apache Flink Community China 支持的会议，通过参会不仅可以了解到 Flink 社区的最新动态和发展计划，还可以了解到国内外一线大厂围绕 Flink 生态的生产实践经验，是 Flink 开发者和使用者不可错过的盛会。去年经过品牌升级后的 Flink Forward Asia 吸引了超过2000人线下参与，一举成为国内最大的 Apache 顶级项目会议。结合2020年的特殊情况，Flink Forward Asia 2020 将在12月26日以线上峰会的形式与大家见面。

【Azure 事件中心】Flink消费Event Hub中事件, 使用Azure默认示例代码，始终获取新产生的事件，如何消费旧事件呢？

问题描述

问题分析

参考资料

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

【Azure 事件中心】Flink消费Event Hub中事件, 使用Azure默认示例代码，始终获取新产生的事件，如何消费旧事件呢？

问题描述

问题分析

参考资料

热门文章

最新文章

相关课程

相关电子书

相关实验场景