《Storm分布式实时计算模式》——第3章 Trident和传感器数据3.1　使用场景-阿里云开发者社区

《Storm分布式实时计算模式》——第3章 Trident和传感器数据3.1　使用场景

2017-07-03 1507

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

本文涉及的产品

实时计算 Flink 版，1000CU*H 3个月

简介：

本节书摘来自华章计算机《Storm分布式实时计算模式》一书中的第3章，第3.1节,作者：（美）P. Taylor Goetz　Brian O’Neill 更多章节内容可以访问云栖社区“华章计算机”公众号查看。

第3章 Trident和传感器数据

在本章中，我们将介绍Trident topology。Trident在Storm上提供了高层抽象。Trident抽象掉了事务处理和状态管理的细节。特别是，它可以让一批tuple进行离散的事务处理。此外，Trident还提供了抽象操作，允许topology在数据上执行函数功能、过滤和聚合操作。
我们将使用传感器数据作为例子来更好地理解Trident。通常情况下，传感器数据流会来自不同的位置。一些传统的例子包括天气和交通状况，这种模式扩展到了更大的数据源。比如，手机应用产生的众多事件信息。处理手机生成的事件流就是另一个传感器数据处理的实例。
传感器数据包括不同设备发射的事件，往往是无穷尽的数据流。这正是Storm最合适的一种应用场景。
本章包括以下主题：

Trident topology
Trident spout
Trident操作——filter和function
Trident聚合——Combiner和Reducer
Trident状态（state）

3.1　使用场景

在用Storm处理传感器数据时，为了更好地理解Trident topology，我们实现了一个Trident topolygy收集医学诊断报告来判断是否有疾病暴发的实例。
这个topology会处理的医学诊断事件包括以下的信息：

https://yqfile.alicdn.com/89aeb985f819351b49755263f1c7d879f9e07f7e.png" >

每个事件包括事件发生时的全球定位系统（GPS）的位置坐标，经度和纬度使用十进制小数表示。事件还包括ICD9-CM编码，表示诊断结果，以及事件发生的时间戳。完整的ICD9-CM编码参见 http://www.icd9data.com/。
为了判断是否有疾病暴发，系统会按照地理位置来统计各种疾病代码在一段时间内出现的次数。为了简化例子，我们按城市划分诊断结果地理位置。实际系统会对地理位置做出更精细的划分。
另外，示例中会逐小时对诊断事件进行分组。实际系统会更倾向于使用滑动窗口，使用移动平均值来计算趋势。
最后，我们使用简单的阈值来判断是否有疾病暴发。如果某个小时事件发生的次数超过了阈值，系统会产生告警信息并且派遣应急人员。
为了维护历史记录，我们还需要将每个城市、小时、疾病的统计量持久化存储。

相关实践学习

基于Hologres+Flink搭建GitHub实时数据大屏

通过使用Flink、Hologres构建实时数仓，并通过Hologres对接BI分析工具（以DataV为例），实现海量数据实时分析.

实时计算 Flink 实战课程

如何使用实时计算 Flink 搞定数据处理难题？实时计算 Flink 极客训练营产品、技术专家齐上阵，从开源 Flink功能介绍到实时计算 Flink 优势详解，现场实操，5天即可上手！欢迎开通实时计算 Flink 版： https://cn.aliyun.com/product/bigdata/sc Flink Forward Asia 介绍： Flink Forward 是由 Apache 官方授权，Apache Flink Community China 支持的会议，通过参会不仅可以了解到 Flink 社区的最新动态和发展计划，还可以了解到国内外一线大厂围绕 Flink 生态的生产实践经验，是 Flink 开发者和使用者不可错过的盛会。去年经过品牌升级后的 Flink Forward Asia 吸引了超过2000人线下参与，一举成为国内最大的 Apache 顶级项目会议。结合2020年的特殊情况，Flink Forward Asia 2020 将在12月26日以线上峰会的形式与大家见面。

《Storm分布式实时计算模式》——第3章 Trident和传感器数据3.1　使用场景

第3章 Trident和传感器数据

3.1　使用场景

华章出版社

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

《Storm分布式实时计算模式》——第3章 Trident和传感器数据3.1 使用场景

第3章 Trident和传感器数据

3.1 使用场景

华章出版社

热门文章

最新文章

相关课程

相关电子书

相关实验场景

《Storm分布式实时计算模式》——第3章 Trident和传感器数据3.1　使用场景

3.1　使用场景