《Storm分布式实时计算模式》——1.2　单词计数topology的数据流-阿里云开发者社区

《Storm分布式实时计算模式》——1.2　单词计数topology的数据流

2017-07-03 1555

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介：

[text](本节书摘来自华章计算机《Storm分布式实时计算模式》一书中的第1章，第1.2节,作者：（美）P. Taylor Goetz　Brian O’Neill 更多章节内容可以访问云栖社区“华章计算机”公众号查看。

1.2　单词计数topology的数据流

如图1-2所示，单词计数topology由一个spout和下游的三个bolt组成。

7d2caf4510f90e61fa828acaa5304fce19690b78

1.2.1　语句生成spout
SentenceSpout类的功能很简单，向后端发射一个单值tuple组成的数据流，键名是“sentence”，键值是字符串格式存储的一句话。如下所示：

4424a913b7e471c789216378adcd4f40462e8bfc

为了简化起见，我们的数据源是一个静态语句的列表。spout会一直循环将每句话作为tuple发射。实际应用中，spout通常会连接到动态数据源上，比如通过Twitter的API获取推特消息。
1.2.2　语句分割bolt
语句分割bolt（SplitSentenceBolt）类会订阅sentence spout发射的tuple流。每当收到一个tuple，bolt会获取“sentence”对应值域的语句，然后将语句分割为一个个的单词。每个单词向后发射一个tuple：

e57f83f819322faf39a932d10632e501a55731e0

1.2.3　单词计数bolt
单词计数bolt（WordCountBolt）订阅SplitSentenceBolt类的输出，保存每个特定单词出现的次数。每当bolt接收到一个tuple，会将对应单词的计数加一，并且向后发送该单词当前的计数。

cddf642b4bb9dd906d85fbadd36e19a9c283bd8b

1.2.4　上报bolt
上报bolt订阅WordCountBolt类的输出，像WordCountBolt一样，维护一份所有单词对应的计数的表。当接收到一个tuple时，上报bolt会更新表中的计数数据，并且将值在终端打印。
)

相关实践学习

基于Hologres+Flink搭建GitHub实时数据大屏

通过使用Flink、Hologres构建实时数仓，并通过Hologres对接BI分析工具（以DataV为例），实现海量数据实时分析.

实时计算 Flink 实战课程

如何使用实时计算 Flink 搞定数据处理难题？实时计算 Flink 极客训练营产品、技术专家齐上阵，从开源 Flink功能介绍到实时计算 Flink 优势详解，现场实操，5天即可上手！欢迎开通实时计算 Flink 版： https://cn.aliyun.com/product/bigdata/sc Flink Forward Asia 介绍： Flink Forward 是由 Apache 官方授权，Apache Flink Community China 支持的会议，通过参会不仅可以了解到 Flink 社区的最新动态和发展计划，还可以了解到国内外一线大厂围绕 Flink 生态的生产实践经验，是 Flink 开发者和使用者不可错过的盛会。去年经过品牌升级后的 Flink Forward Asia 吸引了超过2000人线下参与，一举成为国内最大的 Apache 顶级项目会议。结合2020年的特殊情况，Flink Forward Asia 2020 将在12月26日以线上峰会的形式与大家见面。

《Storm分布式实时计算模式》——1.2　单词计数topology的数据流

1.2　单词计数topology的数据流

华章出版社

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

《Storm分布式实时计算模式》——1.2 单词计数topology的数据流

1.2 单词计数topology的数据流

华章出版社

热门文章

最新文章

相关课程

相关电子书

相关实验场景

《Storm分布式实时计算模式》——1.2　单词计数topology的数据流

1.2　单词计数topology的数据流