ZooKeeper分布式架构实战系列(01):ZooKeeper概念、功能、架构、与使用场景和面试题

本文涉及的产品
服务治理 MSE Sentinel/OpenSergo,Agent数量 不受限
注册配置 MSE Nacos/ZooKeeper,118元/月
任务调度 XXL-JOB 版免费试用,400 元额度,开发版规格
简介: ZooKeeper是分布式协调服务,开源分布式架构领域不可或缺的技术,使用非常的广泛,比如常见的Hadoop大数据架构,阿里巴巴的Dubbo分布式架构,Spring Cloud微服务架构等都有涉及。BAT名企面试中也是经常作为考点。

ZooKeeper是分布式协调服务,开源分布式架构领域不可或缺的技术组件,使用非常的广泛,我们在一些分布式架构的文章中经常看到。
比如常见的Hadoop大数据架构,阿里巴巴的Dubbo分布式架构,Spring Cloud微服务架构等都有涉及。BAT名企面试中也是经常作为考点。重要性不言而喻,作为互联网公司的架构师,不懂ZooKeeper很难过关。
image

今天我们来一起系统学习《ZooKeeper分布式架构实战系列》,包括ZooKeeper概念、功能、架构、与使用场景和面试题,与各种技术组件的搭配使用,部署、运维与开发实战。
1、ZooKeeper 名字由来
ZooKeeper 在分布式领域大名鼎鼎,但是很多人不理解为什么叫这个名字。其实却是很痛苦,我自己第一次听说也是很久不理解。
这和ZooKeeper 最初诞生的时候的设计目标有关系,ZooKeeper 最早是为Hadoop大数据生态系统设计的。我们今天基本都是用在其他的分布式系统场景下,所以很难去理解这个奇怪的名字。
ZooKeeper :动物饲养员,动物管理员,也就是现在Logo的样子,不过这个Logo还不够形象,会让人感觉是个挖下水道的工人。
作为中国程序员,很难理解老外起名字的套路,为什么一个好好的分布式工具,叫这么奇怪的名字?
Hadoop本意,大象,Impala 黑斑羚,Pig猪八戒二师弟。Hive蜜蜂等,Hadoop大数据生态的开源框架基本都是动物的名称,所以就有了这个称谓。ZooKeeper 帮忙管理大数据分布式应用系统中的不同动物组件。
image
2011年美国上映的一部电影《ZooKeeper 》,Kevin James主演的动物管理员,讲的是一个屌丝饲养员在动物的神助攻下追到金发美女的浪漫爱情故事。中国大陆翻译为:动物园看守。这个名字霸气,让你听了就感觉动物是在坐牢。台湾的翻译是:全民情兽。哈哈。让人不敢深入想想。
image
不过真正做过ZooKeeper的名人到有一位,就是德云社相声演员:孙越(岳云鹏的搭档,大胖子)。之前在北京动物园饲养大象,一点都不浪漫。最后回到德云社说相声,发财娶老婆结婚。
2、ZooKeeper核心概念
ZooKeeper是 Apache基金会重要的开源项目,主要作用是提供分布式架构的协调工作。最初的设计目标是为Hadoop大数据生态服务。
官方地址:https://zookeeper.apache.org/
Apache ZooKeeper致力于开发和维护开源服务器,实现高度可靠的分布式协调架构。
ZooKeeper用于分布式协调,目标是用来构建高可用的分布式应用程序的高性能协调程序。
ZooKeeper提供了一种集中式服务,用于维护配置信息,命名,分布式同步和组服务。 所有这些类型的服务都以分布式应用程序的某种形式使用。ZooKeeper是一种用于分布式应用程序的高性能协调服务。 简单的界面中公开了常用服务API - 例如命名,配置管理,同步和组服务 - 因此我们不必从0开始开发一个这样的工具。 我们可以使用ZooKeeper现成的方法来实现共识,组管理,领导者选举和协议。 我们也可以根据自己的特定需求进行二次扩展开发。比如著名的阿里开源的RPC框架Dubbo就使用了ZooKeeper。这样可以节约大量的类似工具的开发成本。

3、ZooKeeper分布式架构
今天来看使用到ZooKeeper的地方必然是分布式架构系统,而且没有自身的高可用机制,借助ZooKeeper来实现,什么意思?就好比动物,没有人管理、喂养,会死掉的,也就是没有人管理的应用,除了没有可能整个系统就垮掉了。ZooKeeper能管理、发现、解决这些问题。
image
ZooKeeper很简单。 ZooKeeper允许分布式进程通过共享的层级命名空间相互协调,该命名空间的组织方式与标准文件系统类似。 名称空间由数据寄存器组成 - 称为znodes - 这些与文件和目录类似。 与专为存储而设计的典型文件系统不同,ZooKeeper数据保存在内存中,这意味着ZooKeeper是高性能协调协调服务程序,可以实现高吞吐量和低延迟数量。
image
ZooKeeper实现非常重视高性能,高可用性,严格有序的访问。 ZooKeeper可以在大型分布式系统中使用。 支持集群模式,可靠性方面使其不会成为单点故障。 严格的排序意味着可以在客户端实现复杂的同步原语,也就是严格的数据同步模式,。
4、ZooKeeper的典型场景
ZooKeeper在分布式系统架构中,经常可以看到,比如Hadoop大数据分布式架构,Dubbo分布式架构,Kafka消息队列分布式架构,Spring Cloud微服务架构中都有,Solr搜索引擎分布式架构等都可以使用。几乎开源分布式架构都有关系。
image
5、ZooKeeper的功能特新
ZK提供了丰富的功能特性,当然最核心的还是分布式协调,为了完整性,我们列举了所有的功能清单:
1.Naming service 命名服务
2.Updating the node’s status 更新节点状态
3.Managing the cluster 管理集群
4.Automatic failure recovery 自动故障恢复
5.Sequential Consistency 顺序一致性
6.Single System Image 单一系统视图
7.Timeliness 及时性

ZK使用简单,可靠,性能高,速度快,保证消息有序,操作的原子性,数据状态一致性。

6、ZooKeeper的核心算法
为了保障ZooKeeper分布式协调服务的高可用,ZooKeeper提供了集群模式,默认有一个Leader,领导,其他是Follower,备选。集群Leader出错,会快速进行选举,选择新的Leader,响应客户的程序的请求。
image
7、ZooKeeper的通信协议
ZooKeeper默认的通信协议是TCP,内部集群选举的协议是广播。客户端连接到单个ZooKeeper服务器。 客户端维护TCP连接,通过该连接发送请求,获取响应,获取监视事件以及发送心跳。 如果与服务器的TCP连接中断,则客户端将连接到其他服务器。
Zookeeper的选举算法使用了Zookeeper Atomic Broadcast协议,(简称ZAB,Zookeeper原子消息广播协议)作为数据一致性同步的核心算法的通信协议。ZAB是一种与Paxos不同的协议,后面我们会专门来讲解这个过程。

8、ZooKeeper的典型公司
几乎著名的互联网公司都在使用Zookeeper:
阿里巴巴
蚂蚁金服
腾讯
华为
今日头条
Google
Yahoo
Facebook
eBay
Twitter
Netflix
等名企都在使用。

我们以后慢慢来详细学习,下一个文章我们学习,如何在Linux系统上安装Zookeeper。逐步深入学习ZooKeeper实战开发。
参考资料:
1、http://zookeeper.apache.org/
2、https://movie.douban.com/photos/photo/1264463926
阿里巴巴Java群超过4500人
进群方式:钉钉扫码入群
image
阿里巴巴MongoDB群
image

相关实践学习
基于MSE实现微服务的全链路灰度
通过本场景的实验操作,您将了解并实现在线业务的微服务全链路灰度能力。
目录
相关文章
|
27天前
|
存储 缓存 NoSQL
分布式系统架构8:分布式缓存
本文介绍了分布式缓存的理论知识及Redis集群的应用,探讨了AP与CP的区别,Redis作为AP系统具备高性能和高可用性但不保证强一致性。文章还讲解了透明多级缓存(TMC)的概念及其优缺点,并详细分析了memcached和Redis的分布式实现方案。此外,针对缓存穿透、击穿、雪崩和污染等常见问题提供了应对策略,强调了Cache Aside模式在解决数据一致性方面的作用。最后指出,面试中关于缓存的问题多围绕Redis展开,建议深入学习相关知识点。
166 8
|
1月前
|
存储 Prometheus Cloud Native
分布式系统架构6:链路追踪
本文深入探讨了分布式系统中的链路追踪理论,涵盖追踪与跨度的概念、追踪系统的模块划分及数据收集的三种方式。链路追踪旨在解决复杂分布式系统中请求流转路径不清晰的问题,帮助快速定位故障和性能瓶颈。文中介绍了基于日志、服务探针和边车代理的数据收集方法,并简述了OpenTracing、OpenCensus和OpenTelemetry等链路追踪协议的发展历程及其特点。通过理解这些概念,可以更好地掌握开源链路追踪框架的使用。
97 41
|
5月前
|
安全 应用服务中间件 API
微服务分布式系统架构之zookeeper与dubbo-2
微服务分布式系统架构之zookeeper与dubbo-2
|
30天前
|
存储 缓存 安全
分布式系统架构7:本地缓存
这是小卷关于分布式系统架构学习的第10篇文章,主要介绍本地缓存的基础理论。文章分析了引入缓存的利弊,解释了缓存对CPU和I/O压力的缓解作用,并讨论了缓存的吞吐量、命中率、淘汰策略等属性。同时,对比了几种常见的本地缓存工具(如ConcurrentHashMap、Ehcache、Guava Cache和Caffeine),详细介绍了它们的访问控制、淘汰策略及扩展功能。
76 6
|
1月前
|
存储 关系型数据库 分布式数据库
[PolarDB实操课] 01.PolarDB分布式版架构介绍
《PolarDB实操课》之“PolarDB分布式版架构介绍”由阿里云架构师王江颖主讲。课程涵盖PolarDB-X的分布式架构、典型业务场景(如实时交易、海量数据存储等)、分布式焦点问题(如业务连续性、一致性保障等)及技术架构详解。PolarDB-X基于Share-Nothing架构,支持HTAP能力,具备高可用性和容错性,适用于多种分布式改造和迁移场景。课程链接:[https://developer.aliyun.com/live/253957](https://developer.aliyun.com/live/253957)。更多内容可访问阿里云培训中心。
[PolarDB实操课] 01.PolarDB分布式版架构介绍
|
2月前
|
设计模式 存储 算法
分布式系统架构5:限流设计模式
本文是小卷关于分布式系统架构学习的第5篇,重点介绍限流器及4种常见的限流设计模式:流量计数器、滑动窗口、漏桶和令牌桶。限流旨在保护系统免受超额流量冲击,确保资源合理分配。流量计数器简单但存在边界问题;滑动窗口更精细地控制流量;漏桶平滑流量但配置复杂;令牌桶允许突发流量。此外,还简要介绍了分布式限流的概念及实现方式,强调了限流的代价与收益权衡。
94 11
|
2月前
|
设计模式 监控 Java
分布式系统架构4:容错设计模式
这是小卷对分布式系统架构学习的第4篇文章,重点介绍了三种常见的容错设计模式:断路器模式、舱壁隔离模式和重试模式。断路器模式防止服务故障蔓延,舱壁隔离模式通过资源隔离避免全局影响,重试模式提升短期故障下的调用成功率。文章还对比了这些模式的优缺点及适用场景,并解释了服务熔断与服务降级的区别。尽管技术文章阅读量不高,但小卷坚持每日更新以促进个人成长。
66 11
|
2月前
|
消息中间件 存储 安全
分布式系统架构3:服务容错
分布式系统因其复杂性,故障几乎是必然的。那么如何让系统在不可避免的故障中依然保持稳定?本文详细介绍了分布式架构中7种核心的服务容错策略,包括故障转移、快速失败、安全失败等,以及它们在实际业务场景中的应用。无论是支付场景的快速失败,还是日志采集的安全失败,每种策略都有自己的适用领域和优缺点。此外,文章还为技术面试提供了解题思路,助你在关键时刻脱颖而出。掌握这些策略,不仅能提升系统健壮性,还能让你的技术栈更上一层楼!快来深入学习,走向架构师之路吧!
73 11
|
2月前
|
消息中间件 架构师 数据库
本地消息表事务:10Wqps 高并发分布式事务的 终极方案,大厂架构师的 必备方案
45岁资深架构师尼恩分享了一篇关于分布式事务的文章,详细解析了如何在10Wqps高并发场景下实现分布式事务。文章从传统单体架构到微服务架构下分布式事务的需求背景出发,介绍了Seata这一开源分布式事务解决方案及其AT和TCC两种模式。随后,文章深入探讨了经典ebay本地消息表方案,以及如何使用RocketMQ消息队列替代数据库表来提高性能和可靠性。尼恩还分享了如何结合延迟消息进行事务数据的定时对账,确保最终一致性。最后,尼恩强调了高端面试中需要准备“高大上”的答案,并提供了多个技术领域的深度学习资料,帮助读者提升技术水平,顺利通过面试。
本地消息表事务:10Wqps 高并发分布式事务的 终极方案,大厂架构师的 必备方案
|
2月前
|
自然语言处理 负载均衡 Kubernetes
分布式系统架构2:服务发现
服务发现是分布式系统中服务实例动态注册和发现机制,确保服务间通信。主要由注册中心和服务消费者组成,支持客户端和服务端两种发现模式。注册中心需具备高可用性,常用框架有Eureka、Zookeeper、Consul等。服务注册方式包括主动注册和被动注册,核心流程涵盖服务注册、心跳检测、服务发现、服务调用和注销。
147 12