文章目录
- 1.ZooKeeper是什么?
- 2.什么是Zookeeper 文件系统?
- 3.四种类型的数据节点 Znode
- 4.Zookeeper Watcher 机制 -- 数据变更通知
- 5.会话管理
- 6.服务器角色
- 7.Zookeeper 下 Server 工作状态
- 8.数据同步
- 9.zookeeper 是如何保证事务的顺序一致性的?
- 10.分布式集群中为什么会有 Master?
- 11.zk 节点宕机如何处理?
- 12.zookeeper 负载均衡和 nginx 负载均衡区别
- 13. Zookeeper 有哪几种几种部署模式?
- 14.集群最少要几台机器,集群规则是怎样的
- 15.集群支持动态添加机器吗?
- 16.Zookeeper 对节点的 watch监听通知是永久的吗?为什么不是永久的
- 17.Zookeeper 的典型应用场景
- 18.ZooKeeper 提供了什么?
- 19.Zookeeper 怎么保证主从节点的状态同步?
- 20. Zookeeper 都有哪些功能?
- 21. 说一下 Zookeeper 的通知机制?
1.ZooKeeper是什么?
- ZooKeeper 是一个开放源码的分布式协调服务,它是集群的管理者,监视着集群中各个节点的状态根据节点提交的反馈进行下一步合理操作。最终,将简单易用的接口和性能高效、功能稳定的系统提供给用户。
- 分布式应用程序可以基于 Zookeeper 实现诸如数据发布/订阅、负载均衡、命名服务、分布式协调/通知、集群管理、Master 选举、分布式锁和分布式队列等功能。
- 客户端的读请求可以被集群中的任意一台机器处理,如果读请求在节点上注册了监听器,这个监听器也是由所连接的zookeeper 机器来处理。对于写请求,这些请求会同时发给其他 zookeeper 机器并且达成一致后,请求才会返回成功。因此,随着 zookeeper 的集群机器增多,读请求的吞吐会提高但是写请求的吞吐会下降。
- 有序性是 zookeeper 中非常重要的一个特性,所有的更新都是全局有序的,每个更新都有一个唯一的时间戳,这个时间戳称为 zxid(Zookeeper Transaction Id)。而读请求只会相对于更新有序,也就是读请求的返回结果中会带有这个zookeeper 最新的 zxid。
2.什么是Zookeeper 文件系统?
- Zookeeper 提供一个多层级的节点命名空间(节点称为 znode)。与文件系统不同的是,这些节点都可以设置关联的数据,而文件系统中只有文件节点可以存放数据而目录节点不行。
- Zookeeper 为了保证高吞吐和低延迟,在内存中维护了这个树状的目录结构,这种特性使得 Zookeeper 不能用于存放大量的数据,每个节点的存放数据上限为1M。
3.四种类型的数据节点 Znode
- 1、PERSISTENT-持久节点除非手动删除,否则节点一直存在于 Zookeeper 上
- 2、EPHEMERAL-临时节点临时节点的生命周期与客户端会话绑定,一旦客户端会话失效(客户端与zookeeper 连接断开不一定会话失效),那么这个客户端创建的所有临时节点都会被移除。
- 3、PERSISTENT_SEQUENTIAL-持久顺序节点基本特性同持久节点,只是增加了顺序属性,节点名后边会追加一个由父节点维护的自增整型数字。
- 4、EPHEMERAL_SEQUENTIAL-临时顺序节点基本特性同临时节点,增加了顺序属性,节点名后边会追加一个由父节点维护的自增整型数字。
4.Zookeeper Watcher 机制 – 数据变更通知
Zookeeper 允许客户端向服务端的某个 Znode 注册一个 Watcher 监听,当服务端的一些指定事件触发了这个 Watcher,服务端会向指定客户端发送一个事件通知来实现分布式的通知功能,然后客户端根据 Watcher 通知状态和事件类型做出业务上的改变。
工作机制:
- 1、客户端注册 watcher
- 2、服务端处理 watcher
- 3、客户端回调 watcher
客户端注册 Watcher 实现
- 1、调用 getData()/getChildren()/exist()三个 API,传入 Watcher 对象
- 2、标记请求 request,封装 Watcher 到 WatchRegistration
- 3、封装成 Packet 对象,发服务端发送 request
- 4、收到服务端响应后,将 Watcher注册到ZKWatcherManager 中进行管理
- 5、请求返回,完成注册。
服务端处理 Watcher 实现
- 1、服务端接收 Watcher 并存储接收到客户端请求,处理请求判断是否需要注册 Watcher,需要的话将数据节点的节点路径和 ServerCnxn(ServerCnxn 代表一个客户端和服务端的连接,实现了 Watcher 的 process 接口,此时可以看成一个 Watcher 对象)存储在WatcherManager 的 WatchTable 和 watch2Paths 中去。
- 2、Watcher 触发
以服务端接收到 setData() 事务请求触发 NodeDataChanged 事件为例:- 2.1 封装 WatchedEvent将通知状态(SyncConnected)、事件类型(NodeDataChanged)以及节点路径封装成一个 WatchedEvent 对象
- 2.2 查询 Watcher
从 WatchTable 中根据节点路径查找 Watcher - 2.3 没找到;说明没有客户端在该数据节点上注册过 Watcher
- 2.4 找到;提取并从 WatchTable 和 Watch2Paths 中删除对应 Watcher(从这里可以看出 Watcher 在服务端是一次性的,触发一次就失效了)
- 3、调用 process 方法来触发 Watcher
这里 process 主要就是通过 ServerCnxn 对应的 TCP 连接发送 Watcher 事件通知。
客户端回调 Watcher
- 客户端 SendThread 线程接收事件通知,交由 EventThread 线程回调 Watcher。
- 客户端的 Watcher 机制同样是一次性的,一旦被触发后,该 Watcher 就失效了。
5.会话管理
- 分桶策略:将类似的会话放在同一区块中进行管理,以便于 Zookeeper 对会话进行不同区块的隔离处理以及同一区块的统一处理。
- 分配原则:每个会话的“下次超时时间点”(ExpirationTime)
- 计算公式:
- ExpirationTime_ = currentTime + sessionTimeout
- ExpirationTime = (ExpirationTime_ / ExpirationInrerval + 1) *
- ExpirationInterval , ExpirationInterval 是指 Zookeeper 会话超时检查时间间隔,默认 tickTime
6.服务器角色
Leader
- 1、事务请求的唯一调度和处理者,保证集群事务处理的顺序性
- 2、集群内部各服务的调度者
Follower
- 1、处理客户端的非事务请求,转发事务请求给 Leader 服务器
- 2、参与事务请求 Proposal 的投票
- 3、参与 Leader 选举投票
Observer
- 1、3.0 版本以后引入的一个服务器角色,在不影响集群事务处理能力的基础上提升集群的非事务处理能力
- 2、处理客户端的非事务请求,转发事务请求给 Leader 服务器
- 3、不参与任何形式的投票
7.Zookeeper 下 Server 工作状态
服务器具有四种状态,分别是 LOOKING、FOLLOWING、LEADING、OBSERVING。
- 1、LOOKING:寻找 Leader 状态。当服务器处于该状态时,它会认为当前集群中没有 Leader,因此需要进入 Leader 选举状态。
- 2、FOLLOWING:跟随者状态。表明当前服务器角色是 Follower。
- 3、LEADING:领导者状态。表明当前服务器角色是 Leader。
- 4、OBSERVING:观察者状态。表明当前服务器角色是 Observer。
8.数据同步
-
整个集群完成 Leader 选举之后,Learner(Follower 和 Observer 的统称)回向Leader 服务器进行注册。当 Learner 服务器想 Leader 服务器完成注册后,进入数据同步环节。
-
数据同步流程:(均以消息传递的方式进行)
- Learner 向 Learder 注册
- 数据同步
- 同步确认
-
Zookeeper 的数据同步通常分为四类:
- 1、直接差异化同步(DIFF 同步)
- 2、先回滚再差异化同步(TRUNC+DIFF 同步)
- 3、仅回滚同步(TRUNC 同步)
- 4、全量同步(SNAP 同步)
9.zookeeper 是如何保证事务的顺序一致性的?
zookeeper 采用了全局递增的事务 Id 来标识,所有的 proposal(提议)都在被提出的时候加上了 zxid,zxid 实际上是一个 64 位的数字,高 32 位是 epoch(时期; 纪元; 世; 新时代)用来标识 leader 周期,如果有新的 leader 产生出来,epoch会自增,低 32 位用来递增计数。当新产生 proposal 的时候,会依据数据库的两阶段过程,首先会向其他的 server 发出事务执行请求,如果超过半数的机器都能执行并且能够成功,那么就会开始执行。
10.分布式集群中为什么会有 Master?
在分布式环境中,有些业务逻辑只需要集群中的某一台机器进行执行,其他的机器可以共享这个结果,这样可以大大减少重复计算,提高性能,于是就需要进行leader 选举。
11.zk 节点宕机如何处理?
- Zookeeper 本身也是集群,推荐配置不少于 3 个服务器。Zookeeper 自身也要保证当一个节点宕机时,其他节点会继续提供服务。
- 如果是一个 Follower 宕机,还有 2 台服务器提供访问,因为 Zookeeper 上的数据是有多个副本的,数据并不会丢失;
- 如果是一个 Leader 宕机,Zookeeper 会选举出新的 Leader。
ZK 集群的机制是只要超过半数的节点正常,集群就能正常提供服务。只有在 ZK节点挂得太多,只剩一半或不到一半节点能工作,集群才失效。 - 所以3 个节点的 cluster 可以挂掉 1 个节点(leader 可以得到 2 票>1.5),2 个节点的 cluster 就不能挂掉任何 1 个节点了(leader 可以得到 1 票<=1)
12.zookeeper 负载均衡和 nginx 负载均衡区别
zk 的负载均衡是可以调控,nginx 只是能调权重,其他需要可控的都需要自己写插件;但是 nginx 的吞吐量比 zk 大很多,应该说按业务选择用哪种方式。
13. Zookeeper 有哪几种几种部署模式?
部署模式:单机模式、伪集群模式、集群模式。
14.集群最少要几台机器,集群规则是怎样的
集群规则为 2N+1 台,N>0,即 3 台。
15.集群支持动态添加机器吗?
其实就是水平扩容了,Zookeeper 在这方面不太好。两种方式:
- 全部重启:关闭所有 Zookeeper 服务,修改配置之后启动。不影响之前客户端的会话。
- 逐个重启:在过半存活即可用的原则下,一台机器重启不影响整个集群对外提供服务。这是比较常用的方式。
3.5 版本开始支持动态扩容。
16.Zookeeper 对节点的 watch监听通知是永久的吗?为什么不是永久的
不是。官方声明:一个 Watch 事件是一个一次性的触发器,当被设置了 Watch的数据发生了改变的时候,则服务器将这个改变发送给设置了 Watch 的客户端,以便通知它们。
为什么不是永久的
举个例子,如果服务端变动频繁,而监听的客户端很多情况
下,每次变动都要通知到所有的客户端,给网络和服务器造成很大压力。
一般是客户端执行 getData(“/节点 A”,true),如果节点 A 发生了变更或删除,客户端会得到它的 watch 事件,但是在之后节点 A 又发生了变更,而客户端又没有设置 watch 事件,就不再给客户端发送。
在实际应用中,很多情况下,我们的客户端不需要知道服务端的每一次变动,我只要最新的数据即可。
17.Zookeeper 的典型应用场景
Zookeeper 是一个典型的发布/订阅模式的分布式数据管理与协调框架,开发人员可以使用它来进行分布式数据的发布和订阅。
通过对 Zookeeper 中丰富的数据节点进行交叉使用,配合 Watcher 事件通知机制,可以非常方便的构建一系列分布式应用中年都会涉及的核心功能,如:
- 1、数据发布/订阅
- 2、负载均衡
- 3、命名服务
- 4、分布式协调/通知
- 5、集群管理
- 6、Master 选举
- 7、分布式锁
- 8、分布式队列
18.ZooKeeper 提供了什么?
-
文件系统
-
通知机制
19.Zookeeper 怎么保证主从节点的状态同步?
Zookeeper 的核心是原子广播机制,这个机制保证了各个 server 之间的同步。实现这个机制的协议叫做 Zab 协议。Zab 协议有两种模式,它们分别是恢复模式和广播模式。
恢复模式
当服务启动或者在领导者崩溃后,Zab就进入了恢复模式,当领导者被选举出来,且大多数 server 完成了和 leader 的状态同步以后,恢复模式就结束了。状态同步保证了 leader 和 server 具有相同的系统状态。
广播模式
一旦 leader 已经和多数的 follower 进行了状态同步后,它就可以开始广播消息了,即进入广播状态。这时候当一个 server 加入 ZooKeeper 服务中,它会在恢复模式下启动,发现 leader,并和 leader 进行状态同步。待到同步结束,它也参与消息广播。ZooKeeper 服务一直维持在 Broadcast 状态,直到 leader 崩溃了或者 leader 失去了大部分的followers 支持。
20. Zookeeper 都有哪些功能?
-
集群管理:监控节点存活状态、运行请求等;
-
主节点选举:主节点挂掉了之后可以从备用的节点开始新一轮选主,主节点选举说的就是这个选举的过程,使用 Zookeeper 可以协助完成这个过程;
-
分布式锁:Zookeeper 提供两种锁:独占锁、共享锁。独占锁即一次只能有一个线程使用资源,共享锁是读锁共享,读写互斥,即可以有多线线程同时读同一个资源,如果要使用写锁也只能有一个线程使用。Zookeeper 可以对分布式锁进行控制。
-
命名服务:在分布式系统中,通过使用命名服务,客户端应用能够根据指定名字来获取资源或服务的地址,提供者等信息。
21. 说一下 Zookeeper 的通知机制?
client 端会对某个 znode 建立一个 watcher 事件,当该 znode 发生变化时,这些 client 会收到 zk 的通知,然后 client 可以根据 znode 变化来做出业务上的改变等。