Zookeeper概念
Zookeeper
是一个分布式协调服务,可用于服务发现,分布式锁,分布式领导选举,配置管理等。
Zookeeper
提供了一个类似于Linux
文件系统的树形结构(可认为是轻量级的内存文件系统,但
只适合存少量信息,完全不适合存储大量文件或者大文件),同时提供了对于每个节点的监控与
通知机制。
Zookeeper角色
Zookeeper
集群是一个基于主从复制的高可用集群,每个服务器承担如下三种角色中的一种。
Leader
- 一个
Zookeeper
集群同一时间只会有一个实际工作的Leader
,它会发起并维护与各Follwer
及Observer
间的心跳。 - 所有的写操作必须要通过
Leader
完成再由Leader
将写操作广播给其他服务器。只有超过半数节点(不包括Observer
节点)写入成功,该写请求就会被提交(类2PC
协议)。
Follower
- 一个
Zookeeper
集群可能同时存在多个Follower
,它会响应Leader
的心跳。 Follower
可直接处理并返回客户端的读请求,同时会将写请求转发给Leader
处理。- 并且负责在
Leader
处理写请求时对请求进行投票。
Observer
- 角色与
Follower
类似,但是无投票权。 Zookeeper
需保证高可用和强一致性,为了支持更多的客户端,需要增加更多Server
;Server
增多,投票阶段延迟增大,影响性能;引入Observer
,Observer
不参与投票;Observers
接受客户端的连接,并将写请求转发给Leader
节点; 加入更多Observer
节点,提高伸缩性,同时不影响吞吐率。
ZAB协议
事务编号 Zxid (事务请求 计数器 + epoch )
- 在
ZAB
(ZooKeeper Atomic Broadcast
,ZooKeeper
原子消息广播协议) 协议的事务编号Zxid
设计中,Zxid
是一个 64 位的数字,其中低 32 位是一个简单的单调递增的计数器,针对客户端每一个事务请求,计数器加 1;而高 32 位则代表Leader
周期epoch
的编号,每个当选产生一个新的Leader
服务器,就会从这个Leader
服务器上取出其本地日志中最大事务的ZXID
,并从中读取epoch
值,然后加 1,以此作为新的epoch
,并将低 32 位从 0 开始计数。Zxid
(Transaction id
)类似于RDBMS
中的事务 ID,用于标识一次更新操作的Proposal
(提议)ID
。为了保证顺序性,该 zkid 必须单调递增。
epoch
- epoch:可以理解为当前集群所处的年代或者周期,每个
Leader
就像皇帝,都有自己的年号,所
以每次改朝换代,Leader
变更之后,都会在前一个年代的基础上加 1。这样就算旧的Leader
崩溃恢复之后,也没有人听他的了,因为Follower
只听从当前年代的Leader
的命令。
Zab 协议有两种模式 - 恢复模式(选主)、广播模式(同步 )
Zab
协议有两种模式,它们分别是恢复模式(选主)和广播模式(同步)。当服务启动或者在领导
者崩溃后,Zab
就进入了恢复模式,当领导者被选举出来,且大多数Server
完成了和Leader
的状态同步以后,恢复模式就结束了。状态同步保证了Leader
和Server
具有相同的系统状态。
ZAB 协议 4 阶段
-
Leader election (选举阶段 - 选出准 Leader )
Leader election
(选举阶段):节点在一开始都处于选举阶段,只要有一个节点得到超半数
节点的票数,它就可以当选准 leader。只有到达 广播阶段(broadcast
) 准Leader
才会成
为真正的Leader
。这一阶段的目的是就是为了选出一个准Leader
,然后进入下一个阶段。
-
Discovery (发现阶段 - 接受提议、生成 epoch 、接受 epoch )
Discovery
(发现阶段):在这个阶段,followers
跟准leader
进行通信,同步followers
最近接收的事务提议。这个一阶段的主要目的是发现当前大多数节点接收的最新提议,并且准 leader 生成新的epoch
,让followers
接受,更新它们的accepted Epoch
一个follower
只会连接一个leader
,如果有一个节点 f 认为另一个follower
p 是leader
,f在尝试连接 p 时会被拒绝,f 被拒绝之后,就会进入重新选举阶段。
-
Synchronization (同步阶段 - 同步 follower 副本 )
-
Broadcast (广播阶段 -leader 消息广播 )