Hadoop生态圈（五）：Zookeeper

最新推荐文章于 2023-06-30 17:58:52 发布

jiezou12138

最新推荐文章于 2023-06-30 17:58:52 发布

阅读量390

点赞数

分类专栏： Hadoop

本文链接：https://blog.csdn.net/jiezou12138/article/details/89224836

版权

Hadoop 专栏收录该内容

13 篇文章 2 订阅

订阅专栏

1 Zookeeper

1.1 概述

Zookeeper是一个开源的、分布式的，为分布式应用提供协调服务的Apache项目

Zookeeper从设计模式角度来理解：是一个基于观察者模式设计的分布式服务管理框架，他负责存储和管理大家都关心的数据，然后接受观察者的注册，一旦这些数据的状态发生变化，Zookeeper就将通知已经再zookeeper上注册的那些观察者，通知其做出相应的反应，从而实现集群中类似Master/Slave管理模式

简单来说：Zookeeper = 文件系统（可以再zk上存储数据）+ 通知机制

1.2 特点

zookeeper：一个领导者（leader），多个跟随者（follower）组成的集群
Leader负责进行投票的发起和决议，更新系统状态
Follower用于接收客户端请求，并向客户端返回结果，在选举leader过程中参与投票
集群中只要由半数以上节点存活，zookeeper集群就可以正常工作，提供服务
全局数据一致：每个server保存一份相同的数据副本，client无论连接哪一个server，数据都是一致的
更新请求按顺序进行，来自一个client的更新请求按其发送顺序依次进行
数据更新原子性，一次数据跟新要么全部成功，要么全部失败
实时性，在一定的时间范围内，client能读到最新的数据

1.3 数据结构

zookeeper数据模型的结构和Unix文件系统很类似，整体上可以看作为一棵树，每个节点称为一个ZNode

显然，zookeeper集群自身维护了一套数据结构，这个结构就是一个树形结构，其上的每一个节点成为“znode”，每个znode节点默认能够存储1MB的数据，每个znode节点都可以通过其路径唯一标识，如图所示

那zookeeper这颗“树”有什么特点呢？ zookeeper的节点znode分为两种类型：

短暂/临时（ephemeral）：当客户端和服务端断开连接之后，所创建的znode节点会自动删除
持久（persistent）：当客户端和服务端断开连接后，所创建的znode节点不会删除

1.4 应用场景，

提供的服务包括：分布式消息同步和协调机制、服务器节点动态上下线、统一配置管理、负载均衡、集群管理等，如图

1.5 下载地址

官网：https://zookeeper.apache.org （俗称动物园管理员）

网盘：请点这里提取码：yzpk

2 zookeeper安装部署

2.1 分布式安装部署

1. 集群规划

在hadoop101、hadoop102和hadoop103三个节点上部署zookeeper

2. 解压安装

将下载的zookeeper文件上传到虚拟机上

1. 解压 zookeeper安装包到/opt/module/目录下

[root@hadoop101 software]$ tar -zxvf zookeeper-3.4.10.tar.gz -C /opt/module/

2. 在 /opt/module/zookeeper-3.4.10/这个目录下创建zkData （后面有解释）

3. 重命名/opt/module/zookeeper-3.4.10/conf这个目录下的zoo_sample.cfg为zoo.cfg

3. 配置zoo.cfg文件

1. 具体配置

dataDir=/opt/module/zookeeper-3.4.10/zkData

增加如下配置：

2. 配置参数解读

server.A=B:C:D

A是一个数字，表示这个是第几号服务器；

B是这个服务器的ip地址；

C是这个服务器与集群中的Leader服务器交换信息的端口；

D是万一集群中的Leader服务器挂了，需要一个端口来重新进行选举，选出一个新的Leader，而这个端口就是用来执行选举时服务器相互通信的端口。

集群模式下配置一个文件myid，这个文件在dataDir目录下，这个文件里面有一个数据就是A的值，Zookeeper启动时读取此文件，拿到里面的数据与zoo.cfg里面的配置信息比较从而判断到底是哪个server。

4. 集群操作

1. 在/opt/module/zookeeper-3.4.10/zkData目录下创建一个myid的文件，并编辑该文件

touch myid

vim myid 在文件中添加与server对应的编号：如1

2. 拷贝配置好的zookeeper到另外两台机器上，并分别修改myid文件中的内容为2、3

3. 分别启动zookeeper

[root@hadoop101 zookeeper-3.4.10]# bin/zkServer.sh start

[root@hadoop102 zookeeper-3.4.10]# bin/zkServer.sh start

[root@hadoop103 zookeeper-3.4.10]# bin/zkServer.sh start

4. 查看状态

[root@hadoop101 zookeeper-3.4.10]# bin/zkServer.sh status

JMX enabled by default

Using config: /opt/module/zookeeper-3.4.10/bin/../conf/zoo.cfg

Mode: follower

[root@hadoop102 zookeeper-3.4.10]# bin/zkServer.sh status

JMX enabled by default

Using config: /opt/module/zookeeper-3.4.10/bin/../conf/zoo.cfg

Mode: leader

[root@hadoop103 zookeeper-3.4.5]# bin/zkServer.sh status

JMX enabled by default

Using config: /opt/module/zookeeper-3.4.10/bin/../conf/zoo.cfg

Mode: follower

2.2 配置参数解读

解释zoo.cfg文件中参数含义

1. tickTime: 通信心跳数，Zookeeper服务器心跳时间，单位毫秒

Zookeeper使用的基本时间，服务器之间维持心跳的时间间隔，也就是每个tickTime时间都会发送一个心跳，报活

2. initLinit：LF初始通信时限

集群中的follower跟随着服务器（F）与leader领导者服务器（L）之间初始连接时能容忍的最多心跳数，用它来界定集群中的zookeeper服务器连接到 Leader的时限

3. syncLimit：LF同步通信时限

集群中的Leader与Follower之间的最大相应时间单位，假如响应超过syncLimit*tickTime，Leader认为Follower挂掉，从服务器列表中删除

在运行过程中，Leader负责与ZK集群中的所有机器进行通信，例如通过一些心跳检测机制，来检测机器的存活状态。

如果Leader发出心跳包在syncLimit之后，还没有从Follower那收到响应，那么就认为i这个Follower已经不在线了

4. dataDir：数据文件目录+数据持久化路径

保存内存数据库快照信息的位置，如果没有其他说明，更新的事务日志也保存到数据库。

5. clientPort：客户端连接端口

监控客户端连接的端口

3 Zookeeper内部原理

3.1 选举机制

1. 半数机制：集群中半数以上存活，集群可用，否则集群处于瘫痪状态不可用。

为什么说zookeeper适合装在奇数台机器上？

原因：比如三个节点的zookeeper集群，要想保证集群可用，最多挂掉一个节点；如果是四个节点的zookeepe集群，要想保证集群可用，最多也只能挂掉一个节点，如果挂掉两个就不满足半数以上存活。所以说奇数个节点和偶数个节点对于zookeeper节点宕机的容忍度是相同的，所以选用奇数个节点，避免浪费资源

2. 选举机制：

zookeeper虽然在配置文件中并没有指定leader和follower。但是在zookeeper集群工作时，是有一个节点为leader，其他节点为follower，Leader是通过内部的选举机制临时产生的

选举机制以下面的例子说明

假设有五台服务器组成的zookeeper集群，它们的id从1-5，同时它们都是最新启动的。假设这些服务器依序启动，来看看会发生什么

（1）服务器1启动，此时只有它一台服务器启动了，它发出去的报没有任何响应，所以它的选举状态一直是LOOKING状态。

（2）服务器2启动，它与最开始启动的服务器1进行通信，互相交换自己的选举结果，由于两者都没有历史数据，所以id值较大的服务器2胜出，但是由于没有达到超过半数以上的服务器都同意选举它(这个例子中的半数以上是3)，所以服务器1、2还是继续保持LOOKING状态。

（3）服务器3启动，根据前面的理论分析，服务器3成为服务器1、2、3中的老大，而与上面不同的是，此时有三台服务器选举了它，所以它成为了这次选举的leader。

（4）服务器4启动，根据前面的分析，理论上服务器4应该是服务器1、2、3、4中最大的，但是由于前面已经有半数以上的服务器选举了服务器3，所以它只能接收当小弟的命了。

（5）服务器5启动，同4一样当小弟。

3.2 节点类型

1. Znode有两种类型四种形式的目录节点（默认是persistent）

（1）持久化目录节点（PERSISTENT）

客户端与zookeeper断开连接后，该节点依旧存在

（2）持久化顺序编号目录节点（PERSISTENT_SEQUENTIAL）

客户端与zookeeper断开连接后，该节点依旧存在，只是Zookeeper给该节点名称进行顺序编号

（3）临时目录节点（EPHEMERAL）

客户端与zookeeper断开连接后，该节点被删除

（4）临时顺序编号目录节点（EPHEMERAL_SEQUENTIAL）

客户端与zookeeper断开连接后，该节点被删除，只是Zookeeper给该节点名称进行顺序编号

2．创建znode时设置顺序标识，znode名称后会附加一个值，顺序号是一个单调递增的计数器，由父节点维护

3．在分布式系统中，顺序号可以被用于为所有的事件进行全局排序，这样客户端可以通过顺序号推断事件的顺序

3.3 监听原理

1. 监听原理

首先要有一个main()线程
在main线程中创建Zookeeper客户端，这时就会创建两个线程，一个负责网络连接通信（connect），一个负责监听（listener）。
通过connect线程将注册的监听事件发送给Zookeeper。
在Zookeeper的注册监听器列表中将注册的监听事件添加到列表中。
Zookeeper监听到有数据或路径变化，就会将这个消息发送给listener线程。
listener线程内部调用了process（）方法。

2. 常见的监听

1. 监听节点数据的变化

get path [watch]

2. 监听节点增减的变化

ls path [watch]

3.5 写数据流程

ZooKeeper 的写数据流程主要分为以下几步：

1）比如 Client 向 ZooKeeper 的 Server1 上写数据，发送一个写请求。
2）如果Server1不是Leader，那么Server1 会把接受到的请求进一步转发给Leader，因为每个ZooKeeper的Server里面有一个是Leader。这个Leader 会将写请求广播给各个Server，比如Server1和Server2，各个Server写成功后就会通知Leader。
3）当Leader收到大多数 Server 数据写成功了，那么就说明数据写成功了。如果这里三个节点的话，只要有两个节点数据写成功了，那么就认为数据写成功了。写成功之后，Leader会告诉Server1数据写成功了。
4）Server1会进一步通知 Client 数据写成功了，这时就认为整个写操作成功。

4 zookeeper实战

4.1 客户端命令行操作

命令基本语法	功能描述
help	显示所有操作命令
ls path [watch]	使用 ls 命令来查看当前znode中所包含的内容
ls2 path [watch]	查看当前节点数据并能看到更新次数等数据
create	普通创建 -s 含有序列 -e 临时（重启或者超时消失）
get path [watch]	获得节点的值
set	设置节点的具体值
stat	查看节点状态
delete	删除节点
rmr	递归删除节点

1. 启动客户端

[root@hadoop101 zookeeper-3.4.10]$ bin/zkCli.sh

2. 显示所有操作命令

[zk: localhost:2181(CONNECTED) 1] help

3. 查看当前znode中所包含的内容

[zk: localhost:2181(CONNECTED) 0] ls /

[zookeeper]

4．查看当前节点数据并能看到更新次数等数据

[zk: localhost:2181(CONNECTED) 1] ls2 /

[zookeeper]

cZxid = 0x0

ctime = Thu Jan 01 08:00:00 CST 1970

mZxid = 0x0

mtime = Thu Jan 01 08:00:00 CST 1970

pZxid = 0x0

cversion = -1

dataVersion = 0

aclVersion = 0

ephemeralOwner = 0x0

dataLength = 0

numChildren = 1

5．创建普通节点

[zk: localhost:2181(CONNECTED) 2] create /app1 "hello app1"

Created /app1

[zk: localhost:2181(CONNECTED) 4] create /app1/server101 "192.168.1.101"

Created /app1/server101

6．获得节点的值

[zk: localhost:2181(CONNECTED) 6] get /app1

hello app1

cZxid = 0x20000000a

ctime = Mon Jul 17 16:08:35 CST 2017

mZxid = 0x20000000a

mtime = Mon Jul 17 16:08:35 CST 2017

pZxid = 0x20000000b

cversion = 1

dataVersion = 0

aclVersion = 0

ephemeralOwner = 0x0

dataLength = 10

numChildren = 1

[zk: localhost:2181(CONNECTED) 8] get /app1/server101

192.168.1.101

cZxid = 0x20000000b

ctime = Mon Jul 17 16:11:04 CST 2017

mZxid = 0x20000000b

mtime = Mon Jul 17 16:11:04 CST 2017

pZxid = 0x20000000b

cversion = 0

dataVersion = 0

aclVersion = 0

ephemeralOwner = 0x0

dataLength = 13

numChildren = 0

7．创建短暂节点

[zk: localhost:2181(CONNECTED) 9] create -e /app-emphemeral 8888

（1）在当前客户端是能查看到的

[zk: localhost:2181(CONNECTED) 10] ls /

[app1, app-emphemeral, zookeeper]

（2）退出当前客户端然后再重启客户端

[zk: localhost:2181(CONNECTED) 12] quit

[bigdata@hadoop104 zookeeper-3.4.10]$ bin/zkCli.sh

（3）再次查看根目录下短暂节点已经删除

[zk: localhost:2181(CONNECTED) 0] ls /

[app1, zookeeper]

8．创建带序号的节点

（1）先创建一个普通的根节点app2

[zk: localhost:2181(CONNECTED) 11] create /app2 "app2"

（2）创建带序号的节点

[zk: localhost:2181(CONNECTED) 13] create -s /app2/aa 888

Created /app2/aa0000000000

[zk: localhost:2181(CONNECTED) 14] create -s /app2/bb 888

Created /app2/bb0000000001

[zk: localhost:2181(CONNECTED) 15] create -s /app2/cc 888

Created /app2/cc0000000002

如果原节点下有1个节点，则再排序时从1开始，以此类推。

[zk: localhost:2181(CONNECTED) 16] create -s /app1/aa 888

Created /app1/aa0000000001

9．修改节点数据值

[zk: localhost:2181(CONNECTED) 2] set /app1 999

10．节点的值变化监听

（1）在103主机上注册监听/app1节点数据变化

[zk: localhost:2181(CONNECTED) 26] get /app1 watch

（2）在102主机上修改/app1节点的数据

[zk: localhost:2181(CONNECTED) 5] set /app1 777

（3）观察103主机收到数据变化的监听

WATCHER::

WatchedEvent state:SyncConnected type:NodeDataChanged path:/app1

11．节点的子节点变化监听（路径变化）

（1）在103主机上注册监听/app1节点的子节点变化

[zk: localhost:2181(CONNECTED) 1] ls /app1 watch

[aa0000000001, server101]

（2）在102主机/app1节点上创建子节点

[zk: localhost:2181(CONNECTED) 6] create /app1/bb 666

Created /app1/bb

（3）观察103主机收到子节点变化的监听

WATCHER::

WatchedEvent state:SyncConnected type:NodeChildrenChanged path:/app1

12．删除节点

[zk: localhost:2181(CONNECTED) 4] delete /app1/bb

13．递归删除节点

[zk: localhost:2181(CONNECTED) 7] rmr /app2

14．查看节点状态

[zk: localhost:2181(CONNECTED) 12] stat /app1

cZxid = 0x20000000a

ctime = Mon Jul 17 16:08:35 CST 2017

mZxid = 0x200000018

mtime = Mon Jul 17 16:54:38 CST 2017

pZxid = 0x20000001c

cversion = 4

dataVersion = 2

aclVersion = 0

ephemeralOwner = 0x0

dataLength = 3

numChildren = 2

4.2 stat结构体

1）czxid- 引起这个znode创建的zxid，创建节点的事务的zxid
每次修改ZooKeeper状态都会收到一个zxid形式的时间戳，也就是ZooKeeper事务ID。
事务ID是ZooKeeper中所有修改总的次序。每个修改都有唯一的zxid，如果zxid1小于zxid2，那么zxid1在zxid2之前发生。
2）ctime - znode被创建的毫秒数(从1970年开始)
3）mzxid - znode最后更新的zxid
4）mtime - znode最后修改的毫秒数(从1970年开始)
5）pZxid-znode最后更新的子节点zxid
6）cversion - znode子节点变化号，znode子节点修改次数
7）dataversion - znode数据变化号
8）aclVersion - znode访问控制列表的变化号
9）ephemeralOwner- 如果是临时节点，这个是znode拥有者的session id。如果不是临时节点则是0。
10）dataLength- znode的数据长度
11）numChildren - znode子节点数量

4.3 API应用

首先导入下面的依赖

<!-- https://mvnrepository.com/artifact/org.apache.zookeeper/zookeeper -->
<dependency>
    <groupId>org.apache.zookeeper</groupId>
    <artifactId>zookeeper</artifactId>
    <version>3.4.10</version>
</dependency>

package com.zookeeper;

import org.apache.zookeeper.*;
import org.apache.zookeeper.data.Stat;
import org.junit.Before;
import org.junit.Test;

import java.io.IOException;
import java.util.List;

public class ZkDemo {

    private String connectStr = "hadoop101:2181,hadoop102:2181,hadoop103:2181";
    private int sessionTimeout = 20000;

    private ZooKeeper zkClient;

    /**
     * 创建zookeeper客户端
     */
    @Before
    public void testZk() throws Exception {
        zkClient = new ZooKeeper(connectStr, sessionTimeout, new Watcher() {
            @Override
            public void process(WatchedEvent watchedEvent) {
                System.out.println("event type:" + watchedEvent.getType() + "  path:" + watchedEvent.getPath());
                // 获取子节点信息的同时，开启对该节点的监控（监控子节点增加或者删除）
                List<String> children = null;
                try {
                    children = zkClient.getChildren("/", true);
                } catch (Exception e) {
                    e.printStackTrace();
                }
            }
        });
    }

    /**
     * 创建子节点
     * @throws Exception
     */
    @Test
    public void testCreateNode() throws Exception {
        zkClient.create("/ceshi","testValue".getBytes(), ZooDefs.Ids.OPEN_ACL_UNSAFE, CreateMode.PERSISTENT);
    }

    /**
     * 创建子节点并监听
     * @throws Exception
     */
    @Test
    public void testGetChildren() throws Exception {
        // 获取子节点信息的同时，开启对该节点的监控（监控子节点增加或者删除）
        List<String> children = zkClient.getChildren("/", true);
        for(String child: children) {
            System.out.println("=========>child:" + child);
        }
        // 线程阻塞
        Thread.sleep(Integer.MAX_VALUE);
    }

    /**
     * 判断节点是否存在
     * @throws Exception
     */
    @Test
    public void testExists() throws Exception {
        Stat exists = zkClient.exists("/app1", false);
        System.out.println(exists);
    }
}

jiezou12138

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
Hadoop生态圈（五）：Zookeeper

目录1 Zookeeper1.1 概述1.2 特点1.3 数据结构1.4 应用场景，1.5 下载地址2 zookeeper安装部署2.1 分布式安装部署2.2 配置参数解读3 Zookeeper内部原理3.1 选举机制3.2 节点类型3.3 监听原理3.5 写数据流程4 zookeeper实战4.1 客户端命令行操作4.2sta...
复制链接

扫一扫

专栏目录