6.数据同步

最新推荐文章于 2024-08-25 21:52:05 发布

Cafebaby_

最新推荐文章于 2024-08-25 21:52:05 发布

阅读量89

点赞数

分类专栏： Redis 文章标签： redis java 数据库

本文链接：https://blog.csdn.net/qq_43632779/article/details/131201184

版权

Redis 专栏收录该内容

8 篇文章 0 订阅

订阅专栏

文章介绍了Redis主从复制的实现过程，包括全量复制和增量复制，以及如何通过主从级联模式缓解主库压力。在主从库网络断开时，通过重传增量数据保证数据一致。主从复制是实现Redis高可靠性的手段之一，结合AOF和RDB保证数据尽量少丢失，而集群模式和哨兵机制则确保服务尽量少中断。

摘要由CSDN通过智能技术生成

数据同步：主从库如何实现数据一致？

AOF 和 RDB，如果 Redis 发生了宕机，它们可以分别通过回放日志和重新读入 RDB 文件的方式恢复数据，从而保证尽量少丢失数据，提升可靠性。不过，即使用了这两种方法，也依然存在服务不可用的问题。如果这个实例宕机了，它在恢复期间，是无法服务新来的数据存取请求的。那我们总说的 Redis 具有 高可靠性，又是什么意思呢？其实，这里有两层含义： 一是数据尽量少丢失， 二是服务尽量少中断。 AOF 和 RDB 保证了前者，而对于后者，Redis 的做法就是增加副本冗余量（即 集群模式），将一份数据同时保存在多个实例上。即使有一个实例出现了故障，需要过一段时间才能恢复，其他实例也可以对外提供服务，不会影响业务使用。高可靠集群模式下有两个重要的概念分别是 主从复制和 哨兵机制。

1.主从复制如何实现

实现原理：读写分离+容灾备份

底层原理：全量复制+长连接命令传播+增量复制

读操作：主库、从库都可以读。主要在从库上读

写操作：只能在主库，然后主库将写操作同步给从库

[外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传(img-oYvDC6Gc-1686706870782)(C:\Users\10059\AppData\Roaming\Typora\typora-user-images\image-20221117105950883.png)]

(1)主从库第一次同步的过程(全量复制)

当我们启动多个 Redis 实例的时候，它们相互之间就可以通过 replicaof（Redis 5.0 之前使用 slaveof）命令形成主库和从库的关系，之后会按照三个阶段完成数据的第一次同步。例如，现在有实例 1（ip：172.16.19.3）和实例 2（ip：172.16.19.5），我们在实例 2 上执行以下这个命令后，实例 2 就变成了实例 1 的从库，并从实例 1 上复制数据：

replicaof  172.16.19.3  6379

主从库第一次同步是全量同步，主要分为3个阶段:

第一阶段是主从库间建立连接、协商同步的过程，主要是为全量复制做准备。在这一步，从库和主库建立起连接，并告诉主库即将进行同步，主库确认回复后，主从库间就可以开始同步了。具体来说，从库给主库发送 psync 命令，表示要进行数据同步，主库根据这个命令的参数来启动复制。psync 命令包含了主库的 runID 和复制进度 offset 两个参数。主库收到 psync 命令后，会用 FULLRESYNC 响应命令带上两个参数：主库 runID 和主库目前的复制进度 offset，返回给从库。从库收到响应后，会记录下这两个参数。这里有个地方需要注意，FULLRESYNC 响应表示第一次复制采用的全量复制，也就是说，主库会把当前所有的数据都复制给从库。
- runID，是每个 Redis 实例启动时都会自动生成的一个随机 ID，用来唯一标记这个实例。当从库和主库第一次复制时，因为不知道主库的 runID，所以将 runID 设为“？”。
- offset，此时设为 -1，表示第一次复制。
第二阶段，主库将所有数据同步给从库。从库收到数据后，在本地完成数据加载。这个过程依赖于内存快照生成的 RDB 文件。具体来说，主库执行 bgsave 命令，生成 RDB 文件，接着将文件发给从库。从库接收到 RDB 文件后，会先清空当前数据库，然后加载 RDB 文件。这是因为从库在通过 replicaof 命令开始和主库同步前，可能保存了其他数据。为了避免之前数据的影响，从库需要先把当前数据库清空。在主库将数据同步给从库的过程中，主库不会被阻塞，仍然可以正常接收请求，这些请求中的写操作并没有记录到刚刚生成的 RDB 文件中。为了保证主从库的数据一致性，主库会在内存中用专门的 replication buffer，记录 RDB 文件生成后收到的所有写操作。
第三个阶段，主库会把第二阶段执行过程中新收到的写命令，再发送给从库。具体的操作是，当主库完成 RDB 文件发送后，就会把此时 replication buffer 中的写操作发给从库，从库再重新执行这些操作。这样一来，主从库就实现同步了。那么，一旦主从库完成了全量复制，它们之间就会一直维护一个网络连接，主库会通过这个连接将后续陆续收到的命令操作再通过repl buff同步给从库，这个过程也称为基于长连接的命令传播（在这个过程中，主库会用 master_repl_offset 记录当前的最新写操作在 repl_backlog_buffer 中的位置，而从库会用 slave_repl_offset 这个值记录当前的复制进度。）可以避免频繁建立连接的开销。

(2)主-从-从模式(主从级联模式分担全量复制时的主库压力)

主从复制存在的问题1：从库数量多带来的主库全量复制性能压力
如果从库数量很多，而且都要和主库进行全量复制的话，就会导致主库忙于 fork 子进程生成 RDB 文件，进行数据全量同步。fork 这个操作会阻塞主线程处理正常请求，从而导致主库响应应用程序的请求速度变慢。此外，传输 RDB 文件也会占用主库的网络带宽，同样会给主库的资源使用带来压力。那么，有没有好的解决方法可以分担主库压力呢？
如何解决：通过“主 - 从 - 从”模式将主库生成 RDB 和传输 RDB 的压力，以级联的方式分散到从库上。
- 简单来说，我们在部署主从集群的时候，可以手动选择一个从库（比如选择内存资源配置较高的从库），用于级联其他的从库。然后，我们可以再选择一些从库（例如三分之一的从库），在这些从库上执行如下命令，让它们和刚才所选的从库，建立起主从关系。
- ```
replicaof  所选从库的IP 6379
```
图解：

(3)主从库网络断了怎么办(增量复制)

主从复制存在的问题2：网络断连或阻塞，主库不挂但是从库挂了。
如何解决：当主从库断连后，主库会把断连期间收到的写操作命令，写入 repl buffer，同时也会把这些操作命令也写入 repl_backlog_buffer 这个缓冲区。repl_backlog_buffer 是一个环形缓冲区，主库会记录自己写到的位置，从库则会记录自己已经读到的位置。刚开始的时候，主库和从库的写读位置在一起，这算是它们的起始位置。随着主库不断接收新的写操作，它在缓冲区中的写位置会逐步偏离起始位置，我们通常用偏移量来衡量这个偏移距离的大小，对主库来说，对应的偏移量就是 master_repl_offset。主库接收的新写操作越多，这个值就会越大。同样，从库在复制完写操作命令后，它在缓冲区中的读位置也开始逐步偏移刚才的起始位置，此时，从库已复制的偏移量 slave_repl_offset 也在不断增加。正常情况下，这两个偏移量基本相等。主从库的连接恢复之后，从库首先会给主库发送 psync 命令，并把自己当前的 slave_repl_offset 发给主库，主库会判断自己的 master_repl_offset 和 slave_repl_offset 之间的差距。在网络断连阶段，主库可能会收到新的写操作命令，所以，一般来说，master_repl_offset 会大于 slave_repl_offset。此时，主库只用把 master_repl_offset 和 slave_repl_offset 之间的命令操作同步给从库就行。
图解：

c77780b16.jpg?wh=3328*1689" alt=“img” style=“zoom: 33%;” />

Cafebaby_

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
6.数据同步

AOF 和 RDB，如果 Redis 发生了宕机，它们可以分别通过回放日志和重新读入 RDB 文件的方式恢复数据，从而保证尽量少丢失数据，提升可靠性。不过，即使用了这两种方法，也依然存在服务不可用的问题。如果这个实例宕机了，它在恢复期间，是无法服务新来的数据存取请求的。那我们总说的 Redis 具有，又是什么意思呢？一是数据尽量少丢失二是服务尽量少中断。，而对于后者，Redis 的做法就是增加副本冗余量（即），将一份数据同时保存在多个实例上。
复制链接

扫一扫

专栏目录