redis主从同步原理

最新推荐文章于 2024-10-31 14:53:53 发布

Fan0914

最新推荐文章于 2024-10-31 14:53:53 发布

阅读量920

点赞数 23

文章标签： redis 数据库服务器

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/m0_63095134/article/details/135216165

版权

文章详细解释了Redis主从数据库的同步过程，包括全量同步（初次连接时复制所有数据）和增量同步（仅同步差异数据）。重点介绍了ReplicationId和repl_baklog在判断节点状态和数据同步中的作用。

摘要由CSDN通过智能技术生成

全量同步

主从第一次建立连接时，会执行全量同步，将master节点的所有数据都拷贝给slave节点，流程：

master如何得知salve是第一次来连接呢？？

有几个概念，可以作为判断依据：

Replication Id：简称replid，是数据集的标记，id一致则说明是同一数据集。每一个master都有唯一的replid，slave则会继承master节点的replid
offset：偏移量，随着记录在repl_baklog中的数据增多而逐渐增大。slave完成同步时也会记录当前同步的offset。如果slave的offset小于master的offset，说明slave数据落后于master，需要更新。

因此slave做数据同步，必须向master声明自己的replication id 和offset，master才可以判断到底需要同步哪些数据。

因为slave原本也是一个master，有自己的replid和offset，当第一次变成slave，与master建立连接时，发送的replid和offset是自己的replid和offset。

master判断发现slave发送来的replid与自己的不一致，说明这是一个全新的slave，就知道要做全量同步了。

master会将自己的replid和offset都发送给这个slave，slave保存这些信息。以后slave的replid就与master一致了。

因此，master判断一个节点是否是第一次同步的依据，就是看replid是否一致。

完整流程描述：

slave节点请求增量同步
master节点判断replid，发现不一致，拒绝增量同步
master将完整内存数据生成RDB，发送RDB到slave
slave清空本地数据，加载master的RDB
master将RDB期间的命令记录在repl_baklog，并持续将log中的命令发送给slave
slave执行接收到的命令，保持与master之间的同步

增量同步

全量同步需要先做RDB，然后将RDB文件通过网络传输个slave，成本太高了。因此除了第一次做全量同步，其它大多数时候slave与master都是做增量同步。

什么是增量同步？就是只更新slave与master存在差异的部分数据。如图：

repl_backlog原理

master怎么知道slave与自己的数据差异在哪里呢?

这就要说到全量同步时的repl_baklog文件了。

这个文件是一个固定大小的数组，只不过数组是环形，也就是说角标到达数组末尾后，会再次从0开始读写，这样数组头部的数据就会被覆盖。

repl_baklog中会记录Redis处理过的命令日志及offset，包括master当前的offset，和slave已经拷贝到的offset：

slave与master的offset之间的差异，就是salve需要增量拷贝的数据了。

随着不断有数据写入，master的offset逐渐变大，slave也不断的拷贝，追赶master的offset：

直到数组被填满：

此时，如果有新的数据写入，就会覆盖数组中的旧数据。不过，旧的数据只要是绿色的，说明是已经被同步到slave的数据，即便被覆盖了也没什么影响。因为未同步的仅仅是红色部分。

但是，如果slave出现网络阻塞，导致master的offset远远超过了slave的offset：

如果master继续写入新数据，其offset就会覆盖旧的数据，直到将slave现在的offset也覆盖：

棕色框中的红色部分，就是尚未同步，但是却已经被覆盖的数据。此时如果slave恢复，需要同步，却发现自己的offset都没有了，无法完成增量同步了。只能做全量同步。

repl_baklog大小有上限，写满后会覆盖最早的数据，如果slave断开时间过久，导致尚未备份的数据被覆盖，则无法基于log做增量同步，只能再次全量同步。

主从同步优化

可以从以下几个方面来优化Redis主从就集群：

在master中配置repl-diskless-sync yes启用无磁盘复制，避免全量同步时的磁盘IO。
Redis单节点上的内存占用不要太大，减少RDB导致的过多磁盘IO
适当提高repl_baklog的大小，发现slave宕机时尽快实现故障恢复，尽可能避免全量同步
限制一个master上的slave节点数量，如果实在是太多slave，则可以采用主-从-从链式结构，减少master压力

主从从架构图：

简述全量同步和增量同步区别？

全量同步：master将完整内存数据生成RDB，发送RDB到slave。后续命令则记录在repl_baklog，逐个发送给slave。
增量同步：slave提交自己的offset到master，master获取repl_baklog中从offset之后的命令给slave

什么时候执行全量同步？

slave节点第一次连接master节点时
slave节点断开时间太久，repl_baklog中的offset已经被覆盖时

什么时候执行增量同步？

slave节点断开又恢复，并且在repl_baklog中能找到offset时

关注

23
点赞
踩
19

收藏

觉得还不错? 一键收藏
1
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

Fan0914 CSDN认证博客专家 CSDN认证企业博客

码龄3年

8: 原创

139万+: 周排名

188万+: 总排名

4699: 访问

: 等级

163: 积分

55: 粉丝

80: 获赞

4: 评论

46: 收藏

私信

关注

热门文章

最新评论

redis主从同步原理
CSDN-Ada助手: 恭喜博主能够深入探讨redis主从同步原理，文章内容通俗易懂，让我受益匪浅。希望博主能够继续坚持创作，分享更多关于redis的知识。下一步建议可以探讨redis在实际应用中的一些问题和解决方案，期待您的精彩作品。谢谢！
nacos配置中心及热加载
CSDN-Ada助手: 非常感谢您的持续创作，这篇关于nacos配置中心及热加载的博客内容非常有深度，让我受益匪浅。希望您能继续分享更多关于配置中心和热加载方面的知识，也可以考虑结合实际案例进行分析，这样更能帮助读者更好地理解和应用。期待您的下一篇精彩文章！
搭建Nacos注册中心
CSDN-Ada助手: 恭喜你成功搭建Nacos注册中心！这篇博客内容详实，对于想要搭建注册中心的读者来说非常有用。希望你能继续保持创作，分享更多关于搭建和管理注册中心的经验和技巧。或许下一步可以考虑分享一些实际案例或者深入解析某些特定功能的使用方法，这样可以让读者更加深入地了解Nacos注册中心的应用。期待你的下一篇作品！如何快速涨粉，请看该博主的分享：https://hope-wisdom.blog.csdn.net/article/details/130544967?utm_source=csdn_ai_ada_blog_reply5
Maven安装步骤，及总结
CSDN-Ada助手: 恭喜你开始了博客创作！Maven安装步骤的总结很有用，对于初学者来说是非常有帮助的。接下来，建议你可以尝试写一些实际使用Maven的案例分析，或者分享一些Maven的高级技巧，这样可以让读者更深入地了解Maven的应用。希望你的博客越来越好，加油！推荐【每天值得看】：https://bbs.csdn.net/forums/csdnnews?typeId=21804&utm_source=csdn_ai_ada_blog_reply1

大家在看

计算机视觉-霍夫变换直线检测实验报告 860

最新文章

目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。