日志系统: 一条sql更新语句是如何执行的

从一个表的一条更新语句说起,表的创建语句如下:

create table T(ID int primary key, c int);

这个表有一个主键ID和一个整形字段c

如果要将ID=2这一行的值增加1,sql语句就会这么写:

update T set c=c+1 where ID = 2;

首先,查询语句的那一套流程,更新语句也是同样会走一遍

和查询流程不一样的是,更新流程还涉及两个重要的日志模块,即redo log(重做日志)和binlog(归档日志)。

redo log(物理)日志模块

如果每一次的更新操作都需要写进磁盘,然后磁盘也要找到对应的那条记录,然后再更新,整个过程IO成本,查询成本都很高。为了解决这一个问题,mysql使用了WAL(write_Ahead Logging)技术,它的关键点就是先写日志,再写磁盘。

具体来说就是,当有一条记录需要更新时,InnoDB引擎就会先把记录写到redo log里面,并更新内容,这个时候更新就算完成了。同时,InnoDB引擎会在适当的时候,将这个操作记录更新到磁盘里面,而这个更新往往是在系统比较闲的时候做。

InnoDB的redo log是固定大小的,比如可以配置为一组4个文件,每个文件的大小就是1GB,那么日志就可以记录4GB的操作。从头开始,写到末尾就又回到开头循环写。流程如下图所示:
在这里插入图片描述
write pos是当前记录的位置,一边写一边后移,写到第3号文件末尾后就回到0号文件开头。checkpoint是当前要擦除的位置,也是往后推移并且循环的,擦除记录前要把记录更新到数据文件

write pos和checkpoint之间的是还空着的部分,可以用来记录新的操作,如果write pos追上了checkpoint,标识空间满了,这时候不能再执行新的更新,得停下来擦掉一些记录,把checkpoint推进一下

有了redo log,InnoDB就可以保证即使数据库发生异常重启,之前提交的记录都不会丢失,这个能力称为crash-safe

redo log用于保证crash-safe能力,innodb_flush_log_at_trx_commit这个参数设置成1的时候,表示每次事务的redo log都直接持久化到磁盘,这个参数建议设置成1,这样可以保证Mysql异常重启之后数据不丢失

binlog(逻辑)日志模块

mysql整体来看,其实就两块,一块是server层,主要做的是mysql功能层面的事,一块是引擎层,负责存储相关的具体事宜。redo log是InnoDB引擎特有的日志,而server层也有自己的日志,成为binlog(归档日志)

为什么会有两份日志呢?

因为最开始的mysql里并没有InnoDB引擎,mysql自带的引擎是MyISAM,但是MyISAM没有crash-safe的能力,binlog日志只能用于归档。而InnDB是另一个公司以插件形式引入Mysql的,既然只依靠binlog是没有crash-safe能力的,所以InnoDB使用另外一套日志系统——也就是redo log来实现crash-safe能力。

sync_binlog这个参数设置成1的时候,表示每次事务的binlog都持久化到磁盘,这个参数建议设置成1,这样可以保证Mysql异常重启之后的binlog不丢失

redo log和binlog日志的不同点

1、redo log是InnoDB引擎特有的,binlog是Mysql的Server层实现的,所有引擎都可以使用

2、redo log是物理日志,记录的是“在某个数据页上做了什么修改”;binlog是逻辑日志,记录的是这个语句的原始逻辑,比如“给ID=2这一行的c字段加1”

3、redo log是循环写的,空间固定会用完;binlog是可以追加写入的。“追加写”是指binlog文件写到一定大小后会切换到下一个,并不会覆盖以前的日志

4、redo log不是记录数据页“更新之后的状态”,而是记录这个页“做了什么改动”

binlog有两种模式,statement格式的话是记sql语句,row格式会记录行的内容,记两条,更新前和更新后都有

执行update语句的内部流程

1、执行器先找引擎取 ID=2这一行。ID是主键, 引擎直接用树搜索找到这一行。如果 ID=2这一行所在的数据页本来就在内存中,就直接返回给执行器,否则,需要先从磁盘读入内存,然后在返回

2、执行器拿到引擎给的行数据,把这个值加上1,比如原来是N,现在就是N+1,得到新的一行数据,在调用引擎接口写入这行新数据

3、引擎将这行新数据更新到内存中,同时将这个更新操作记录到redo log里面,此时,redo log处于prepare状态,然后告知执行器执行完成了,随时提交事务

4、执行器生成这个操作的binlog,把binlog写入磁盘

5、执行器调用引擎的提交事务接口,引擎把刚刚写入的redo log改成tijiao(commit)状态,更新完成

update执行语句流程图如下:
在这里插入图片描述
图中浅色框表示的是在InnoDB内部执行的,深色框表示是在执行器中执行的

两阶段提交

redo log的写入拆分成了两个步骤:prepare 和 commit 这就是两阶段提交

两阶段提价是为了让两份日志之间的逻辑一致(怎么样让数据库恢复到半个月内任意一秒的状态)

如果不使用两阶段提交,那么数据库的状态就有可能和用它的日志恢复出来的库状态不一致

数据恢复过程:

1、首先,找到最近的一次全量备份,如果你运气好,可能就是昨天晚上的一个备份,从这个备份恢复到临时库

2、从备份的时间点开始,将备份的binlog依次取出来,重放到中午误删表之前的那个时刻

3、这时的临时库就跟误删之前的线上库一样了,然后你可以把表数据从临时库取出来,按需要恢复到线上库

不只是误操作后需要用这个过程来恢复数据,当需要扩容的时候,也就是需要再多搭建一些备库来增加系统的读能力的时候,现在常见的做法也是用全量备份加上应用binlog来实现的,这个“不一致”就会导致线上出现主从数据库不一致的情况

redo log和binlog都可以用于表示事务的提交状态,两阶段提交就是让这两个状态保持逻辑上的一致

一天一备跟一周一备的对比

好处是“最长恢复时间”更短

在一天一备的模式里,最坏情况下需要应用一天的binlog,比如,你每天0点做一次全量备份,而要恢复出一个到昨天晚上23点的备份

一周一备最坏情况就要应用一周的binlog了

系统的对应指标就是RTO(恢复目标的时间)

这个是有成本的,因为更频繁全量备份需要消耗更多存储空间,所以这个RTO是成本换来的,就需要根据业务重要性来评估

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 3
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值