深入理解Mysql索引底层数据结构与算法

深入理解Mysql索引底层数据结构与算法

一、索引是什么

在这里插入图片描述
在这里插入图片描述在这里插入图片描述

  • 磁盘存取原理
    1. 寻道时间(时间长,慢)
    2. 旋转时间(快)
      在这里插入图片描述
      在这里插入图片描述

二、树结构

B-Tree
在这里插入图片描述

  1. 相比二叉树,相当于多叉树
  2. 度(Degree)-节点的数据存储个数 (一般存储一页大小的数据量)
  3. 叶节点具有相同的深度
  4. 叶节点的指针为空
  5. 节点中的数据key从左到右递增排列

B+Tree(B-Tree变种)
在这里插入图片描述

  1. 非叶子节点不存储data,只存储key,可以增大度
  2. 叶子节点不存储指针
  3. 顺序访问指针,提高区间访问的性能

B+Tree索引的性能分析

  • 一般使用磁盘I/O次数评价索引结构的优劣
  • 预读:磁盘一般会顺序向后读取一定长度的数据(页的整数倍)放入内存
  • 局部性原理:当一个数据被用到时,其附近的数据也通常会马上被使用
  • B+Tree节点的大小设为等于一个页,每次新建节点直接申请一个页的空间,这样就 保证一个节点物理上也存储在一个页里,就实现了一个节点的载入只需一次I/O
  • B+Tree的度d一般会超过100,因此h非常小(一般为3到5之间)

三 MyISAM 与Innodb 索引比较

MyISAM索引实现

  • MyISAM索引文件和数据文件是分离的(非聚集),叶子节点存储索引和索引文件的指针。
    主键索引
    在这里插入图片描述
    普通索引
    在这里插入图片描述
    InnoDB索引实现
    • 数据文件本身就是索引文件*(.frm和.idb)*,idb包含数据和索引

    • 表数据文件本身就是按B+Tree组织的一个索引结构文件

    • 聚集索引-叶节点包含了完整的数据记录

    • 为什么InnoDB表必须有主键,并且推荐使用整型的自增主键?

      1. 如果我们定义了主键(PRIMARY KEY)
        那么InnoDB会选择主键作为聚集索引、如果没有显式定义主键,则InnoDB会选择第一个不包含有NULL值的唯一索引作为主键索引、如果也没有这样的唯一索引,则InnoDB会选择内置6字节长的ROWID作为隐含的聚集索引(ROWID随着行记录的写入而主键递增,这个ROWID不像ORACLE的ROWID那样可引用,是隐含的)。
      2. 数据记录本身被存于主索引(一颗B+Tree)的叶子节点上
        这就要求同一个叶子节点内(大小为一个内存页或磁盘页)的各条数据记录按主键顺序存放,因此每当有一条新的记录插入时,MySQL会根据其主键将其插入适当的节点和位置,如果页面达到装载因子(InnoDB默认为15/16),则开辟一个新的页(节点)
      3. 如果表使用自增主键
        那么每次插入新的记录,记录就会顺序添加到当前索引节点的后续位置,当一页写满,就会自动开辟一个新的页
      4. 如果使用非自增主键(如果身份证号或学号等)
        由于每次插入主键的值近似于随机,因此每次新纪录都要被插到现有索引页得中间某个位置,此时MySQL不得不为了将新记录插到合适位置而移动数据,甚至目标页面可能已经被回写到磁盘上而从缓存中清掉,此时又要从磁盘上读回来,这增加了很多开销,同时频繁的移动、分页操作造成了大量的碎片,得到了不够紧凑的索引结构,后续不得不通过OPTIMIZE TABLE来重建表并优化填充页面。
        总结:如果InnoDB表的数据写入顺序能和B+树索引的叶子节点顺序一致的话,这时候存取效率是最高的,也就是下面这几种情况的存取效率最高:
        a、使用自增列(INT/BIGINT类型)做主键,这时候写入顺序是自增的,和B+数叶子节点分裂顺序一致;
        b、该表不指定自增列做主键,同时也没有可以被选为主键的唯一索引(上面的条件),这时候InnoDB会选择内置的ROWID作为主键,写入顺序和ROWID增长顺序一致;
        c、如果一个InnoDB表又没有显示主键,又有可以被选择为主键的唯一索引,但该唯一索引可能不是递增关系时(例如字符串、UUID、多字段联合唯一索引的情况),该表的存取效率就会比较差。
    • 为什么非主键索引结构叶子节点存储的是主键值?(一致性和节省存储空间)
      1 主键索引已经存储了完成的数据,如果再存储浪费空间,并且当数据更新时还要讲非主键索引的数据重新更新,否则会出现数据不一致。因为存的是主键

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值