mysql数据结构和算法

最新推荐文章于 2024-09-09 13:54:08 发布

zhenghehehe

最新推荐文章于 2024-09-09 13:54:08 发布

阅读量132

点赞数

分类专栏： mysql 文章标签：数据结构 mysql 算法

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/qq_39440464/article/details/120722737

版权

mysql 专栏收录该内容

4 篇文章 0 订阅

订阅专栏

本文解析了为何MySQL不采用二叉树和红黑树作为索引，重点介绍了B-Tree特别是B+Tree的优势，如叶节点结构、存储效率和查询性能。讲解了InnoDB的主键策略，以及非主键索引的原理。还涵盖了Hash索引的特点和适用场景。

摘要由CSDN通过智能技术生成

索引是帮助mysql高效获取数据的排好序的数据结构

为什么数据结构不是二叉树？

因为mysql数据存储在硬盘中，每次插入数据都会读写硬盘数据，二叉树原则是右边比父节点大，左边比父节点小，如果索引建立在自增ID上，查找ID为10w的数据，会查找10w次，查询效率慢。

为什么数据结构不使用红黑树？

红黑树又叫平衡二叉树，是一种二叉树的扩展，在数据量大的情况下依旧无法承载索引所需要提供的查询效率，从根节点会一直找到对应的叶子节点。

B-Tree

叶节点具有相同的深度，叶节点的指针为空

所有索引元素不重复

节点中的数据索引从左到右递增排列

mysql 在内存中默认分配16kb内存，存储节点

B-Tree一个节点占用1kb 一行只可以存储16个

B+Tree

非叶子节点不存储data，只存储索引，可以放更多索引

叶子节点包含所有索引字段

叶子节点用指针链接，提高区间访问性能

每行可以放 1024kb/(8+6)b的数据

树的高度越小，查询效率越快，所以选用B+Tree，BTree中叶子节点没有用指针链接，如果查询范围数据的话效率远不如B+Tree 如 age>50。

Hash

缺点不支持范围查询

MyISAM存储引擎索引实现

存储到硬盘的文件

frm 表结构信息

MYD文件 MyISAM引擎Data文件

MYI文件 MyISAM引擎Index文件

Index文件存储格式

在Index文件中查找到对应的文件地址去Data文件中读取数据找到指定数据

InnoDB存储引擎索引实现

frm 表结构信息

ibd 包含索引和数据信息

表数据文件本身就按B+Tree组织的一个索引结构文件

聚集索引-叶节点包含了完整的数据记录

为什么InnoDB表必须建主键，并推荐使用整型的自增主键？

因为如果没有建立自增主键，mysql会查找一列不重复的数据建立B+Tree索引，如果没有符合该规则的列则会建立一列隐藏列来建立索引。

如果使用字符串类型，例如UUID，会降低性能，B+Tree数据会从小到大依次排序，字符串类型使用ASCII码顺序来进行对比，性能远不及整型。

由于每次插入时也不需要移动已有数据，因此效率很高，也不会增加很多开销在维护索引上

如果使用非自增主键（如果身份证号或学号等），由于每次插入主键的值近似于随机，因此每次新纪录都要被插到现有索引页得中间某个位置，此时MySQL不得不为了将新记录插到合适位置而移动数据，甚至目标页面可能已经被回写到磁盘上而从缓存中清掉，此时又要从磁盘上读回来，这增加了很多开销，同时频繁的移动、分页操作造成了大量的碎片，得到了不够紧凑的索引结构，后续不得不通过OPTIMIZE TABLE来重建表并优化填充页面。

为什么非主键索引结构叶子节点存储的是主键值？

一致性和节省存储空间

属于非聚簇索引，找到对应的主键之后去到聚簇索引中查找对应的数据

一个表只会有一个聚簇索引

联合索引

索引最左前缀原理

索引的原则是排好序，根据排序去查找对应的数据，它会根据字段的顺序去依次排序，如果直接查找第二个，索引会进行全表扫描，排序规则不会生效

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

zhenghehehe CSDN认证博客专家 CSDN认证企业博客

码龄7年

45: 原创

11万+: 周排名

37万+: 总排名

2万+: 访问

: 等级

461: 积分

1: 粉丝

7: 获赞

2: 评论

24: 收藏

私信

关注

分类专栏

工具 1篇
解决问题 4篇
消息队列 1篇
Kafka 1篇
redis 7篇
JVM 10篇
Tomcat 1篇
多线程 12篇
数据结构 2篇
java基础 3篇
mysql 4篇
fastjson 2篇
mybatisplus 1篇

最新评论

ReentrantReadWriteLock读写锁
蜀山小师叔: 锁降级中读锁的获取是否必要呢？答案是必要的。主要是为了保证数据的可见性，如果当前线程不获取读锁而是直接释放写锁，假设此刻另一个线程（记作线程T）获取了写锁并修改了数据，那么当前线程无法感知线程T的数据更新。如果当前线程获取读锁，即遵循锁降级的步骤，则线程T将会被阻塞，直到当前线程使用数据并释放读锁之后，线程T才能获取写锁进行数据更新。。。。。。。。。。。。。。就这句话，抄了几个了账号了。。。。

大家在看

【漏洞复现】用友 GRP-U8 bx_dj_check.jsp Sql注入漏洞

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。