索引原理
索引的目的在于提高查询效率,与我们查阅图书所用的目录是一个道理:先定位到章,然后定位到该章下的一个小节,然后找到页数。相似的例子还有:查字典,查火车车次,飞机航班等
本质都是:通过不断地缩小想要获取数据的范围来筛选出最终想要的结果,同时把随机的事件变成顺序的事件,也就是说,有了这种索引机制,我们可以总是用同一种查找方式来锁定数据。
b+树性质
1.索引字段要尽量的小:
通过上面的分析,我们知道IO次数取决于b+数的高度h,假设当前数据表的数据为N,每个磁盘块的数据项的数量是m,则有h=㏒(m+1)N,当数据量N一定的情况下,m越大,h越小;而m= 磁盘块的大小 / 数据项的大小,磁盘块的大小也就是一个数据页的大小,是固定的,如果数据项占的空间越小,数据项的数量越多,树的高度越低。这就是为什么每个数据项,即索引字段要尽量的小,比如int占4字节,要比bigint8字节少一半。这也是为什么b+树要求把真实的数据放到叶子节点而不是内层节点,一旦放到内层节点,磁盘块的数据项会大幅度下降,导致树增高。当数据项等于1时将会退化成线性表。
2.索引的最左匹配特性(即从左往右匹配):
当b+树的数据项是复合的数据结构,比如(name,age,sex)的时候,b+数是按照从左到右的顺序来建立搜索树的,比如当(张三,20,F)这样的数据来检索的时候,b+树会优先比较name来确定下一步的所搜方向,如果name相同再依次比较age和sex,最后得到检索的数据;但当(20,F)这样的没有name的数据来的时候,b+树就不知道下一步该查哪个节点,因为建立搜索树的时候name就是第一个比较因子,必须要先根据name来搜索才能知道下一步去哪里查询。比如当(张三,F)这样的数据来检索时,b+树可以用name来指定搜索方向,但下一个字段age的缺失,所以只能把名字等于张三的数据都找到,然后再匹配性别是F的数据了,
这个是非常重要的性质,即索引的最左匹配特性。
Mysql索引失效的七种情况
1、当在条件中使用or,并且在or的前后不全是索引的情况下,索引会失效
2、当在like模糊查询时,在索引的前面用到%,会导致全表查询,索引失效
3、当在where子句中,用索引做数学运算时,索引会失效
4、当在where子句中,在索引上使用函数时,索引会失效
5、当使用复合索引时,没有按照复合索引的顺序进行查找时,索引会失效
6、当索引列存在类型转换时,索引会失效,比如索引列是varchar,在where子句中索引后的条件没有加引号
7、当数据量少的情况下,mysql计算使用全表查询比索引快时,索引会失效
什么情况下不推荐使用索引
1、数据唯一性差的字段不要使用索引
2、频繁更新的字段不要使用索引
3、字段不在where子句中出现的不要使用索引,如果where后含IS NULL ,IS NOT NULL,like等条件,不建议使用索引
4、where子句中对索引列使用不等于(<>),索引效果一般