1、哪些情况不走索引
(1)函数
当SQL语句中使用函数时,索引将无法被应用。例如,下面的SQL语句使用了函数UPPER,这将导致MySQL无法使用索引进行查询。例如:SELECT * FROM customers WHERE UPPER(name) = 'JOHN';
(2) 以通配符开头的LIKE
在使用LIKE语句进行模糊查询时,如果通配符放在开头(例如%john),MySQL也将无法使用索引。这是因为MySQL只能利用索引执行前缀匹配,而不能利用索引进行后缀匹配。例如:SELECT * FROM customers WHERE name LIKE '%john';
(3)OR
当SQL语句中使用了逻辑或操作符(OR)时,索引也无法被应用。例如,下面的SQL语句使用了逻辑或操作符,这将导致MySQL无法使用索引进行查询。例如:SELECT * FROM customers WHERE name = 'john' OR age = 30;
(4)不等于,包含!=和<>
当SQL语句中使用了不等于操作符(<>或!=)时,索引将无法被应用。例如,下面的SQL语句使用了不等于操作符,这将导致MySQL无法使用索引进行查询。例如:SELECT * FROM customers WHERE age <> 30;
(5)NULL值
当SQL语句中使用了NULL值作为查询条件时,索引也无法被应用。这是因为索引无法用于查找缺失的值。例如,下面的SQL语句使用了NULL值作为查询条件,这将导致MySQL无法使用索引进行查询。例如:SELECT * FROM customers WHERE name IS NULL;
2、复合索引的最左前缀特性
如果我们创建了(a, b, c)的复合索引,那么其实相当于创建了(a,b,c)、(a,b)、(a)三个索引。
注意,向右匹配直到遇到以下3类情况就停止匹配,例如:"where a = 1 and b > 2 and c = 3" 中,索引c就失效了。
【上面 "1、哪些情况不走索引" 小节中 的5个条件:函数、以通配符开头的LIKE、OR、不等于、NULL值】
【范围查询(>、<、between)】
【LIKE,不仅仅是"以通配符开头的LIKE"的情况】
相关练习题:(以index(a,b,c)复合索引为例)
语句 | 索引是否生效 |
---|---|
where a = 1 | 是,字段 a 索引生效 |
where a = 1 and b = 2 | 是,字段 a 和 b 索引生效 |
where a = 1 and b = 2 and c = 3 | 是,全部生效 |
where b = 2 或 where c = 3 | 否,全部不生效 |
where a = 1 and c = 3 | 字段 a 生效,字段 c 失效 |
where a = 1 and b > 2 and c = 3 | 字段 a,b 生效,字段 c 失效 |
where a = 1 and b like 'xxx%' and c = 3 | 字段 a,b 生效,字段 c 失效 |
3、给order by加索引
(1)where和order后的字段会走联合索引:
(2)只给where加索引,不给order后的字段加的话,会慢:
(3)只给order加索引,不给where后的字段加的话,会不走索引:
(4)题目:如何给【... where a = 1, b > 1 order by c;】这个sql建索引?
只给a+b建联合索引就好。
因为即使给a+b+c建了联合索引,也会因为范围查询所中断,走不到c。
因为是先走where的索引再走order的索引,所以建a+c+b的联合索引的话也没用的。
4、其他关于索引方面的建议
(1)选择唯一性的列索引
唯一性索引的值是唯一的,可以更快速的通过该索引来确定某条记录。例如,学生表中学号是具有唯一性的字段。为该字段建立唯一性索引可以很快的确定某个学生的信息。如果使用姓名的话,可能存在同名现象,从而降低查询速度。
(2)为经常需要排序、分组和联合操作的字段建立索引,为常作为查询条件的字段建立索引
经常需要ORDER BY、GROUP BY、DISTINCT和UNION等操作的字段,排序操作会浪费很多时间。如果为其建立索引,可以有效地避免排序操作。如果某个字段经常用来做查询条件,那么该字段的查询速度会影响整个表的查询速度。因此,为这样的字段建立索引,可以提高整个表的查询速度。
(3)限制索引的数量,删除不再使用或者很少使用的索引
索引的数目不是越多越好。每个索引都需要占用磁盘空间,索引越多,需要的磁盘空间就越大。修改表时,对索引的重构和更新很麻烦。越多的索引,会使更新表变得很浪费时间。表中的数据被大量更新,或者数据的使用方式被改变后,原有的一些索引可能不再需要。数据库管理员应当定期找出这些索引,将它们删除,从而减少索引对更新操作的影响。
(4)尽量使用数据量少的索引
如果索引的值很长,那么查询的速度会受到影响。例如,对一个CHAR(100)类型的字段进行全文检索需要的时间肯定要比对CHAR(10)类型的字段需要的时间要多。
(5)尽量使用前缀来索引
如果索引字段的值很长,最好使用值的前缀来索引。例如,TEXT和BLOG类型的字段,进行全文检索会很浪费时间。如果只检索字段的前面的若干个字符,这样可以提高检索速度。
(6)= 和 in 内是可以乱序的
比如 where c = 3 and a = 1 and b = 2是可以走到 (a,b,c) 联合索引的,mysql的查询优化器会帮你优化成索引可以识别的形式。
(7)尽量选择区分度高的列作为索引,即:索引选择性
区分度的公式是count(distinct col)/count(*),表示字段不重复的比例,比例越大我们扫描的记录数越少,唯一键的区分度是1,而一些状态、性别字段可能在大数据面前区分度就 是0,那可能有人会问,这个比例有什么经验值吗?使用场景不同,这个值也很难确定,一般需要join的字段我们都要求是0.1以上,即平均1条扫描10条 记录。