Python大咖:想要做好MySQL优化,这十点知识你必须要知道

12 篇文章 0 订阅
11 篇文章 0 订阅

1.为查询缓存优化你的查询

  大多数的MySQL服务器都开启了查询缓存。这是提高性能最有效的方法之一,而且这是被MySQL的数据库引擎处理的。当有很多相同的查询被执行了多次的时候,这些查询结果会被放到一个缓存中,这样,后续的相同的查询就不用操作表而直接访问缓存结构了。

  这里最主要的问题是,对于程序员来书,这件事情很容易被忽略的。因为,我们某些查询语句会让MySQL不使用缓存。

查询缓存不开启

   $result = mysql_query("select username from user where signup_date >=curdate()");

开启查询缓存

$today = date(“Y-m-d”);

   $result  = mysql_query("select username from user signup_date >='$today'");

上面两条SQL语句的差别就是CURDATE(),MySQL的查询缓存对这个函数不起作用。所以,像NOW()和RAND()或是其他的诸如此类的SQL函数都不会开启查询缓存,因为这写函数的返回是会不定的易变的。所以,你需要的就是用一个变量来代替MySQL的函数,从而开启缓存。

2.EXPLAIN你的SELECT查询

 使用EXPLAIN关键字可以让你知道MYSQL是如何处理你的SQL语句的。这可以帮你分析你的查询语句或是表结构的性能瓶颈。

 EXPLAIN的查询结果还会告诉你你的索引主键被如何利用的,你的数据表是如何被搜索和排序的......等等。

挑一个你的SELECT语句,把关键字EXPLAIN加到前面。你可以使用phpmyadmin来做这个事情。然后,你会看到一张表格。

3.当只要一行数据时使用limit 1

  当你查询表的有些时候,你已经知道结果只会有一条结果,但因为你可能需要去fetche游标,或是你也许会去检查返回的记录书。

  在这种情况下,加上limit 1可以增加性能。这样一来,MYSQL数据库引擎会在找到一条数据后停止搜索,而不是继续往后查找下一条符合记录的数据

 下面有俩条语句

 $result = mysql_query("select * from user where username = 'admin' ");

if(mysql_num_rows($result) > 0){

// 代码

}

$result  = mysql_query("select * from user where username = 'admin' limit 1");

if(mysql_num_rows($result) > 0){

    // 代码

}

通过观察我们可以清楚的知道,这两条SQL语句的效率,第二条语句是大于第一条的。

4.为搜索字段建立索引

 索引并不一定就是给主键或是唯一的字段,如果在你的表中,有某个字段你总要是经常用来做搜索,那么,请为其建立索引。

在这里插入图片描述
从上图你可以看到俩条语句模糊查询的时间。一个建立索引,一个是没有索引,性能差了4倍左右。

另外,你应该也需要知道什么样的搜索是不能使用正常的索引的。例如,当你需要在一篇大的文章中搜索一个词时,如where post_content like ‘%apple%’ ,索引可能是没有意义的,你可能需要使用MYSQL全文索引,或是自己做一个索引。

5.在join表的时候使用相同类型的,并建立索引

如果你的应用程序有很多join查询,你应该确认俩个表中join的字段是被建立过索引的。这样,MYSQL内部会启动为你优化join的SQL语句的机制。

而且,这些被用来JOIN的字段,应该是相同的类型。例如:如果你要把DECIMAL字段和一个INT字段join在一起,MYSQL就无法使用他们的索引。对于那些STRING类型,还需要有相同的字符集才行。

$result = mysql_query(‘select company_name from users left join companies on users.state = companies.state where user.id = $user_id’);

6.千万不要ORDER BY RAND()

 想打乱返回的数据行?随机挑一个数据?真不知道谁发明了这种用法,但很多新手很喜欢这样用。但你却不了解这样做有多么可怕的性能问题。

如果你真的想把返回的数据行打乱了,你有N种方法可以达到这个目的。这样使用只能让你的数据库的性能呈指数级的下降。这里的问题是:MYSLQ会不得不去执行RAND()函数(很耗CPU时间),而且这是为了每一行记录去记行,然后再对其排序。就算是你用了limit 1 也无济于事

**7.避免SELECT ***

从数据库里读出越多的数据,那么查询就会变得越慢。并且,如果你的数据库服务器和WEB服务器是两台独立的服务器的话,这还会增加网络传输的负载。

所以,你应该养成一个需要什么就取什么的好的习惯。

8.永远为每张表设置一个ID

 我们应该为数据库里的每张表都设置一个ID做为其主键,而且最好的是一个INT型的,并设置自动增加的AUTO_INCREMENT标志。

 就算是你users表有一个主键叫"email"的字段,你也别让它成为主键。使用varchar 类型来当主键会使得性能下降。另外,在你的程序中,你应该使用表的ID来构造你的数据结构。

 而且,在MYSQL数据引擎下,还有一些操作需要使用主键,在这些情况下,主键的性能和设置变得非常重要,比如,集群,分区......

在这里,只有一个情况是例外,那就是"关联表"的外键,也就是说,这个表的主键,通过若干个别的表的主键构成。我们把这个情况叫做"外键"。比如:有一个"学生表"有学生的ID,有一个"课程表"有课程ID,那么"成绩表"就是"关联表"了,其关联了学生表和课程表,在成绩表中,学生ID和课程ID叫"外键"其共同组成主键。

9.使用ENUM而不是VARCHAR

ENUM类型是非常快和紧凑的。在实际上,其保存的是TINYINT,但其外表显示为字符串。这样一来,用这个字段来做一些选项列表变的相当的完美。

 如果你有一个字段,比如"性别","国家","民族",你知道这些字段的取值是有限而且固定的,那么,你应该使用ENUM而不是VARCHAR。

MYQSL也有一个"建议",告诉你怎么去重新组织你的表结构。当你有一个VARHCAR字段时,这个建议会告诉你把其改成ENUM类型。使用PROCEDURE ANALYSE() 你可以得到相关的建议。

10.尽可能的使用NOT NULL

  除非你有一个很特别的原因去使用NULL值,你应该总是让你的字段保持NOT NULL。这看起来好像有点争议。

 首先,问问你自己"empty"和"null"有多大的区别?如果你觉得它们之间没有什么区别,那么你就不要使用null。

不要以为NULL不需要空间,其需要额外的空间,并且,在你进行比较的时候,你的程序会更复杂。当然,这里并不是说你就不能使用NULL了,现实情况是很复杂的,依然会有些情况下,你需要使用NULL值。

添加Python学习群:1015615067,和老师一对一解答指导!

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值