MySQL索引使用及注意事项

参考链接:mysql索引使用技巧及注意事项 - 猿人谷 

一、索引的作用

       一般的应用系统,读写比例在10:1左右,而且插入操作和一般的更新操作很少出现性能问题,遇到最多的,也是最容易出问题的,还是一些复杂的查询操作,所以查询语句的优化显然是重中之重。

       在数据量和访问量不大的情况下,mysql访问是非常快的,是否加索引对访问影响不大。但是当数据量和访问量剧增的时候,就会发现mysql变慢,甚至down掉,这就必须要考虑优化sql了,给数据库建立正确合理的索引,是mysql优化的一个重要手段。

       索引的目的在于提高查询效率,可以类比字典,如果要查“mysql”这个单词,我们肯定首先需要定位到m字母,然后找到y字母,再找到剩下的s、q、l。如果没有索引,那么你可能需要把所有单词看一遍,才能找到你想要的。除了词典,生活中随处可见索引的例子,如火车站的车次表、图书的目录等。它们的原理都是一样的,通过不断的缩小想要获得数据的范围来筛选出最终想要的结果,同时把随机的事件变成顺序的事件,也就是我们总是通过同一种查找方式来锁定数据。

       在创建索引时,需要考虑哪些列会用于SQL查询,然后为这些列创建一个或多个索引。事实上,索引也是一种表,保存着主键或索引字段,以及一个能将每个记录指向实际表的指针。数据库用户是看不到索引的,它们只是用来加速查询的。数据库搜索引擎使用索引来快速定位记录。

       INSERT 与 UPDATE 语句在拥有索引的表中执行会花费更多的时间,而SELECT 语句却执行得更快。这是因为在进行插入或更新时,数据库也需要插入或更新索引值

 

二、索引的创建、删除

索引的类型

  • UNIQUE(唯一索引):避免重复的列出现,不可以出现相同的值,可以有NULL值,可以有多个唯一索引

  • INDEX(普通索引):默认的,允许出现相同的索引内容,可以有多个,可通过index或key关键字来设置

  • PROMARY KEY(主键索引):唯一的标识,不允许出现相同的值,只能有一个列作为主键

  • FULLTEXT INDEX(全文索引):在特定的数据库引擎下使用,之前只有MYISAM支持,可以针对值中的某个单词进行快速定位查询,但效率确实不敢恭维

  • 组合索引:实质上是将多个字段建在一个索引里,列值的组合必须唯一

2.1 使用ALTER TABLE语句创建索引

适用场合

  • 在创建表的时候给字段增加索引

  • 表创建完毕后,再增加索引

格式

 ALTER TABLE 表名 ADD 索引类型(unique index,primary key,fulltext index,index) 索引名(字段名)
 -- 一般可以令索引名与字段名一致,方便使用
                                                                           
 -- 普通索引
 ALTER TABLE table_name ADD INDEX index_name(col_name);
 ​
 -- 唯一索引
 ALTER TABLE table_name ADD UNIQUE INDEX index_name(col_name);
 ​
 -- 主键索引
 ALTER TABLE table_name ADD PRIMARY KEY index_name;
 ​
 -- 全文索引
 ALTER TABLE table_name ADD FULLTEXT INDEX index_name(col_name);

        ALTER TABLE可用于4种索引创建,table_name是要增加索引的表名,index_name表示索引名,col_name指出对哪些列进行索引,多列时各列之间用逗号分隔。索引名index_name可选,缺省时,MySQL将根据第一个索引列赋一个名称。另外,ALTER TABLE允许在单个语句中更改多个表,因此可以同时创建多个索引。

2.2 使用CREATE INDEX语句对表增加索引

       CREATE INDEX可用于对表增加普通索引或UNIQUE索引,可用于建表时创建索引。

 CREATE INDEX index_name ON table_name(col_name)
 -- index_name一般设置为:id_表名_字段名
 -- 举例:
 CREATE INDEX id_app_user_name ON `app_user`(`name`)
 ​
 CREATE INDEX index_name ON table_name(username(length));
 -- 如果是CHAR,VARCHAR类型,length可以小于字段实际长度;
 -- 如果是BLOB和TEXT类型,必须指定length。
 -- create只能添加这两种索引;
 CREATE INDEX index_name ON table_name (column_list)
 CREATE UNIQUE INDEX index_name ON table_name (column_list)

       create只能添加这两种索引,table_name、index_name和column_list具有与ALTER TABLE语句中相同的含义,索引名不可选。另外,不能用CREATE INDEX语句创建PRIMARY KEY索引

2.3 删除索引

       删除索引可以使用ALTER TABLE或DROP INDEX语句来实现。DROP INDEX可以在ALTER TABLE内部作为一条语句处理,其格式如下:

 DROP INDEX index_name ON table_name ;
 ALTER TABLE table_name DROP INDEX index_name ;
 -- 举例:
 DROP INDEX id_app_user_name ON `app_user`;
 ALTER TABLE table_name DROP PRIMARY KEY ;

       其中,在前面的两条语句中,都删除了table_name中的索引index_name。而在最后一条语句中,只在删除PRIMARY KEY索引中使用,因为一个表只可能有一个PRIMARY KEY索引,因此不需要指定索引名。如果没有创建PRIMARY KEY索引,但表具有一个或多个UNIQUE索引,则MySQL将删除第一个UNIQUE索引。

       从表中删除某列,则索引会受影响。对于多列组合的索引,如果删除其中的某列,则该列也会从索引中删除。如果删除组成索引的所有列,则整个索引将被删除。

2.4 组合索引与前缀索引

       在这里要指出,组合索引和前缀索引是对建立索引技巧的一种称呼,并不是索引的类型。为了更好的表述清楚,建立一个demo表如下。

 CREATE TABLE `USER_DEMO`(
   `ID` INT NOT NULL AUTO_INCREMENT COMMENT '主键',
   `LOGIN_NAME` VARCHAR(100) NOT NULL COMMENT '登录名',
   `PASSWORD` VARCHAR(100) NOT NULL COMMENT '密码',
   `CITY` VARCHAR(30) NOT NULL COMMENT '城市',
   `AGE` INT NOT NULL COMMENT '年龄',
   `SEX` INT NOT NULL COMMENT '性别(0:女 1:男)',
   PRIMARY KEY (ID)
 )ENGINE=INNODB DEFAULT CHARSET=utf8;

       为了进一步提高mysql的效率,可以考虑建立组合索引,即将LOGIN_NAME,CITY,AGE建到一个索引里:

 ALTER TABLE USER_DEMO ADD INDEX name_city_age (LOGIN_NAME(16),CITY,AGE); 

       建表时,LOGIN_NAME长度为100,这里用16,是因为一般情况下名字的长度不会超过16,这样会加快索引查询速度,还会减少索引文件的大小,提高INSERT、UPDATE的更新速度。

       如果分别给LOGIN_NAME、CITY、AGE建立单列索引,让该表有3个单列索引,查询时和组合索引的效率是大不一样的,甚至远远低于我们的组合索引。虽然此时有三个索引,但mysql只能用到其中的那个它认为似乎是最有效率的单列索引,另外两个是用不到的,也就是说还是一个全表扫描的过程。

       建立这样的组合索引,就相当于分别建立如下三种组合索引:

 LOGIN_NAME,CITY,AGE
 LOGIN_NAME,CITY
 LOGIN_NAME

       为什么没有CITY、AGE等这样的组合索引呢?这是因为mysql组合索引“最左前缀”的结果。简单的理解就是只从最左边的开始组合,并不是只要包含这三列的查询都会用到该组合索引。也就是说name_city_age(LOGIN_NAME(16),CITY,AGE)从左到右进行索引,如果没有左前索引,mysql不会执行索引查询

       如果索引列长度过长,这种列索引时将会产生很大的索引文件,不便于操作,可以使用前缀索引方式进行索引,前缀索引应该控制在一个合适的点,控制在0.31黄金值即可(大于这个值就可以创建)。

 

三、索引的使用及注意事项

3.1 索引的使用

        EXPLAIN可以帮助开发人员分析SQL问题,explain显示了mysql如何使用索引来处理select语句以及连接表,可以帮助选择更好的索引和写出更优化的查询语句。

       使用方法:在select语句前加上Explain就可以了。

 EXPLAIN SELECT * FROM USER WHERE id=1;

       尽量避免这些不走索引的sql:

 SELECT `sname` FROM `stu` WHERE `age`+10=30; -- 不会使用索引,因为所有索引列参与了计算
 ​
 SELECT `sname` FROM `stu` WHERE LEFT(`date`,4) <1990; -- 不会使用索引,因为使用了函数运算,原理与上面相同
 ​
 SELECT * FROM `houdunwang` WHERE `uname` LIKE'后盾%' -- 走索引
 ​
 SELECT * FROM `houdunwang` WHERE `uname` LIKE "%后盾%" -- 不走索引
 ​
 -- 正则表达式不使用索引,这应该很好理解,所以为什么在SQL中很难看到regexp关键字的原因
 ​
 -- 字符串与数字比较不使用索引;
 CREATE TABLE `a` (`a` CHAR(10));
 EXPLAIN SELECT * FROM `a` WHERE `a`="1" -- 走索引
 EXPLAIN SELECT * FROM `a` WHERE `a`=1 -- 不走索引
 ​
 SELECT * FROM dept WHERE dname='xxx' OR loc='xx' OR deptno=45
 -- 如果条件中有or,即使其中有条件带索引也不会使用。
 -- 换言之,就是要求使用的所有字段,都必须建立索引, 我们建议大家尽量避免使用or关键字
 ​
 -- 如果mysql估计使用全表扫描要比使用索引快,则不使用索引。

3.2 注意事项

       索引虽然好处很多,但过多的使用索引可能带来相反的问题,索引也是有缺点的:

  • 虽然索引大大提高了查询速度,同时却会降低更新表的速度,如对表进行INSERT、UPDATE和DELETE。因为更新表时,mysql不仅要保存数据,还要保存一下索引文件。

  • 建立索引会占用磁盘空间的索引文件。一般情况下,这个问题不太严重,但如果你在大表上建了多种组合索引,索引文件会膨胀很宽。

       索引只是提高效率的一个方式,如果mysql有大数据量的表,就要花时间研究建立最优的索引,或优化查询语句。

       使用索引时,有一些技巧:

  1. 索引不会包含有NULL的列

       只要列中包含有NULL值,都将不会被包含在索引中,复合索引中只要有一列含有NULL值,那么这一列对于此复合索引就是无效的。

  1. 使用短索引

       对串列进行索引,如果可以就应该指定一个前缀长度。例如,如果有一个char(255)的列,如果在前10个或20个字符内,多数值是唯一的,那么就不要对整个列进行索引。短索引不仅可以提高查询速度,而且可以节省磁盘空间和I/O操作。

  1. 索引列排序

       mysql查询只使用一个索引,因此如果where子句中已经使用了索引的话,那么order by中的列是不会使用索引的。因此数据库默认排序在符合要求的情况下不要使用排序操作,尽量不要包含多个列的排序,如果需要最好给这些列建复合索引。

  1. like语句操作

             一般情况下不鼓励使用like操作,如果非使用不可,注意正确的使用方式。like ‘%aaa%’不会使用索引,而like ‘aaa%’可以使用索引。

  1. 不要在列上进行运算

  1. 不使用NOT IN 、<>、!=操作,但<、<=、=、>、>=、BETWEEN、IN是可以用到索引的

  1. 索引要建立在经常进行select操作的字段上。

             这是因为,如果这些列很少用到,那么有无索引并不能明显改变查询速度。相反,由于增加了索引,反而降低了系统的维护速度和增大了空间需求。

  1. 索引要建立在值比较唯一的字段上。

  1. 对于那些定义为text、image和bit数据类型的列不应该增加索引。

    因为这些列的数据量要么相当大,要么取值很少。

  1. 在where和join中出现的列需要建立索引。

  1. where的查询条件里有不等号(where column != …),mysql将无法使用索引。

  1. 如果where字句的查询条件里使用了函数(如:where DAY(column)=…),mysql将无法使用索引。

  1. 在join操作中(需要从多个数据表提取数据时),mysql只有在主键和外键的数据类型相同时才能使用索引,否则即使建立了索引也不会使用。