「mysql优化专题」程序员面试都用得上的索引优化手册(5)【面试重点】

时间 2019-11-17

标签 mysql 优化专题程序员面试用得上索引手册面试重点栏目 MySQL 繁體版

原文原文链接

本专题讲到索引查询优化，恭喜你，已经达到mysql优化的中级水平。这篇咱们要讲的是mysql优化中重点中的重点——索引优化。面试官百分百必问mysql

1、索引的概述

1）什么是索引？并发

索引是一种特殊的文件(InnoDB数据表上的索引是表空间的一个组成部分)，它们包含着对数据表里全部记录的引用指针。更通俗的说，索引就至关于目录。当你在用新华字典时，帮你把目录撕掉了，你查询某个字开头的成语只能从第一页翻到第一千页。累！把目录还给你，则能快速定位！高并发

2）索引的优缺点：

能够大大加快数据的检索速度，这也是建立索引的最主要的缘由。，且经过使用索引，能够在查询的过程当中，使用优化隐藏器，提升系统的性能。可是，索引也是有缺点的：索引须要额外的维护成本；由于索引文件是单独存在的文件,对数据的增长,修改,删除,都会产生额外的对索引文件的操做,这些操做须要消耗额外的IO,会下降增/改/删的执行效率。

2、索引的基本使用

1）建立索引：（三种方式）

第一种方式：

第二种方式：使用ALTER TABLE命令去增长索引：

ALTER TABLE用来建立普通索引、UNIQUE索引或PRIMARY KEY索引。

其中table_name是要增长索引的表名，column_list指出对哪些列进行索引，多列时各列之间用逗号分隔。

索引名index_name可本身命名，缺省时，MySQL将根据第一个索引列赋一个名称。另外，ALTER TABLE容许在单个语句中更改多个表，所以能够在同时建立多个索引。

第三种方式：使用CREATE INDEX命令建立

CREATE INDEX可对表增长普通索引或UNIQUE索引。（可是，不能建立PRIMARY KEY索引）

3、索引的基本原理（不想像别的文章那样一大堆篇幅废话）

索引用来快速地寻找那些具备特定值的记录。若是没有索引，通常来讲执行查询时遍历整张表。

索引的原理很简单，就是把无序的数据变成有序的查询

一、把建立了索引的列的内容进行排序

二、对排序结果生成倒排表

三、在倒排表内容上拼上数据地址链

四、在查询的时候，先拿到倒排表内容，再取出数据地址链，从而拿到具体数据

4、索引的数据结构（b树，hash）

1）B树索引

mysql经过存储引擎取数据，基本上90%的人用的就是InnoDB了，按照实现方式分，InnoDB的索引类型目前只有两种：BTREE（B树）索引和HASH索引。B树索引是Mysql数据库中使用最频繁的索引类型，基本全部存储引擎都支持BTree索引。一般咱们说的索引不出意外指的就是（B树）索引（实际是用B+树实现的，由于在查看表索引时，mysql一概打印BTREE，因此简称为B树索引）

查询方式：

主键索引区:PI(关联保存的时数据的地址)按主键查询,

普通索引区:si(关联的id的地址,而后再到达上面的地址)。因此按主键查询,速度最快

B+tree性质：

1.）n棵子tree的节点包含n个关键字，不用来保存数据而是保存数据的索引。

2.）全部的叶子结点中包含了所有关键字的信息，及指向含这些关键字记录的指针，且叶子结点自己依关键字的大小自小而大顺序连接。

3.）全部的非终端结点能够当作是索引部分，结点中仅含其子树中的最大（或最小）关键字。

4.）B+ 树中，数据对象的插入和删除仅在叶节点上进行。

5.）B+树有2个头指针，一个是树的根节点，一个是最小关键码的叶节点。

2）哈希索引

简要说下，相似于数据结构中简单实现的HASH表（散列表）同样，当咱们在mysql中用哈希索引时，主要就是经过Hash算法（常见的Hash算法有直接定址法、平方取中法、折叠法、除数取余法、随机数法），将数据库字段数据转换成定长的Hash值，与这条数据的行指针一并存入Hash表的对应位置；若是发生Hash碰撞（两个不一样关键字的Hash值相同），则在对应Hash键下以链表形式存储。固然这只是简略模拟图。

ps：关于数据结构，有兴趣深刻的朋友能够关注我后查看【数据结构】专题，这里不作详细讲解。

5、建立索引的原则（重中之重）

索引虽好，但也不是无限制的使用，最好符合一下几个原则

1）最左前缀匹配原则，组合索引很是重要的原则，mysql会一直向右匹配直到遇到范围查询(>、<、between、like)就中止匹配，好比a = 1 and b = 2 and c > 3 and d = 4 若是创建(a,b,c,d)顺序的索引，d是用不到索引的，若是创建(a,b,d,c)的索引则均可以用到，a,b,d的顺序能够任意调整。

2）较频繁做为查询条件的字段才去建立索引

3）更新频繁字段不适合建立索引

4）如果不能有效区分数据的列不适合作索引列(如性别，男女未知，最多也就三种，区分度实在过低)

5）尽可能的扩展索引，不要新建索引。好比表中已经有a的索引，如今要加(a,b)的索引，那么只须要修改原来的索引便可。

6）定义有外键的数据列必定要创建索引。

7）对于那些查询中不多涉及的列，重复值比较多的列不要创建索引。

8）对于定义为text、image和bit的数据类型的列不要创建索引。

百万级别或以上的数据如何删除

关于索引：因为索引须要额外的维护成本，由于索引文件是单独存在的文件,因此当咱们对数据的增长,修改,删除,都会产生额外的对索引文件的操做,这些操做须要消耗额外的IO,会下降增/改/删的执行效率。因此，在咱们删除数据库百万级别数据的时候，查询MySQL官方手册得知删除数据的速度和建立的索引数量是成正比的。

因此咱们想要删除百万数据的时候能够先删除索引（此时大概耗时三分多钟）
而后删除其中无用数据（此过程须要不到两分钟）
删除完成后从新建立索引(此时数据较少了)建立索引也很是快，约十分钟左右。
与以前的直接删除绝对是要快速不少，更别说万一删除中断,一切删除会回滚。那更是坑了。

今天，索引的讲解就到这里，重点提一下，索引基本原理和建立索引的原则是重点，面试基本必问！你们能够收藏好多理解理解。本号内有多个专题，如【数据结构】、【netty专题】、【dubbo专题】、【mysql优化专题】、【redis专题】、【高并发专题】等优质好文。以为有收获的同窗来个关注。