文档章节

MySQL索引和优化查询

__JM_Joy__
 __JM_Joy__
发布于 2015/06/04 21:38
字数 2504
阅读 22
收藏 0

索引和优化查询

恰当的索引可以加快查询速度,可以分为四种类型:主键、唯一索引、全文索引、普通索引。

主键:唯一且没有null值。

create table pk_test(f1 int not null,primary key(f1));

alter table customer modify id int not null, add primary key(id);

普通索引:允许重复的值出现。

create table tableanme (fieldname1 columntype,fieldname2 columntype,index [indexname] (fieldname1 [,fieldname2...]));

create table tablename add index [indexname] (fieldname1 [fieldname2...]);

alter table slaes add index(value);

全文索引:用来对大表的文本域(char,varchar,text)进行索引。

语法和普通索引一样-fulltext。

使用全文索引:create table ft2 (f1 varchar(255),fulltext(f1));

insert into ft2 values(‘wating for the bvarbariands‘),(‘in the heart of the country‘),(‘the master of petersburg‘),(‘writing and being‘),(‘heart of the beast‘),(‘master master‘);

select * from ft2 where match(f1) against(‘master‘); // match()-匹配域;against()匹配值。

mysql会对某些字忽略,造成查询的误差:a. 50%以上的域出现的单词;b.少于三个字的单词;c.mysql预定义的列表,包括the。查询语句:select * from ft2 where match(f1) against(‘the master‘); // 与希望的结果是不同的

相关性分数查询:select f1,(match(f1) against(‘master‘)) from ft2;

mysql4的新功能-布尔全文查询:select * from ft2 where match(f1) against(‘+master -pet‘ in boolean mode); // 运算符类型 +-<>()~*"

唯一索引:除了不能有重复的记录外,其它和普通索引一样。

create table ui_test (f1 int,f2 int,unique(f1));

alter table ui_test add unique(f2);

对域(varchar,char,blob,text)的部分创建索引:alter table customer add index (surname(10));

自动增加域:每次插入记录时会自动增加一个域的值,只能用于一个域,且这个域有索引。

create table tablename(fieldname int auto_increment,[fieldname2...,] primary key(filedname));

alter table tablename modify fieldname columntype auto_increment;

last_insert_id()函数返回最新插入的自动增加值。

select last_insert_id() from customer limit 1;

此函数在多个连接同时进行时,会发生错误。

重置自动增加计数器的值:

create table tablename(fieldname int auto_increment,[fieldname2...,] primary key(filedname) auto_increment=50);

alter table tablename auto_increment=50;

如果重置的值比存在的值小,自动增加计数器会从记录中最大的那个值开始增加计数,比如customer表中的id已经有1、2、3、15、16、20,当把自动增加计数器的值设为1时,下次插入的记录会从21开始。

自动增加计数器的越界:有效值为1~2的127次方,即2147483647。如果超过这个值(包括负值),mysql会自动把它设为最大值,这样就会产生一个重复键值的错误。

自动增加域在多列索引中的使用:

create table staff(rank enum(‘employee‘,‘manager‘,‘contractor‘) not null,position varchar(100),id int not null auto_increment,primary key(rank,id));

insert into staff(rank,position) values(‘employee‘,‘cleaner‘),(‘cotractor‘,‘network maintenance‘),(‘manager‘,‘sales manager‘);

在对每个级别添加一些数据,会看到熟悉的自动增加现象:

insert into staff(rank,position) values(‘employee‘,‘cleaner1‘),(‘employee‘,‘network maintenance1‘),(‘manager‘,‘sales manager1‘);

在这种情况下是不能重置自动增加计数器的。

删除或更改索引:对索引的更改都需要先删除再重新定义。

alter table tablename drop primary key;

alter table table drop index indexname;

drop index on tablename;

高效使用索引:下面讨论的是用了索引会给我们带来什么?

1.) 获得域where从句中匹配的行:select * from customer where surname>‘c‘;

2.) 查找max()和min()值时,mysql只需在排序的索引中查找第一个和最后一个值。

3.) 返回的部分是索引的一部分,mysql就不需要去查询全表的数据而只需看索引:select id from customer;

4.) 对域使用order by的地方:select * from customer order by surname;

5.) 还可以加速表的连接:select first_name,surname,commission from sales,sales_rep where sales.sales_rep=sales_rep.employee_number and code=8;

6.) 在通配符的情况下:select * from sales_rep where surname like ‘ser%‘;

这种情况就不能起作用:select * from sales_rep where surname like ‘%ser%‘;

选择索引:

1.) 有查询需要使用索引(比如where从句中条件的域)的时候,要创建索引;不要不使用的域(不如第一个字符是通配符的)创建索引。

2.) 创建的索引返回的行越少越好,主键最好,枚举类型的索引不什么用处。

3.) 使用短索引(比如,名字的头十个字符而不是全部)。

4.) 不要创建太多的索引,虽然加快了查询的速度,但增加了更新的添加记录的时间。如果索引在查询中很少使用,而没有索引只是轻微的影响速度,就不要创建索引。

最左边规则:这种情况发生在多个有索引的域上,mysql从索引列表的最左边开始,按顺序使用他们。

alter table customer add initial varchar(5);

alter table customer add index(surname,initial,first_name);

update customer set initial=‘x‘ where id=1;

update customer set initial=‘c‘ where id=2;

update customer set initial=‘v‘ where id=3;

update customer set initial=‘b‘ where id=4;

update customer set initial=‘n‘ where id=20;

update customer set initial=‘m‘ where id=21;

如果在查询中使用了这三个域,那就最大限度的利用了索引:select * from customer where surname=‘clegg‘ and initial=‘x‘ and first_name=‘yvonne‘;

或者是利用索引的大部分:select * from customer where surname=‘clegg‘ and initial=‘x‘;

或仅仅是surname:select * from customer where surname=‘clegg‘;

如果打破最左边规则,下面的例子就不会用到索引:select * from customer where initial=‘x‘ and first_name=‘yvonne‘;

select * from customer where initial=‘x‘ ;

select * from customer where first_name=‘yvonne‘;

select * from customer where surname=‘clegg‘ and first_name=‘yvonne‘;


使用explain-解释mysql如何使用索引来处理select语句及连接表的。

输入 explain select * from customer; 后,出现一张表,个行的意思如下:

table-显示此行数据属于哪张表;type-重要的一列,显示使用了何种连接,从好到差依次为const、eq_ref、ref、range、index、all,下面会详细说明;possible_keys-可以应用在这张表中的索引,如果为null,则表示没有可用索引;key-实际使用的索引,如为null,表示没有用到索引;key_len-索引的长度,在不损失精确度的情况下,越短越好;ref-显示索引的哪一列被使用了,如果可能的话,是个常数;rows-返回请求数据的行数;extra-关于mysql如何解析查询的额外信息,下面会详细说明。

extra行的描述:distinct-mysql找到了域行联合匹配的行,就不再搜索了;

not exists-mysql优化了left join,一旦找到了匹配left join的行,就不再搜索了;

range checked for each-没找到理想的索引,一次对于从前面表中来的每一个行组合;

record(index map: #)-检查使用哪个索引,并用它从表中返回行,这是使用索引最慢的一种;

using filesort-看到这个就需要优化查询了,mysql需要额外的步骤来发现如何对返回的行排序。他根据连接类型以及存储排序键值和匹配条件的全部行的行指针来排序全部行。

using index-列数据是从单单使用了索引中的信息而没有读取实际行的表返回的,这发生在对表的全部的请求列都是同一个索引时;

using temporary-看到这个就需要优化查询了,mysql需要创建一个临时表来查询存储结果,这通常发生在多不同的列表进行order by时,而不是group by;

where used-使用了where从句来限制哪些行将与下一张表匹配或是返回给用户。如不想返回表中用的全部行,并连接类型是all或index,这就会发生,也可能是查询有问题。

type的描述:system-表只有一行,这是const连接类型的特例;const-表中一个记录的最大值能够匹配这个查询(索引可以是主键或唯一索引)。因为只有一行,这个值实际就是常数,因为mysql先读这个值,再把它当作常数对待;eq_ref-从前面的表中,对每一个记录的联合都从表中读取一个记录。在查询使用索引为主键或唯一索引的全部时使用;ref-只有使用了不是主键或唯一索引的部分时发生。对于前面表的每一行联合,全部记录都将从表中读出,这个连接类型严重依赖索引匹配记录的多少-越少越好;range-使用索引返回一个范围中的行,比如使用>或<查找时发生;index-这个连接类型对前面的表中的每一个记录联合进行完全扫描(比all好,因为索引一般小于表数据);all-这个连接类型多前面的表中的每一个记录联合进行完全扫描,这个比较糟糕,应该尽量避免。

举个例子:create index sales_rep on sales(sales_rep); // 可以比较一下创建索引前后的变化

explain select * from sales_rep left join sales on sales.sales_rep = sales_rep.employee_number; 

结果如下:

table type possible_keys key key_len ref rows extra

sales_rep all null null null null 5

sales ref sales_rep sales_rep 5 sales_rep.employee_number 2

这个结果表示sales_rep表有个不好的连接类型-all,没用到索引,要查询的行数为5;sales的连接类型为ref,可用的索引是sales_rep,实际也使用sales_rep索引,这个索引的长度是5,对应的列是employee_number,要查询的行数为2,所以这次查询对表共进行了5×2次查询。


查看索引信息:show index from tablename;

列的描述:table-正在查看的表名;non_unique-1或1.0表示索引不能包含重复值(主键和唯一索引),1表示可以;key_name-索引名;seq_in_index-索引中列的顺序,从1开始;column_name-列名;collation-a或null,a表示索引以序升排列,null表示不排序;cardinality-索引中唯一值的个数;sub_part-如果整个列为索引,值为null,否则以字符表示索引的大小;packed-是否打包;null-如果列能包含null,则为yes;comment-各种注释。


本文转载自:http://blog.chinaunix.net/uid-20577907-id-3063379.html

共有 人打赏支持
__JM_Joy__
粉丝 31
博文 26
码字总数 4751
作品 0
江门
程序员
私信 提问
MySQL 索引选择原则

目的 MySQL查询优化器是基于代价(cost-based)的查询方式。因此,在查询过程中,最重要的一部分是根据查询的SQL语句,依据多种索引,计算查询需要的代价,从而选择最优的索引方式生成查询计...

tara_qri
2015/09/24
62
0
SQL-SQL优化-索引

图文并茂详解 SQL JOIN Join 是关系型数据库系统的重要操作之一,一般关系型数据库中包含的常用 Join:内联接、外联接和交叉联接等。如果我们想在两个或以上的表获取其中从一个表中的行与另一...

掘金官方
2017/12/25
0
0
MySQL 索引选择原则分析(二)

2:MySQL索引选择规则(唯一索引查询) studentsorigin表中只有主键,没有建立索引。 select id, name from studentsorigin; 根据MySQL 索引选择原则分析(一)2.1来分析,所以只能是全表扫描...

tara_qri
2015/10/14
24
0
「mysql优化专题」本专题总结终章(13)

一个月过去了,【mysql优化专题】围绕着mysql优化进行了十三篇的优化文章,下面进行一次完整的总结!我尝试用最简短最通俗易懂的话阐述明白每篇文章,让本专题画上完美的句号!坚持到文末,留...

java进阶架构师
2018/01/04
0
0
PHPer面试指南-MySQL 篇

本书的 GitHub 地址:https://github.com/todayqq/PHPerInterviewGuide 什么是索引,作用是什么?常见索引类型有那些?Mysql 建立索引的原则? 索引是一种特殊的文件,它们包含着对数据表里所...

angkee
2018/01/24
0
0

没有更多内容

加载失败,请刷新页面

加载更多

IOS  学习记录

1.StackView=>IOS 9及以上支持 2.布局方式: AutoLayout / StackView 堆布局 (线性布局) 3.屏幕适配 (资源分辨率、设计分辨率、屏幕分辨率) Size Class技术 可以针对 屏幕的方向进行设置...

萨x姆
56分钟前
3
0
第四次工业革命:自主经济的崛起

https://36kr.com/p/5170370.html

shengjuntu
昨天
3
0
Cloud Native 与12-Factor

12-Factor(twelve-factor),也称为“十二要素”,是一套流行的应用程序开发原则。Cloud Native架构中使用12-Factor作为设计准则。 12-Factor 的目标在于: 使用标准化流程自动配置,从而使...

waylau
昨天
9
0
java多线程2

“非线程安全”问题存在于“实例变量”中,如果是方法内部的私有变量,则不存在线程安全问题。这是因为方法内部的变量都是私有造成的。 synchronized 获取的都是对象锁。如果多个线程访问多个...

一滴水穿石
昨天
4
0
今天的学习

1,document.location.href:获取整个url 2,str.split(' '):用字符分割字符串 3,$this->load->library(' '):引用图像处理类 4,$this->load->library(' '):引用Email类 5,特殊访问指针$th......

墨冥
昨天
6
0

没有更多内容

加载失败,请刷新页面

加载更多

返回顶部
顶部