MySQL --索引操作 与 优化
来源:互联网 发布:qq永久封号软件 编辑:程序博客网 时间:2024/05/19 21:14
索引目的
索引的目的在于提高查询效率,可以类比字典,如果要查“mysql”这个单词,我们肯定需要定位到m字母,然后从下往下找到y字母,再找到剩下的sql。如果没有索引,那么你可能需要把所有单词看一遍才能找到你想要的,如果我想找到m开头的单词呢?或者ze开头的单词呢?是不是觉得如果没有索引,这个事情根本无法完成?
索引原理
除了词典,生活中随处可见索引的例子,如火车站的车次表、图书的目录等。它们的原理都是一样的,通过不断的缩小想要获得数据的范围来筛选出最终想要的结果,同时把随机的事件变成顺序的事件,也就是我们总是通过同一种查找方式来锁定数据。
数据库也是一样,但显然要复杂许多,因为不仅面临着等值查询,还有范围查询(>、<、between、in)、模糊查询(like)、并集查询(or)等等。数据库应该选择怎么样的方式来应对所有的问题呢?我们回想字典的例子,能不能把数据分成段,然后分段查询呢?最简单的如果1000条数据,1到100分成第一段,101到200分成第二段,201到300分成第三段……这样查第250条数据,只要找第三段就可以了,一下子去除了90%的无效数据。但如果是1千万的记录呢,分成几段比较好?稍有算法基础的同学会想到搜索树,其平均复杂度是lgN,具有不错的查询性能。但这里我们忽略了一个关键的问题,复杂度模型是基于每次相同的操作成本来考虑的,数据库实现比较复杂,数据保存在磁盘上,而为了提高性能,每次又可以把部分数据读入内存来计算,因为我们知道访问磁盘的成本大概是访问内存的十万倍左右,所以简单的搜索树难以满足复杂的应用场景。
索引分类
1. 普通索引
这是最基本的索引,它没有任何限制,比如上文中为title字段创建的索引就是一个普通索引,MyIASM中默认的BTREE类型的索引,也是我们大多数情况下用到的索引。
01
–直接创建索引
02
CREATE
INDEX
index_name
ON
table
(
column
(length))
03
–修改表结构的方式添加索引
04
ALTER
TABLE
table_name
ADD
INDEX
index_name
ON
(
column
(length))
05
–创建表的时候同时创建索引
06
CREATE
TABLE
`
table
` (
07
`id`
int
(11)
NOT
NULL
AUTO_INCREMENT ,
08
`title`
char
(255)
CHARACTER
SET
utf8
COLLATE
utf8_general_ci
NOT
NULL
,
09
`content` text
CHARACTER
SET
utf8
COLLATE
utf8_general_ci
NULL
,
10
`
time
`
int
(10)
NULL
DEFAULT
NULL
,
11
PRIMARY
KEY
(`id`),
12
INDEX
index_name (title(length))
13
)
14
–删除索引
15
DROP
INDEX
index_name
ON
table
2. 唯一索引
与普通索引类似,不同的就是:索引列的值必须唯一,但允许有空值(注意和主键不同)。如果是组合索引,则列值的组合必须唯一,创建方法和普通索引类似。
01
–创建唯一索引
02
CREATE
UNIQUE
INDEX
indexName
ON
table
(
column
(length))
03
–修改表结构
04
ALTER
TABLE
table_name
ADD
UNIQUE
indexName
ON
(
column
(length))
05
–创建表的时候直接指定
06
CREATE
TABLE
`
table
` (
07
`id`
int
(11)
NOT
NULL
AUTO_INCREMENT ,
08
`title`
char
(255)
CHARACTER
SET
utf8
COLLATE
utf8_general_ci
NOT
NULL
,
09
`content` text
CHARACTER
SET
utf8
COLLATE
utf8_general_ci
NULL
,
10
`
time
`
int
(10)
NULL
DEFAULT
NULL
,
11
PRIMARY
KEY
(`id`),
12
UNIQUE
indexName (title(length))
13
);
3. 全文索引(FULLTEXT)
MySQL从3.23.23版开始支持全文索引和全文检索,FULLTEXT索引仅可用于 MyISAM 表;他们可以从CHAR、VARCHAR或TEXT列中作为CREATE TABLE语句的一部分被创建,或是随后使用ALTER TABLE 或CREATE INDEX被添加。////对于较大的数据集,将你的资料输入一个没有FULLTEXT索引的表中,然后创建索引,其速度比把资料输入现有FULLTEXT索引的速度更为快。不过切记对于大容量的数据表,生成全文索引是一个非常消耗时间非常消耗硬盘空间的做法。
01
–创建表的适合添加全文索引
02
CREATE
TABLE
`
table
` (
03
`id`
int
(11)
NOT
NULL
AUTO_INCREMENT ,
04
`title`
char
(255)
CHARACTER
SET
utf8
COLLATE
utf8_general_ci
NOT
NULL
,
05
`content` text
CHARACTER
SET
utf8
COLLATE
utf8_general_ci
NULL
,
06
`
time
`
int
(10)
NULL
DEFAULT
NULL
,
07
PRIMARY
KEY
(`id`),
08
FULLTEXT (content)
09
);
10
–修改表结构添加全文索引
11
ALTER
TABLE
article
ADD
FULLTEXT index_content(content)
12
–直接创建索引
13
CREATE
FULLTEXT
INDEX
index_content
ON
article(content)
4. 单列索引、多列索引
多个单列索引与单个多列索引的查询效果不同,因为执行查询时,MySQL只能使用一个索引,会从多个索引中选择一个限制最为严格的索引。
5. 组合索引(最左前缀)
平时用的SQL查询语句一般都有比较多的限制条件,所以为了进一步榨取MySQL的效率,就要考虑建立组合索引。例如上表中针对title和time建立一个组合索引:ALTER TABLE article ADD INDEX index_titme_time (title(50),time(10))。建立这样的组合索引,其实是相当于分别建立了下面两组组合索引:
–title,time
–title
为什么没有time这样的组合索引呢?这是因为MySQL组合索引“最左前缀”的结果。简单的理解就是只从最左面的开始组合。并不是只要包含这两列的查询都会用到该组合索引,如下面的几个SQL所示:
1
–使用到上面的索引
2
SELECT
*
FROM
article WHREE title=
'测试'
AND
time
=1234567890;
3
SELECT
*
FROM
article WHREE utitle=
'测试'
;
4
–不使用上面的索引
5
SELECT
*
FROM
article WHREE
time
=1234567890;
MySQL索引的优化
上面都在说使用索引的好处,但过多的使用索引将会造成滥用。因此索引也会有它的缺点:虽然索引大大提高了查询速度,同时却会降低更新表的速度,如对表进行INSERT、UPDATE和DELETE。因为更新表时,MySQL不仅要保存数据,还要保存一下索引文件。建立索引会占用磁盘空间的索引文件。一般情况这个问题不太严重,但如果你在一个大表上创建了多种组合索引,索引文件的会膨胀很快。索引只是提高效率的一个因素,如果你的MySQL有大数据量的表,就需要花时间研究建立最优秀的索引,或优化查询语句。下面是一些总结以及收藏的MySQL索引的注意事项和优化方法。
1. 何时使用聚集索引或非聚集索引?
动作描述使用聚集索引使用非聚集索引列经常被分组排序使用使用返回某范围内的数据使用不使用一个或极少不同值不使用不使用小数目的不同值使用不使用大数目的不同值不使用使用频繁更新的列不使用使用外键列使用使用主键列使用使用频繁修改索引列不使用使用事实上,我们可以通过前面聚集索引和非聚集索引的定义的例子来理解上表。如:返回某范围内的数据一项。比如您的某个表有一个时间列,恰好您把聚合索引建立在了该列,这时您查询2004年1月1日至2004年10月1日之间的全部数据时,这个速度就将是很快的,因为您的这本字典正文是按日期进行排序的,聚类索引只需要找到要检索的所有数据中的开头和结尾数据即可;而不像非聚集索引,必须先查到目录中查到每一项数据对应的页码,然后再根据页码查到具体内容。其实这个具体用法我还不是很理解,只能等待后期的项目开发中慢慢学学了。
2. 索引不会包含有NULL值的列
只要列中包含有NULL值都将不会被包含在索引中,复合索引中只要有一列含有NULL值,那么这一列对于此复合索引就是无效的。所以我们在数据库设计时不要让字段的默认值为NULL。
3. 使用短索引
对串列进行索引,如果可能应该指定一个前缀长度。例如,如果有一个CHAR(255)的列,如果在前10个或20个字符内,多数值是惟一的,那么就不要对整个列进行索引。短索引不仅可以提高查询速度而且可以节省磁盘空间和I/O操作。
4. 索引列排序
MySQL查询只使用一个索引,因此如果where子句中已经使用了索引的话,那么order by中的列是不会使用索引的。因此数据库默认排序可以符合要求的情况下不要使用排序操作;尽量不要包含多个列的排序,如果需要最好给这些列创建复合索引。
5. like语句操作
一般情况下不鼓励使用like操作,如果非使用不可,如何使用也是一个问题。like “%aaa%” 不会使用索引而like “aaa%”可以使用索引。
6. 不要在列上进行运算
例如:select * from users where YEAR(adddate)<2007,将在每个行上进行运算,这将导致索引失效而进行全表扫描,因此我们可以改成:select * from users where adddate<’2007-01-01′。关于这一点可以围观:一个单引号引发的MYSQL性能损失。
最后总结一下,MySQL只对一下操作符才使用索引:<,<=,=,>,>=,between,in,以及某些时候的like(不以通配符%或_开头的情形)。而理论上每张表里面最多可创建16个索引,不过除非是数据量真的很多,否则过多的使用索引也不是那么好玩的,比如我刚才针对text类型的字段创建索引的时候,系统差点就卡死了。
- MySQL --索引操作 与 优化
- mysql 索引与优化
- MySQL索引与优化
- MySQL索引与优化
- MYSQL 索引与优化
- Mysql索引与优化
- Mysql 索引与优化
- MYSQL索引与优化
- MySQL索引与优化
- MySQL索引与优化
- Mysql--索引与优化
- Mysql索引与优化
- MySQL索引与优化
- mysql索引与优化
- MySQL索引与优化
- MySQL 索引与优化
- MySQL索引与优化
- MySQL索引与优化
- deBug日志_关于在多个fragment中又嵌套多个fragment导致控件显示错乱与不知名bug
- Java集合框架之Collection实例解析
- 内存溢出、内存泄露、内存越界、缓冲区溢出、栈溢出
- 五款最佳Linux下载管理器推荐
- 数据结构队列之javascript实现
- MySQL --索引操作 与 优化
- JQuery修改CSS伪类
- Hibernate学习(2)------ Hibernate的配置文件
- linux常用的几个命令
- 线性代数常用基本知识 (含向量和矩阵范数<Matrix or vector norm>)
- 围绕业务订单进行的可扩展后台设计
- 讨论5种跟踪Java执行的方法
- 删除CentOS系统自带的jdk
- View绘制详解,从LayoutInflater谈起