文章目录
建立索引
1. =和in可以乱序
比如:
a = 1 and b = 2 and c = 3
建立(a,b,c)索引可以任意顺序,mysql的查询优化器会帮你优化成索引可以识别的形式。
联合索引:Mysql从左到右的使用索引中的字段,一个查询可以只使用索引中的一部份,但只能是最左侧部分。例如索引是
key index (a,b,c)
. 可以支持a
|a,b
|a,b,c
3种组合进行查找,但不支持b,c
进行查找。
联合索引与查询优化器优化乱序 不冲突。
2. 最左前缀匹配原则
mysql会一直向右匹配直到遇到范围查询(>、<、between、like)就停止匹配,比如:
a = 1 and b = 2 and c > 3 and d = 4
如果建立(a,b,c,d)顺序的索引,d是用不到索引的;
如果建立(a,b,d,c)的索引则都可以用到,a,b,d的顺序可以任意调整。
3. 尽量选择区分度高的列作为索引
区分度的公式是:
count(distinct col)/count(*)
表示字段不重复的比例,比例越大我们扫描的记录数越少,唯一键的区分度是1,而一些状态、性别字段可能在大数据面前区分度就是0。
这个比例有什么经验值吗?使用场景不同,这个值也很难确定,一般需要join的字段我们都要求是0.1以上,即平均1条扫描10条记录
唯一性索引的值是唯一的,可以更快速的通过该索引来确定某条记录。例如,学生表中学号是具有唯一性的字段。为该字段建立唯一性索引可以很快的确定某个学生的信息。如果使用姓名的话,可能存在同名现象,从而降低查询速度。
4. 索引列不能参与计算
保持列“干净”,比如:
from_unixtime(create_time) = ’2014-05-29’
就不能使用到索引,原因很简单,b+树中存的都是数据表中的字段值,但进行检索时,需要把所有元素都应用函数才能比较,显然成本太大。
所以语句应该写成:
create_time = unix_timestamp(’2014-05-29’);
5. 尽量的扩展索引,不要新建索引
比如表中已经有a
的索引,现在要加(a,b)
的索引,那么只需要修改原来的索引即可。
6. 为经常需要排序、分组和联合操作的字段建立索引
经常需要ORDER BY
、GROUP BY
、DISTINCT
和UNION
等操作的字段,排序操作会浪费很多时间。
如果为其建立索引,可以有效地避免排序操作。
7. 为常作为查询条件的字段建立索引
如果某个字段经常用来做查询条件,那么该字段的查询速度会影响整个表的查询速度。因此,为这样的字段建立索引,可以提高整个表的查询速度。
8. 限制索引的数目
索引的数目不是越多越好。每个索引都需要占用磁盘空间,索引越多,需要的磁盘空间就越大。修改表时,对索引的重构和更新很麻烦。越多的索引,会使更新表变得很浪费时间。
9. 尽量使用数据量少的索引
如果索引的值很长,那么查询的速度会受到影响。例如,对一个CHAR(100)类型的字段进行全文检索需要的时间肯定要比对CHAR(10)类型的字段需要的时间要多。
10. 尽量使用前缀来索引
如果索引字段的值很长,最好使用值的前缀来索引。例如,TEXT和BLOG类型的字段,进行全文检索会很浪费时间。如果只检索字段的前面的若干个字符,这样可以提高检索速度。
11. 删除不再使用或者很少使用的索引
表中的数据被大量更新,或者数据的使用方式被改变后,原有的一些索引可能不再需要。数据库管理员应当定期找出这些索引,将它们删除,从而减少索引对更新操作的影响。
Where查询优化
1. !=或者<>
在 where 子句中使用!=
或<>
操作符,会使引擎放弃使用索引而进行全表扫描。
2. Null值
在 where 子句中对字段进行null
值判断,会使引擎放弃使用索引而进行全表扫描。
所以Null一般要存为默认值,如0
3. Or连接
在 where 子句中使用 or 来连接条件,会使引擎放弃使用索引而进行全表扫描。
比如:
select * from salaries where user_id=1 or user_id=2;
可改为:
select * from salaries where user_id=1
union all
select * from salaries where user_id=2
4. 表达式操作
在 where 子句中对字段进行表达式操作,会使引擎放弃使用索引而进行全表扫描。
比如:
select * from salaries where num/2=100
可改为:
select * from salaries where num=100*2
5. 不匹配的数据类型
如现在在一张用户信息表中,可能有公民的身份证号码字段,这个字段的类型为字符型。通常情况下,为这个字符类型的字段赋值时需要加入单引号。
select * from salaries where identity_card_id='123456789900'
但是如果把一个纯数字的字符串赋值给一个字符型的字段时,可以不用加单引号。因为此时数据库系统会自动把这串数字转换为字符型数据。比如:
select * from salaries where identity_card_id=123456789900
系统会识别为:
select * from salaries where ToNumber(identity_card_id)=123456789900
相当于做了表达式操作