- 浏览: 167485 次
- 性别:
- 来自: 广州
文章分类
最新评论
-
xiangyufangai:
很好很强大膜拜中哈哈!!
VB 两个字符串处理函数(类似Left/Mid/Right/Split的结合) -
hellohank:
这个……叫摘要算法,不叫加密算法~
Java实现的加密工具类(支持MD5和SHA) -
NIUCH1029291561:
接口有问题奥
网银在线支付接口和应用 -
yeuego:
能幫你就行了
MySQL索引分析 -
ForgiDaved:
很给力的介绍。记得前段时间给一个系统加功能,设计的表没有 ...
MySQL索引分析
走向精通MySQL的道路非常的艰难,还好各种关系型数据库大同小异,足够让我从增删改查上升到高性能数据库的架构和调优。这期间的各种概念就不絮叨了,我也很难表述的很清楚,昨天写了个小脚本往我本机MySQL数据库的某张表里面注入了200万条数据(Windows7旗舰版/1.66GHz/2G内存/MySQL5.1.50),数据表的结构如下图所示,属于一个比较基本的定长表,考虑到我可怜的本本的承受能力,id使用从1开始的自增,title字段为随机20个标题中的一个,content都是相同的内容,time使用时间戳而非datetime类型,即10位整型数据。
就是这么一个结构极其简单的表,200万数量级的复杂查询将会变的非常缓慢,比如执行下面的SQL语句。
SELECT a.id,FROM_UNIXTIME(a.time)
FROM article AS a
WHERE a.title=‘PHP笔试题和答案——基础语言方面’
查询时间基本上需要50-100秒,这个是非常恐怖的,如果加上联合查询和其他一些约束条件,数据库会疯狂的消耗内存。
如果这时候数据库里面针对title字段建立了索引,查询效率将会大幅度提升,如下图所示。可见对于大型数据库,建立索引是非常非常重要的一个优化手段(当然还会有很多其他优化这样的数据库的方法,但是本文主题所限,暂不讨论。),废话了这么多,以下开始总结MySQL中索引的使用方法和性能优化以及一些注意事项。
索引的概念
索引是一种特殊的文件(InnoDB数据表上的索引是表空间的一个组成部分),它们包含着对数据表里所有记录的引用指针。更通俗的说,数据库索引好比是一本书前面的目录,能加快数据库的查询速度。上述SQL语句,在没有索引的情况下,数据库会遍历全部200条数据后选择符合条件的;而有了相应的索引之后,数据库会直接在索引中查找符合条件的选项。如果我们把SQL语句换成“SELECT * FROM article WHERE id=2000000”,那么你是希望数据库按照顺序读取完200万行数据以后给你结果还是直接在索引中定位呢?上面的两个图片鲜明的用时对比已经给出了答案(注:一般数据库默认都会为主键生成索引)。
索引分为聚簇索引和非聚簇索引两种,聚簇索引是按照数据存放的物理位置为顺序的,而非聚簇索引就不一样了;聚簇索引能提高多行检索的速度,而非聚簇索引对于单行的检索很快。
索引的类型
1. 普通索引
这是最基本的索引,它没有任何限制,比如上文中为title字段创建的索引就是一个普通索引。
–直接创建索引 CREATE INDEX indexName ON table(column(length))
–修改表结构的方式添加索引 ALTER tableADD INDEX indexName ON (column(length))
–创建表的时候同时创建索引 CREATE TABLE `table` ( `id` int(11) NOT NULL AUTO_INCREMENT , `title` char(255) CHARACTER SET utf8 COLLATE utf8_general_ci NOT NULL , `content` text CHARACTER SET utf8 COLLATE utf8_general_ci NULL , `time` int(10) NULL DEFAULT NULL , PRIMARY KEY (`id`), INDEX indexName (title(length)) )
PRIMARY KEY (`id`), KEY `listorder` (`id`,`time`)
–删除索引 DROP INDEX indexName ON table
2. 唯一索引
与普通索引类似,不同的就是:索引列的值必须唯一,但允许有空值(注意和主键不同)。如果是组合索引,则列值的组合必须唯一,创建方法和普通索引类似。
–创建唯一索引 CREATE UNIQUE INDEX indexName ON table(column(length))
–修改表结构 ALTER table ADD UNIQUE indexName ON (column(length))
–创建表的时候直接指定 CREATE TABLE `table` ( `id` int(11) NOT NULL AUTO_INCREMENT , `title` char(255) CHARACTER SET utf8 COLLATE utf8_general_ci NOT NULL , `content` text CHARACTER SET utf8 COLLATE utf8_general_ci NULL , `time` int(10) NULL DEFAULT NULL , PRIMARY KEY (`id`), UNIQUE indexName (title(length)) );
3. 全文索引(FULLTEXT)
MySQL从3.23.23版开始支持全文索引和全文检索,FULLTEXT索引仅可用于 MyISAM 表;他们可以从CHAR、VARCHAR或TEXT列中作为CREATE TABLE语句的一部分被创建,或是随后使用ALTER TABLE 或CREATE INDEX被添加。////对于较大的数据集,将你的资料输入一个没有FULLTEXT索引的表中,然后创建索引,其速度比把资料输入现有FULLTEXT索引的速度更为快。不过切记对于大容量的数据表,生成全文索引是一个非常消耗时间非常消耗硬盘空间的做法。
–创建表的适合添加全文索引 CREATE TABLE `table` ( `id` int(11) NOT NULL AUTO_INCREMENT , `title` char(255) CHARACTER SET utf8 COLLATE utf8_general_ci NOT NULL , `content` text CHARACTER SET utf8 COLLATE utf8_general_ci NULL , `time` int(10) NULL DEFAULT NULL , PRIMARY KEY (`id`), FULLTEXT (content) );
–修改表结构添加全文索引 ALTER TABLE article ADD FULLTEXT index_content(content)
–直接创建索引 CREATE FULLTEXT INDEX index_content ON article(content)
4. 单列索引、多列索引
多个单列索引与单个多列索引的查询效果不同,因为执行查询时,MySQL只能使用一个索引,会从多个索引中选择一个限制最为严格的索引。
5. 组合索引(最左前缀)
平时用的SQL查询语句一般都有比较多的限制条件,所以为了进一步榨取MySQL的效率,就要考虑建立组合索引。例如上表中针对title和time建立一个组合索引:ALTER TABLE article ADD INDEX index_titme_time (title(50),time(10))。建立这样的组合索引,其实是相当于分别建立了下面两组组合索引:
–title,time
–title
为什么没有time这样的组合索引呢?这是因为MySQL组合索引“最左前缀”的结果。简单的理解就是只从最左面的开始组合。并不是只要包含这两列的查询都会用到该组合索引,如下面的几个SQL所示:
–使用到上面的索引
SELECT * FROM article WHREE title=“PHP程序员” AND time=1234567890
SELECT * FROM article WHREE utitle=“PHP程序员”
–不使用上面的索引
SELECT * FROM article WHREE time=1234567890
MySQL索引的优化
上面都在说使用索引的好处,但过多的使用索引将会造成滥用。因此索引也会有它的缺点:虽然索引大大提高了查询速度,同时却会降低更新表的速度,如对表进行INSERT、UPDATE和DELETE。因为更新表时,MySQL不仅要保存数据,还要保存一下索引文件。建立索引会占用磁盘空间的索引文件。一般情况这个问题不太严重,但如果你在一个大表上创建了多种组合索引,索引文件的会膨胀很快。索引只是提高效率的一个因素,如果你的MySQL有大数据量的表,就需要花时间研究建立最优秀的索引,或优化查询语句。下面是一些总结以及收藏的MySQL索引的注意事项和优化方法。
1. 何时使用聚集索引或非聚集索引?
动作描述 | 使用聚集索引 | 使用非聚集索引 |
列经常被分组排序 | 使用 | 使用 |
返回某范围内的数据 | 使用 | 不使用 |
一个或极少不同值 | 不使用 | 不使用 |
小数目的不同值 | 使用 | 不使用 |
大数目的不同值 | 不使用 | 使用 |
频繁更新的列 | 不使用 | 使用 |
外键列 | 使用 | 使用 |
主键列 | 使用 | 使用 |
频繁修改索引列 | 不使用 | 使用 |
事实上,我们可以通过前面聚集索引和非聚集索引的定义的例子来理解上表。如:返回某范围内的数据一项。比如您的某个表有一个时间列,恰好您把聚合索引建立在了该列,这时您查询2004年1月1日至2004年10月1日之间的全部数据时,这个速度就将是很快的,因为您的这本字典正文是按日期进行排序的,聚类索引只需要找到要检索的所有数据中的开头和结尾数据即可;而不像非聚集索引,必须先查到目录中查到每一项数据对应的页码,然后再根据页码查到具体内容。其实这个具体用法我还不是很理解,只能等待后期的项目开发中慢慢学学了。
2. 索引不会包含有NULL值的列
只要列中包含有NULL值都将不会被包含在索引中,复合索引中只要有一列含有NULL值,那么这一列对于此复合索引就是无效的。所以我们在数据库设计时不要让字段的默认值为NULL。
3. 使用短索引
对串列进行索引,如果可能应该指定一个前缀长度。例如,如果有一个CHAR(255)的列,如果在前10个或20个字符内,多数值是惟一的,那么就不要对整个列进行索引。短索引不仅可以提高查询速度而且可以节省磁盘空间和I/O操作。
4. 索引列排序
MySQL查询只使用一个索引,因此如果where子句中已经使用了索引的话,那么order by中的列是不会使用索引的。因此数据库默认排序可以符合要求的情况下不要使用排序操作;尽量不要包含多个列的排序,如果需要最好给这些列创建复合索引。
5. like语句操作
一般情况下不鼓励使用like操作,如果非使用不可,如何使用也是一个问题。like “%aaa%” 不会使用索引而like “aaa%”可以使用索引。
6. 不要在列上进行运算
例如:select * from users where YEAR(adddate)<2007,将在每个行上进行运算,这将导致索引失效而进行全表扫描,因此我们可以改成:select * from users where adddate<’2007-01-01′。关于这一点可以围观:一个单引号引发的MYSQL性能损失。
最后总结一下,MySQL只对一下操作符才使用索引:<,<=,=,>,>=,between,in,以及某些时候的like(不以通配符%或_开头的情形)。而理论上每张表里面最多可创建16个索引,不过除非是数据量真的很多,否则过多的使用索引也不是那么好玩的,比如我刚才针对text类型的字段创建索引的时候,系统差点就卡死了。
最后的最后PS:现在更新个技术文章真难,还得做大量实验…
评论
发表评论
-
用户体验之网页版块设计
2011-05-27 16:50 1533用户体验(User Experience ... -
CivWorld Relies On Multiplayer, Multiple Game Types To Conquer Facebook
2011-05-24 10:13 1303Console game publisher 2K Games ... -
游戏业各种形式的起伏给社交媒体的启示
2011-05-24 10:08 1079两点之间线段最短 ... -
手机社交游戏需具备的十大功能
2011-05-24 10:04 1051在旧金山举办的游戏开 ... -
全球SNS用户学历调查:中国社交网站包揽前四
2011-05-24 10:03 11295月12日消息,近日 ... -
Facebook新游戏人体模仿俄罗斯方块
2011-05-24 09:57 1360Eastpak的Facebook广告游戏《SPAK》是人体 ... -
Fleck用谷歌地图功能推LBS社交游戏
2011-05-24 09:54 1070也许有玩家还没有 ... -
调查称10%用户成功完成50%社交游戏邀请
2011-05-24 09:49 1286一组调查人员在去年发布了一份关于社交游戏传播动态的调查 ... -
虚拟主机集群的优缺点分析
2011-03-09 16:47 1010服务器虚拟化最显著 ... -
集群的负载均衡技术
2011-03-09 16:46 904前言 当前,无论 ... -
网银在线支付接口和应用
2011-03-09 16:44 1921最近关注项目中在线支付,所以看一下文档,在线支付应用开发: ... -
Facebook如何管理150亿张照片
2011-03-09 16:42 1120Facebook 的照片分享很受欢迎,迄今,Faceboo ... -
mmorpg要点整理
2011-03-02 00:41 908主题:mmropg客户闻风而动 ... -
facebook又改版了:之前的文章,不知还可不可以用了
2011-03-02 00:38 855手把手教你开发Facebook 应用 在这里记录一下, ... -
如何写一份好的数据分析报告/邮件
2011-03-02 00:21 711在谈这个问题之前先说 ... -
什么是游戏策划,如何成为一名游戏策划
2011-03-02 00:20 843一:什么是策划 策划, ... -
游戏活动策划案例分析
2011-03-02 00:15 827某网游是由国内某知名游戏公司研发并运营,游戏题材为武侠。在这款 ... -
三维程序游戏制作基本常识
2011-03-02 00:06 685很多flash3d初学者都是从 ... -
遇敌原理研究
2011-03-02 00:05 655这是原理解释,虽说 ... -
Window服务全攻略
2011-02-16 00:04 920对于我们经常使用的windows 2000/xp ...
相关推荐
MySQL索引分析和优化.pdf 记录自己在学习过程中看过的书欢迎下载
Mysql索引分析文章
MySQL索引分析和优化[定义].pdf
MySQL索引分析.pdf
MySQL索引分析和优化,介绍了索引的类型,单列索引与多列索引,最左前缀,选择索引
MySQL索引分析及优化.pdf
mysql索引分析和优化的文档,不错的,可以看看
讲述mysql索引的优化,很实用,对初学都很有帮助,值得一看
索引相关知识点整理以及问题分析
由浅入深探究mysql索引结构原理、性能分析与优化
MySQL 索引分析和优化
讲座的一个ppt分享 1. MySQL的索引类型选择 2. MySQL数据结构分析 3. MySQL的引擎类型分析
1 .索引的存储结构是什么? 是B树、B+树还是二叉树 2.什么是聚集索引? 聚集索引的主键索引和次要索引区别是什么 3.什么是非聚集索引? 非聚集索引的主键索引和次要索引区别是什么
MySQL索引的最佳实践和执行计划的使用分析,包括索引的设计原则,SQL语句的优化原则等
Mysql架构、索引介绍及原理分析.zipMysql架构、索引介绍及原理分析.zipMysql架构、索引介绍及原理分析.zipMysql架构、索引介绍及原理分析.zipMysql架构、索引介绍及原理分析.zipMysql架构、索引介绍及原理分析....
mysql查询,通过explain 分析,没有利用到索引,查询效率不高等出现的问题。
从mysql索引分析开始,介绍如何建立索引,什么情况需要建立索引,以及查询截取分析,mysql 的锁机制,主从复制,分表分库等mysql高级部分知识结构