目录(技术文)

多关于索引,分为以下几点来讲解:

一、索引的概述(什么是索引,索引的优缺点)

二、索引的基本使用(创建索引)

三、索引的基本原理(面试重点)

四、索引的数据结构(B树,hash)

五、创建索引的原则(重中之重,面试必问!敬请收藏!)

六、百万级别或以上的数据如何删除

一、索引的概述

1)什么是索引?

索引是一种特殊的文件(InnoDB数据表上的索引是表空间的一个组成部分),它们包含着对数据表里所有记录的引用指针。更通俗的说,索引就相当于目录。当你在用新华字典时,帮你把目录撕掉了,你查询某个字开头的成语只能从第一页翻到第一千页。累!把目录还给你,则能快速定位!

2)索引的优缺点:

可以大大加快数据的检索速度,这也是创建索引的最主要的原因。,且通过使用索引,可以在查询的过程中,使用优化隐藏器,提高系统的性能。但是,索引也是有缺点的:索引需要额外的维护成本;因为索引文件是单独存在的文件,对数据的增加,修改,删除,都会产生额外的对索引文件的操作,这些操作需要消耗额外的IO,会降低增/改/删的执行效率。

二、索引的基本使用(真技术文)

1)创建索引:(三种方式)

第一种方式:

第二种方式:使用ALTER TABLE命令去增加索引:

ALTER TABLE用来创建普通索引、UNIQUE索引或PRIMARY KEY索引。

其中table_name是要增加索引的表名,column_list指出对哪些列进行索引,多列时各列之间用逗号分隔。

索引名index_name可自己命名,缺省时,MySQL将根据第一个索引列赋一个名称。另外,ALTER TABLE允许在单个语句中更改多个表,因此可以在同时创建多个索引。

第三种方式:使用CREATE INDEX命令创建

CREATE INDEX可对表增加普通索引或UNIQUE索引。(但是,不能创建PRIMARY KEY索引)

三、索引的基本原理(不想像别的文章那样一大堆篇幅废话)

索引用来快速地寻找那些具有特定值的记录。如果没有索引,一般来说执行查询时遍历整张表。

索引的原理很简单,就是把无序的数据变成有序的查询

1、把创建了索引的列的内容进行排序

2、对排序结果生成倒排表

3、在倒排表内容上拼上数据地址链

4、在查询的时候,先拿到倒排表内容,再取出数据地址链,从而拿到具体数据

四、索引的数据结构(b树,hash)

1)B树索引

mysql通过存储引擎取数据,基本上90%的人用的就是InnoDB了,按照实现方式分,InnoDB的索引类型目前只有两种:BTREE(B树)索引和HASH索引。B树索引是Mysql数据库中使用最频繁的索引类型,基本所有存储引擎都支持BTree索引。通常我们说的索引不出意外指的就是(B树)索引(实际是用B+树实现的,因为在查看表索引时,mysql一律打印BTREE,所以简称为B树索引)

查询方式:

主键索引区:PI(关联保存的时数据的地址)按主键查询,

普通索引区:si(关联的id的地址,然后再到达上面的地址)。所以按主键查询,速度最快

B+tree性质:

1.)n棵子tree的节点包含n个关键字,不用来保存数据而是保存数据的索引。

2.)所有的叶子结点中包含了全部关键字的信息,及指向含这些关键字记录的指针,且叶子结点本身依关键字的大小自小而大顺序链接。

3.)所有的非终端结点可以看成是索引部分,结点中仅含其子树中的最大(或最小)关键字。

4.)B+ 树中,数据对象的插入和删除仅在叶节点上进行。

5.)B+树有2个头指针,一个是树的根节点,一个是最小关键码的叶节点。

2)哈希索引(好技术文)

简要说下,类似于数据结构中简单实现的HASH表(散列表)一样,当我们在mysql中用哈希索引时,主要就是通过Hash算法(常见的Hash算法有直接定址法、平方取中法、折叠法、除数取余法、随机数法),将数据库字段数据转换成定长的Hash值,与这条数据的行指针一并存入Hash表的对应位置;如果发生Hash碰撞(两个不同关键字的Hash值相同),则在对应Hash键下以链表形式存储。当然这只是简略模拟图。

ps:关于数据结构,有兴趣深入的朋友可以关注我后查看【数据结构】专题,这里不做详细讲解。

五、创建索引的原则(重中之重)

索引虽好,但也不是无限制的使用,最好符合一下几个原则

1) 最左前缀匹配原则,组合索引非常重要的原则,mysql会一直向右匹配直到遇到范围查询(>、<、between、like)就停止匹配,比如a = 1 and b = 2 and c > 3 and d = 4 如果建立(a,b,c,d)顺序的索引,d是用不到索引的,如果建立(a,b,d,c)的索引则都可以用到,a,b,d的顺序可以任意调整。

2)较频繁作为查询条件的字段才去创建索引

3)更新频繁字段不适合创建索引

4)若是不能有效区分数据的列不适合做索引列(如性别,男女未知,最多也就三种,区分度实在太低)

5)尽量的扩展索引,不要新建索引。比如表中已经有a的索引,现在要加(a,b)的索引,那么只需要修改原来的索引即可。

6)定义有外键的数据列一定要建立索引。

7)对于那些查询中很少涉及的列,重复值比较多的列不要建立索引。

8)对于定义为text、image和bit的数据类型的列不要建立索引。

百万级别或以上的数据如何删除(真好技术文)

关于索引:由于索引需要额外的维护成本,因为索引文件是单独存在的文件,所以当我们对数据的增加,修改,删除,都会产生额外的对索引文件的操作,这些操作需要消耗额外的IO,会降低增/改/删的执行效率。所以,在我们删除数据库百万级别数据的时候,查询MySQL官方手册得知删除数据的速度和创建的索引数量是成正比的。

  1. 所以我们想要删除百万数据的时候可以先删除索引(此时大概耗时三分多钟)

  2. 然后删除其中无用数据(此过程需要不到两分钟)

  3. 删除完成后重新创建索引(此时数据较少了)创建索引也非常快,约十分钟左右。

  4. 与之前的直接删除绝对是要快速很多,更别说万一删除中断,一切删除会回滚。那更是坑了。

「mysql优化专题」90%程序员面试都用得上的索引优化手册(5)相关推荐

  1. 「mysql优化专题」90%程序员面试都用得上的索引优化手册(5)【面试重点】

    本专题讲到索引查询优化,恭喜你,已经达到mysql优化的中级水平.这篇我们要讲的是mysql优化中重点中的重点--索引优化.面试官百分百必问 目录 多关于索引,分为以下几点来讲解: 一.索引的概述(什 ...

  2. 「mysql优化专题」90%程序员都会忽略的增删改优化(2)

    前文一篇「mysql优化专题」这大概是一篇最好的mysql优化入门文章(1)让大家知道msql优化,究竟在优化什么,本篇为mysql优化专题的第二篇,主要先从增删改进行优化. 补充知识点:操作数据语句 ...

  3. 「花田对」CSDN程序员专场——谁来拯救技术宅!_豆瓣

    「花田对」CSDN程序员专场--谁来拯救技术宅!_豆瓣 「花田对」CSDN程序员专场--谁来拯救技术宅!

  4. 程序员面试金典——9.1上楼梯

    程序员面试金典--9.1上楼梯 Solution1:我的破答案,复杂度太高未能AC 递归的毛病就是复杂度太高!!! class GoUpstairs { public:int countWays(in ...

  5. 论「能写代码」的程序员与「会写代码」的程序员

    点击上方"程序人生",选择"置顶公众号" 第一时间关注程序猿(媛)身边的故事 之所以提这个话题,跟前两天在微信群里的讨论有关,年后本该是跳槽.找工作的高峰月份, ...

  6. 如何成为一位「不那么差」的程序员

    前言 已经记不清有多少读者问过: 博主,你是怎么学习的?像我这样的情况有啥好的建议嘛? 也不知道啥时候我居然成人生导师了.当然我不排斥这些问题,和大家交流都是学习的过程. 因此也许诺会准备一篇关于学习 ...

  7. 如何成为一位「不那么差」的程序员?

    作者:crossoverJie 来源:crossoverJie 前言 已经记不清有多少读者问过: 博主,你是怎么学习的?像我这样的情况有啥好的建议嘛? 也不知道啥时候我居然成人生导师了.当然我不排斥这 ...

  8. 「源码解读」知名程序员 TJ 的 only 库

    大家好,我是前端西瓜哥.我最近尝试开启一个源码解读系列,不定期解读一些简单或复杂的源码. 今天要解读 npm 第三方库的源码:only,仓库地址为:https://github.com/tj/node ...

  9. 假如程序员面试都说真话

    写了那么多面试文,这次来谈谈面试说真话这件事 经常听见的一句话「面试造火箭,入职拧螺丝」 因为我现在在一家大厂做游戏,拿offer的时候也是切身体会 面试时,过五关.斩六将,才能拿到心仪的offer ...

最新文章

  1. 【登录异常解决】Ubuntu 输入正确的密码后重新返回到登陆界面
  2. Java接口interface
  3. python处理csv数据-Python处理csv文件
  4. Python基础第六天——函数的使用、函数的参数、函数的返回值、函数的嵌套、命名空间、作用域、函数对象...
  5. 怎么修改谷歌浏览器文件提交按钮样式_使用css自定义input file浏览按钮样式
  6. truncate delete 与 drop的区别
  7. linux查看端口被哪个服务占用的命令
  8. 基于MDK编译器 STM32与12864液晶显示程序 和电路连接
  9. IIS管理器FTP站点中FTP防火墙支持页面
  10. mysql查询去除重复记录
  11. android tv香橙派镜像,香橙派-如何通过dd制作系统镜像
  12. Spring Boot打包成执行jar后获取classpath下文件异常解决
  13. 抖音最疯狂的辞职代码,你下载了吗?
  14. HTML5特别篇——代码规范(2)
  15. 陌陌其实也是个APP工厂,除了AI换脸ZAO,还有这些
  16. 电视机顶盒视频播放插件
  17. 如何系统由高效的自学Android,字节大牛如实说道,记住这几个点超越90%的Android开发者
  18. 谍影重重4 伯恩的遗产 720P 8.97G DTS-HD 下载
  19. win7下virtualbox遇到的问题
  20. HUDJ 2011 多项式求和

热门文章

  1. 自考那些事儿(四):软件开发工具(理论篇)
  2. 《我的世界》AI大战降临:6000万帧超大数据集已发布,NeurIPS 19向你约战
  3. PyTorch大更新!谷歌出手帮助开发,正式支持TensorBoard | 附5大开源项目
  4. 融资13亿后突然死亡!首款产品被苹果点赞,与谷歌竞赛的明星创业公司Anki倒闭...
  5. 李笑来登GitHub趋势榜第一,教你自学编程,含37%“硬核鸡汤”
  6. 终于学会后空翻!历经多次NG,波士顿动力机器人再get新技能
  7. C/C++ 指针小结——指针的概念和如何使用指针
  8. 如何在Swiper内制作CSS3动画效果
  9. 云服务被归类为IDC业务 提供云服务必须持证上岗
  10. 你从 Kotlin 中 get 了多少技能了?