点击上方“朱小厮的博客”,选择“设为星标”

后台回复"书",获取

后台回复“k8s”,可领取k8s资料

来源:r6d.cn/W2LN

送分题

面试官:有操作过Linux吗?

我:有的呀

面试官:我想查看内存的使用情况该用什么命令

我:free 或者 top

面试官:那你说一下用free命令都可以看到啥信息

我:那,如下图所示 可以看到内存以及缓存的使用情况

  • total 总内存

  • used 已用内存

  • free 空闲内存

  • buff/cache 已使用的缓存

  • avaiable 可用内存

面试官:那你知道怎么清理已使用的缓存吗(buff/cache)

我:em... 不知道

面试官:sync; echo 3 > /proc/sys/vm/drop_caches就可以清理buff/cache了,你说说我在线上执行这条命令做好不好?

我:(送分题,内心大喜)好处大大的有,清理出缓存我们就有更多可用的内存空间, 就跟pc上面xx卫士的小火箭一样,点一下,就释放出好多的内存

面试官:em...., 回去等通知吧

再谈SQL Join

面试官:换个话题,谈谈你对join的理解

我:好的(再答错就彻底完了,把握住机会)

回顾

SQL中的join可以根据某些条件把指定的表给结合起来并将数据返回给客户端

join的方式有:5 种

  • inner join 内连接

  • left join 左连接

  • right join 右连接

  • full join 全连接

面试官:在项目开发中如果需要使用join语句,如何优化提升性能?

我:分为两种情况,数据规模小的,数据规模大的。

面试官: 然后?

我:对于

  • 数据规模较小 全部干进内存就完事了嗷

  • 数据规模较大

可以通过增加索引来优化join语句的执行速度 可以通过冗余信息来减少join的次数 尽量减少表连接的次数,一个SQL语句表连接的次数不要超过5次

面试官:可以总结为join语句是相对比较耗费性能,对吗?

我:是的

面试官: 为什么?

缓冲区

我: 在执行join语句的时候必然要有一个比较的过程

面试官: 是的

我:逐条比较两个表的语句是比较慢的,因此我们可以把两个表中数据依次读进一个内存块中, 以MySQL的InnoDB引擎为例,使用以下语句我们必然可以查到相关的内存区域show variables like '%buffer%'

如下图所示join_buffer_size的大小将会影响我们join语句的执行性能

面试官: 除此之外呢?

一个大前提

我:任何项目终究要上线,不可避免的要产生数据,数据的规模又不可能太小

面试官: 是这样的

我:大部分数据库中的数据最终要保存到硬盘上,并且以文件的形式进行存储。

以MySQL的InnoDB引擎为例

  • InnoDB以(page)为基本的IO单位,每个页的大小为16KB

  • InnoDB会为每个表创建用于存储数据的.ibd文件

验证

我:这意味着我们有多少表要连接就需要读多少个文件,虽然可以利用索引,但还是免不了频繁的移动硬盘的磁头

面试官:也就是说频繁的移动磁头会影响性能对吧

我:是的,现在的开源框架不都喜欢说自己通过顺序读写大大的提升了性能吗,比如hbasekafka

面试官:说的没错,那你认为Linux有对此做出优化吗?提示,你可以再执行一次free命令看一下

我:奇怪缓存怎么占用了1.2G多

面试官: 你有没有想过

  • buff/cache 里面存的是什么,?

  • 为什么buff/cache 占了那么多内存,可用内存即availlable还有1.1G

  • 为什么你可以通过两条命令来清理buff/cache占用的内存,而想要释放used只能通过结束进程来实现?

品,你细品

思考了几分钟后

我:这么随便就释放了buff/cache所占用的内存,说明它就不重要, 清除它不会对系统的运行造成影响

面试官: 不完全对

我:难道是?想起来《CSAPP》(深入理解计算机系统)里面说过一句话

存储器层次结构的本质是,每一层存储设备都是较低一层设备的缓存

翻译成人话,就是说Linux会把内存当作是硬盘的高速缓存

面试官:现在知道那道送分题应该怎么回答了吧

我:我....

Join算法

面试官:再给你个机会,如果让你来实现Join算法你会怎么做?

我:无索引的话,嵌套循环就完事了嗷。有索引的话,则可以利用索引来提升性能.

面试官:说回join_buffer 你认为join_buffer里面存储的是什么?

我:在扫描过程中,数据库会选择一个表把他要返回以及需要进行和其他表进行比较的数据放进join_buffer

面试官:有索引的情况下是怎么处理的?

我:这个就比较简单了,直接读取两个表的索引树进行比较就完事了嗷,我这边介绍一下无索引的处理方式

Nested Loop Join

嵌套循环,每次只读取表中的一行数据,也就是说如果outerTable有10万行数据, innerTable有100行数据,需要读取10000000次(假设这两个表的文件没有被操作系统给缓存到内存, 我们称之为冷数据表)

当然现在没啥数据库引擎使用这种算法(太慢了)

Block nested loop

Block 块,也就是说每次都会取一块数据到内存以减少I/O的开销

当没有索引可以使用的时候,MySQL InnoDB 就会使用这种算法

考虑以下两个表 t_a 和t_b

当无法使用索引执行join操作的时候,InnoDB会自动使用Block nested loop 算法

总结

上学时,数据库老师最喜欢考数据库范式,直到上班才学会一切以性能为准,能冗余就冗余,实在冗余不了的就join如果join真的影响到性能。试着调大你的join_buffer_size, 或者换固态硬盘。

想知道更多?描下面的二维码关注我

后台回复"技术",加入技术群

后台回复“k8s”,可领取k8s资料

【精彩推荐】

  • 原创|OpenAPI标准规范

  • 如此简单| ES最全详细使用教程

  • ClickHouse到底是什么?为什么如此牛逼!

  • 原来ElasticSearch还可以这么理解

  • 面试官:InnoDB中一棵B+树可以存放多少行数据?

  • 微服务下如何解耦?对于已经紧耦合下如何重构?

  • 如何构建一套高性能、高可用、低成本的视频处理系统?

  • 架构之道:分离业务逻辑和技术细节

  • 星巴克不使用两阶段提交

点个赞+在看,少个 bug ????

面试官灵魂拷问:为什么 SQL 语句不要过多的 join?相关推荐

  1. 【Java】面试官灵魂拷问:if语句执行完else语句真的不会再执行吗?

    写在前面 最近跳槽找工作的朋友确实不少,遇到的面试题也是千奇百怪,这不,一名读者面试时,被面试官问到了一个直击灵魂的问题:if 语句执行完else语句真的不会再执行吗?这个奇葩的问题把这名读者问倒了! ...

  2. 面试官灵魂拷问:if语句执行完else语句真的不会再执行吗?

    写在前面 最近跳槽找工作的朋友确实不少,遇到的面试题也是千奇百怪,这不,一名读者面试时,被面试官问到了一个直击灵魂的问题:if 语句执行完else语句真的不会再执行吗?这个奇葩的问题把这名读者问倒了! ...

  3. 面试官灵魂拷问:为什么代码规范要求 SQL 语句不要过多的 join?

    送分题 面试官:有操作过Linux吗? 我:有的呀 面试官:我想查看内存的使用情况该用什么命令 我:free 或者 top 面试官:那你说一下用free命令都可以看到啥信息 我:那,如下图所示 可以看 ...

  4. 为什么 SQL 语句不要过多的 join?

    点击上方"方志朋",选择"设为星标" 回复"666"获取新整理的面试文章 作者:柯三 链接:juejin.im/post/5e0443ae6 ...

  5. 为什么代码规范要求SQL语句不要过多的join?

    作者: 柯三 juejin.im/post/5e0443ae6fb9a0162277a2c3 送分题 面试官:有操作过Linux吗? 我:有的呀 面试官:我想查看内存的使用情况该用什么命令 我:fre ...

  6. java执行sql文件_面试官问你MyBatis SQL是如何执行的?把这篇文章甩给他

    初识 MyBatis MyBatis 是第一个支持自定义 SQL.存储过程和高级映射的类持久框架.MyBatis 消除了大部分 JDBC 的样板代码.手动设置参数以及检索结果.MyBatis 能够支持 ...

  7. 面试官:编写一个 SQL 查询,找出每个部门工资第二高的员工

    今天我们来看看大数据开发中row_number函数. 作为一名程序员,求职面试时时常会遇到需要编写一些基础的sql,编写sql这样做的目的主要是考验求职者的逻辑思维及编写sql基础能力.而row_nu ...

  8. LeetCode-175. 组合两个表(SQL语句中的LEFT JOIN)

    题目链接: 组合两个表 题目描述: 表1: Person +-------------+---------+ | 列名 | 类型 | +-------------+---------+ | Perso ...

  9. java左右连接sql写法,join用不了了 sql语句写法,不用join

    在SQL语言中,join什么时候用,什么时候不用 一般来讲,关系数据库中需要用指定连接方式(例如指定内连接.左右连接.全外连接)来组合.筛选来自多张表(包括1张表自连接)或查询或视图的信息时就要使用j ...

最新文章

  1. 运维工具SaltStack
  2. 量子计算机神器,量子计算技术再获神器 科学家开发出新的成像技术
  3. angular之Rxjs异步数据流编程入门
  4. ORACLE初始化参数文件概述
  5. 2009-08-19股市大跌分析(转载)
  6. 进程线程004 Windows线程切换的三种方式
  7. Swift数据类型(一)
  8. Flutter 随机颜色 颜色处理工具类
  9. Agile入门系列-1
  10. Cordova系列(一)
  11. win的反义词_小学英语反义词汇总大全,这样背单词事半功倍!
  12. 国外硕博论文下载网址资源
  13. 阿里云安装MySQL数据库全过程(适合小白)
  14. 【银河麒麟】终端安装微信代码
  15. jetson nano如何拓展磁盘空间
  16. 高德地图 公交路线查询
  17. Echarts全国地区地图json获取(包含乡镇)
  18. 我的管理类联考考研经验分享
  19. linux备份工具比较,2020年Linux最好的5个备份工具
  20. 一分钟看懂数据湖架构

热门文章

  1. FutureTask源码
  2. Trumb/ARM 指令模式
  3. React 和 Vue的特点
  4. 助力产教融合,阿里云教育一体机发布
  5. H5页面关于android软键盘弹出顶起底部元素的解决方案
  6. 并发编程之多进程3 (生产者与消费者模型) 回调函数
  7. 【设计模式】—— 适配器模式Adapter
  8. MySQL多个相同结构的表查询并把结果合并放在一起的语句(union all)
  9. 2017年第1贴:EXT.JS使用MVC模式时,注意如何协调MODEL, STORE,VIEW,CONTROLLER的关系
  10. (四)新建Maven项目