为什么 SQL 语句不要过多的 join?( 二 )

  • 为什么buff/cache 占了那么多内存,可用内存即availlable还有1.1G?
  • 为什么你可以通过两条命令来清理buff/cache占用的内存,而想要释放used只能通过结束进程来实现?
  • 品,你细品
    思考了几分钟后
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    我:这么随便就释放了buff/cache所占用的内存,说明它就不重要, 清除它不会对系统的运行造成影响
    面试官: 不完全对
    我:难道是?想起来《CSApp》(深入理解计算机系统)里面说过一句话
    存储器层次结构的本质是,每一层存储设备都是较低一层设备的缓存
     
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    翻译成人话,就是说Linux会把内存当作是硬盘的高速缓存
    相关资料 tldp.org/LDP/sag/htm…
    面试官:现在知道那道送分题应该怎么回答了吧
    我:我....
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    Join算法面试官:再给你个机会,如果让你来实现Join算法你会怎么做?
    我:无索引的话,嵌套循环就完事了嗷 。有索引的话,则可以利用索引来提升性能.
    面试官:说回join_buffer 你认为join_buffer里面存储的是什么?
    我:在扫描过程中,数据库会选择一个表把他要返回以及需要进行和其他表进行比较的数据放进join_buffer
    面试官:有索引的情况下是怎么处理的?
    我:这个就比较简单了,直接读取两个表的索引树进行比较就完事了嗷,我这边介绍一下无索引的处理方式
    Nested Loop Join 
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    嵌套循环,每次只读取表中的一行数据,也就是说如果outerTable有10万行数据, innerTable有100行数据,需要读取10000000次(假设这两个表的文件没有被操作系统给缓存到内存, 我们称之为冷数据表)
    当然现在没啥数据库引擎使用这种算法(太慢了)
    Block nested loop 
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    Block 块,也就是说每次都会取一块数据到内存以减少I/O的开销
    当没有索引可以使用的时候,MySQL InnoDB 就会使用这种算法
    考虑以下两个表 t_a 和t_b
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    当无法使用索引执行join操作的时候,InnoDB会自动使用Block nested loop 算法
    为什么 SQL 语句不要过多的 join?

    文章插图
     
    总结上学时,数据库老师最喜欢考数据库范式,直到上班才学会一切以性能为准,能冗余就冗余,实在冗余不了的就join如果join真的影响到性能 。试着调大你的join_buffer_size, 或者换固态硬盘 。
    如果这篇文章对您有所帮助,或者有所启发的话,帮忙关注一下:苏三说技术,或者点赞,转发一下,坚持原创不易,您的支持是我前进最大的动力,谢谢
    来源:https://juejin.im/post/6844904041382674440




    推荐阅读