被面试官虐了,索引为何使用B+树,你知道吗
本文源自 公-众-号 IT老哥 的分享
IT老哥,一个在大厂做高级Java开发的程序员,每天分享技术干货文章
问题思考
数据库索引的数据结构有很多种,比如:哈希索引
、平衡二叉树索引
、B树索引
、B+树索引
等等。
目前最流行的是B+树索引
,那大家有没有想过为什么是B+树索引最流行,为什么其他索引应用不广泛。
就像为什么别人能拿2-3
万的工资,我却只能拿一万
的工资,大家有思考过吗?
以下算法动态演示网址:https://www.cs.usfca.edu/~galles/visualization/Algorithms.html
哈希索引
hash大家应该非常的熟悉,就是我们老生常谈的HashMap里用到的技术。Hash索引其检索效率
非常高
,索引的检索可以一次定位
。
可能很多人又有疑问了,既然Hash索引的效率这么高,为什么都用Hash索引而还要使用B-Tree索引呢?
任何事物都是有两面性
的,Hash索引也一样,虽然Hash索引效率高,但是Hash索引本身由于其特殊性也带来了很多限制
和弊端
,主要有以下这些:
原因一:
Hash索引不能使用范围查询
Hash索引仅仅能满足"=
","IN
"和"<=>
"查询(注意<>和<=>是不同的操作),不能使用范围查询
,例如WHERE price > 100。
由于Hash索引比较的是进行Hash运算之后的Hash值
,所以它只能用于等值的过滤,不能用于基于范围的过滤
。
原因二:
Hash索引不能利用部分索引键查询
。
对于复合索引
,Hash索引在计算Hash值
的时候,是组合索引键合并后
再一起计算
Hash值,而不是单独计算
Hash值。
所以通过复合索引的前面一个或几个索引键进行查询的时候,Hash索引也无法被利用。
原因三:
Hash索引在任何时候都不能避免表扫描
。
Hash索引是将索引键通过Hash运算之后,将 Hash运算结果的Hash值和所对应的行指针信息存放于一个Hash表中。
由于不同索引键
存在相同Hash值
,所以无法从Hash索引中直接完成查询,还是要通过访问表中的实际数据进行相应的比较,并得到相应的结果。
hash索引out出局
平衡二叉树索引
又称 AVL
树。它除了具备二叉查找树的基本特征之外,还具有一个非常重要的特点:它的左子树
和右子树
都是平衡二叉树
。
且左子树和右子树的深度之差
的绝对值(平衡因子 )不超过1。也就是说AVL树每个节点的平衡因子只可能是-1、0和1(左子树高度减去右子树高度)。
被淘汰的原因
- 树的高度过高,高度越高,查找速度越慢
- 他支持范围查找,但是他需要在进行回旋查找
比如我要找到大于5
的数据
第一步我先定位到5,然后在树上按照二叉树规则去回旋
查找大于5其他数据6、7、8、9、10。。。
如果大于5的数据很多,那速度是很慢的。
B树索引
大家可以看到B树
和二叉树
最大的区别在于:它一个节点可以存储两个值,这就意味着它的树高度
,比二叉树的高度更低
,它的查询
速度就更快
。这是他的优点
那为什么最终还是不用它呢,还是因为他在范围查找
的时候,存在回旋
查询的问题。同样order by排序的时候效率也很低,因为要把树上的数据手动排序一遍。
终极大佬:B+树
它是B数的升级版,B+
树相比B
树,新增叶子节点
与非叶子节点
关系。
叶子节点
中包含了key
和value
,key存储的是1-10这些数字,value存储的是数据存储地址,非叶子节点
中只是包含了key
,不包含value。
所有相邻的叶子节点包含
非叶子节点,使用链表
进行结合,有一定顺序排序
,从而范围查询
效率非常高。
比如我们要查找大于5
的数据:
- 首先我们定位到5的位置
- 然后直接将5后面的数据全部拿出来即可,因为这是有序链表,
已经排好序了
我们在order by
排序的时候为什么要使用索引进行排序
,原因就在这。
如果大家还没懂,请留言给我吧
云服务器,云硬盘,数据库(包括MySQL、Redis、MongoDB、SQL Server),CDN流量包,短信流量包,cos资源包,消息队列ckafka,点播资源包,实时音视频套餐,网站管家(WAF),大禹BGP高防(包含高防包及高防IP),云解析,SSL证书,手游安全MTP,移动应用安全、 云直播等等。
- JavaScript 教程
- JavaScript 编辑工具
- JavaScript 与HTML
- JavaScript 与Java
- JavaScript 数据结构
- JavaScript 基本数据类型
- JavaScript 特殊数据类型
- JavaScript 运算符
- JavaScript typeof 运算符
- JavaScript 表达式
- JavaScript 类型转换
- JavaScript 基本语法
- JavaScript 注释
- Javascript 基本处理流程
- Javascript 选择结构
- Javascript if 语句
- Javascript if 语句的嵌套
- Javascript switch 语句
- Javascript 循环结构
- Javascript 循环结构实例
- Javascript 跳转语句
- Javascript 控制语句总结
- Javascript 函数介绍
- Javascript 函数的定义
- Javascript 函数调用
- Javascript 几种特殊的函数
- JavaScript 内置函数简介
- Javascript eval() 函数
- Javascript isFinite() 函数
- Javascript isNaN() 函数
- parseInt() 与 parseFloat()
- escape() 与 unescape()
- Javascript 字符串介绍
- Javascript length属性
- javascript 字符串函数
- Javascript 日期对象简介
- Javascript 日期对象用途
- Date 对象属性和方法
- Javascript 数组是什么
- Javascript 创建数组
- Javascript 数组赋值与取值
- Javascript 数组属性和方法
- MySQL优化--MVCC
- Linux入门--基础命令
- Linux入门--权限管理、任务调度、磁盘管理
- 【Rust日报】2020-08-05 -- 如何在2020年进一步加快 Rust 编译器的速度
- Linux学习--网络、进程、服务、软件管理
- IOS label 设置行高
- 重学数据结构(序:概览)
- 【Rust日报】2020-08-06 使用 Rust 编写的 Lambdas 在 AWS IoT 和 SQS 队列之间传递消息
- react-router-config的使用
- Spring 源码解读第七弹!bean 标签的解析
- Kubeflow实战: 入门介绍与部署实践
- matplotlib基础绘图命令之violinplot
- 性能分析(3)- 短时进程导致用户 CPU 使用率过高案例
- stat 命令家族(1)- 详解 vmstat
- 性能测试必备知识(9)- 深入理解“软中断”