MySQL 为什么要使用 B+树索引

搞懂这个问题之前，我们首先来看一下 MySQL 表的存储结构，再分别对比二叉树、多叉树、B 树和 B+树的区别就都懂了。

# MySQL 的存储结构

单位：表>段>区>页>行

在数据库中，不论读一行，还是读多行，都是将这些行所在的页进行加载。也就是说存储空间的基本单位是页。
一个页就是一棵树 B+树的节点，数据库 I/O 操作的最小单位是页，与数据库相关的内容都会存储在页的结构里。

有以下几个特点

页的主要作用是存储记录，在页中记录以单链表的形式进行存储。
单链表优点是插入、删除方便，缺点是检索效率不高，最坏的情况要遍历链表所有的节点。因此页目录中提供了二分查找的方式，来提高记录的检索效率。

我们再来看下 B+树的检索过程

数据库访问数据要通过页，一个页就是一个 B+树节点，访问一个节点相当于一次 I/O 操作，所以越快能找到节点，查找性能越好。
B+树的特点就是够矮够胖，能有效地减少访问节点次数从而提高性能。

下面，我们来对比一个二叉树、多叉树、B 树和 B+树。

二叉树是一种二分查找树，有很好的查找性能，相当于二分查找。

但是当 N 比较大的时候，树的深度比较高。数据查询的时间主要依赖于磁盘 IO 的次数，二叉树深度越大，查找的次数越多，性能越差。最坏的情况是退化成了链表，如下图

为了让二叉树不至于退化成链表，人们发明了 AVL 树（平衡二叉搜索树）：任何结点的左子树和右子树高度最多相差 1

多叉树就是节点可以是 M 个，能有效地减少高度，高度变小后，节点变少 I/O 自然少，性能比二叉树好了

B 树简单地说就是多叉树，每个叶子会存储数据，和指向下一个节点的指针。

例如要查找 9，步骤如下

B+树是 B 树的改进，简单地说是：只有叶子节点才存数据，非叶子节点是存储的指针；所有叶子节点构成一个有序链表

B+树的内部节点并没有指向关键字具体信息的指针，因此其内部节点相对 B 树更小，如果把所有同一内部节点的关键字存放在同一盘块中，那么盘块所能容纳的关键字数量也越多，一次性读入内存的需要查找的关键字也就越多，相对 IO 读写次数就降低了

例如要查找关键字 16，步骤如下

B+树与 B 树的不同：

B+树非叶子节点不存在数据只存索引，B 树非叶子节点存储数据
B+树查询效率更高。B+树使用双向链表串连所有叶子节点，区间查询效率更高（因为所有数据都在 B+树的叶子节点，扫描数据库只需扫一遍叶子结点就行了），但是 B 树则需要通过中序遍历才能完成查询范围的查找。
B+树查询效率更稳定。B+树每次都必须查询到叶子节点才能找到数据，而 B 树查询的数据可能不在叶子节点，也可能在，这样就会造成查询的效率的不稳定
B+树的磁盘读写代价更小。B+树的内部节点并没有指向关键字具体信息的指针，因此其内部节点相对 B 树更小，通常 B+树矮更胖，高度小查询产生的 I/O 更少。

上次更新: 2025-08-03, 13:30:31