目录
一.AVL树的概念
二叉搜索树虽可以缩短查找的效率,但如果数据有序或接近有序二叉搜索树将退化为单支树,查 找元素相当于在顺序表中搜索元素,效率低下。
因此,两位俄罗斯的数学家G.M.Adelson-Velskii 和E.M.Landis在1962年 发明了一种解决上述问题的方法:当向二叉搜索树中插入新结点后,如果能保证每个结点的左右子树高度之差的绝对值不超过1(需要对树中的结点进行调整),即可降低树的高度,从而减少平均 搜索长度。
一棵AVL树或者是空树,或者是具有以下性质的二叉搜索树:
- 它的左右子树都是AVL树
- 左右子树高度之差(简称平衡因子)的绝对值不超过1(-1/0/1)
如果一棵二叉搜索树是高度平衡的,它就是AVL树。如果它有n个结点,其高度可保持在
O(log_2 n),搜索时间复杂度O(log_2 n)。
我们将左右子树高度之差定义为平衡因子。
注意:
1.本文中采用右子树的高度 - 左子树的高度以计算平衡因子。(如上图所示)
2.本文中的AVL树为KV模型。
二.AVL树的基本操作
1.AVL树节点及AVL树的创建
因为AVL树就是在二叉搜索树的基础上延申而来, 加入了平衡因子,故改动二叉搜索树模型即可。
//AVLTree树节点
template<class K, class V>
struct AVLTreeNode
{
AVLTreeNode<K, V>* _left;
AVLTreeNode<K, V>* _right;
AVLTreeNode<K, V>* _parent;
pair<K, V> _kv;
int _bf; // 平衡因子 balance factor
//键值对
AVLTreeNode(const pair<K, V>& kv)
:_left(nullptr)
, _right(nullptr)
, _parent(nullptr)
, _kv(kv)
, _bf(0)
{ }
};
//树
template<class K, class V>
class AVLTree
{
typedef AVLTreeNode<K, V> Node;
private:
Node* _root = nullptr;
};
2.AVL树的插入
AVL树的插入可以分为两步:
- 按照二叉搜索树的方式插入新节点
- 调整节点的平衡因子
因为AVL树的性质, 所以插入新节点前,所有节点的平衡因子分为三种情况:0,1,-1,插入新节点后,会使其父节点的平衡因子发生变化, 有三种情况。
1.插入新节点后父节点的平衡因子变为0
如插入后根节点平衡因子变为0.
2.插入新节点后父节点的平衡因子变为1或-1
如插入后6节点平衡因子变为-1.
3.插入新节点后父节点的平衡因子变为2或-2
若再插入7、8、9节点后6节点平衡因子变为2(图中不在给出)。
若某节点的平衡因子在插入节点后 变为2或-2,则违反了AVL树的性质,需对其进行矫正,称为旋转处理。
3.AVL树的旋转
注意:下文中的a, b ,c红色块等均为抽象树,其中每一个节点均满足AVL树的性质, h为该抽象树的高度,紫色块为新插入的节点
①:右单旋
当新节点插入到较高左子树的左侧时,使用右单旋。
右单旋规则:
code:
void RotateR(Node* parent)
{
// 要更改六条边
Node* subL = parent->_left;
Node* subLR = subL->_right;
// 先处理parent和SubLR
parent->_left = subLR;
if (subLR)
subLR->_parent = parent;
//再处理parent和 subl
//因为 后面需要把 parent的parent和subl链接
//需要先保存parent的parent
subL->_right = parent;
Node* ppNode = parent->_parent;
parent->_parent = subL;
//处理 subl的 父节点
if (parent == _root)
{
_root = subL;
_root->_parent = nullptr;
}
else
{
if (ppNode->_left == parent)
{
ppNode->_left = subL;
}
else
{
ppNode->_right = subL;
}
subL->_parent = ppNode;
}
//平衡因子置为零
parent->_bf = subL->_bf = 0;
}
②:左单旋
当新节点插入到较高左子树的左侧时,使用左单旋。
左单旋规则:
code:
void RotateL(Node* parent)
{
Node* subR = parent->_right;
Node* subRL = subR->_left;
parent->_right = subRL;
if (subRL)
subRL->_parent = parent;
subR->_left = parent;
Node* ppNode = parent->_parent;
parent->_parent = subR;
if (parent == _root)
{
_root = subR;
_root->_parent = nullptr;
}
else
{
if (ppNode->_left == parent)
{
ppNode->_left = subR;
}
else
{
ppNode->_right = subR;
}
subR->_parent = ppNode;
}
parent->_bf = subR->_bf = 0;
}
③:左右双旋
当新节点插入到较高左子树的左侧时,使用先左单旋再右单旋。
此种左右双旋,其规则如下:
但将抽象节点具体时, 取h = 0 和h = 1时,我们发现当subLR的平衡因子不同时,对于结果(parent, subL,subLR)而言, 分成了三种情况。
由此, 我们得出结论:
- 当
subLR = 0
时:调整subLR = 0,subL = 0,parent = 0
- 当
subLR = -1
时:调整subLR = 0,subL = 0,parent = 1
- 当
subLR = 1
时:调整subLR = 0,subL = -1,parent = 0
void RotateLR(Node* parent)
{
Node* subL = parent->_left;
Node* subLR = subL->_right;
int bf = subLR->_bf;
RotateL(parent->_left);
RotateR(parent);
// 三种情况 但最后移到中间的sublr 一定是0
if (bf == -1)
{
subL->_bf = 0;
subLR->_bf = 0;
parent->_bf = 1;
}
else if (bf == 1)
{
subL->_bf = -1;
subLR->_bf = 0;
parent->_bf = 0;
}
// subLR没有子节点
else if (bf == 0)
{
subL->_bf = 0;
subLR->_bf = 0;
parent->_bf = 0;
}
else
{
assert(false);
}
}
④:右左双旋
当新节点插入到较高左子树的左侧时,使用先右单旋再左单旋
同样的, 对于右左单旋,也有三种情况:
新节点插入在25的左边:
新节点插入在25的右边:
以及h = 0时
由此,我们得出结论:
- 当
subRL = 0
时:调整为subRL = 0,subR = 0,parent = 0
- 当
subRL = -1
时:调整为subRL = 0,subR = 1,parent = 0
- 当
subRL = 1
时:调整为subRL = 0,subR = 0,parent = -1
code:
void RotateRL(Node* parent)
{
Node* subR = parent->_right;
Node* subRL = subR->_left;
int bf = subRL->_bf;
RotateR(subR);
RotateL(parent);
subRL->_bf = 0;
if (bf == 1)
{
subR->_bf = 0;
parent->_bf = -1;
}
else if (bf == -1)
{
parent->_bf = 0;
subR->_bf = 1;
}
else
{
parent->_bf = 0;
subR->_bf = 0;
}
}
以及插入的完整代码:
bool Insert(const pair<K, V>& kv)
{
if (_root == nullptr)
{
_root = new Node(kv);
return true;
}
Node* parent = nullptr;
Node* cur = _root;
while (cur)
{
if (cur->_kv.first < kv.first)
{
parent = cur;
cur = cur->_right;
}
else if (cur->_kv.first > kv.first)
{
parent = cur;
cur = cur->_left;
}
else
{
// 相等不插入
return false;
}
}
cur = new Node(kv);
if (parent->_kv.first < kv.first)
{
parent->_right = cur;
}
else
{
parent->_left = cur;
}
// 别忘记指向父亲
cur->_parent = parent;
//更新平衡因子 平衡因子 = 右子树高度 - 左子树高度
//3中情况
//1. 父亲平衡因子 == 0 ,父亲所在子树高度不变, 不再继续往上更新, 插入结束
//2. 父亲平衡因子 == 1 or -1. 父亲所在子树高度变了 ,继续网上更新
//3. 父亲平衡因子 == 2 or -2, 父亲所在子树已经不平衡了 ,需要旋转处理
//更新中不可呢出现其他情况 , 插入之前是avl树 平衡因子只能是-1, 0 , 1
//每次+1, -1, 没有其他情况
// 往上更新
while (parent)
{
// 右子树高度 - 左子树高度
if (cur == parent->_left)
{
parent->_bf--;
}
else
{
parent->_bf++;
}
// 判断是否需要旋转
if (parent->_bf == 0)
{
break;
}
else if (parent->_bf == 1 || parent->_bf == -1)// 0 -> 1 -1
{
//继续往上跟新
cur = parent;
parent = parent->_parent;
}
else if (parent->_bf == 2 || parent->_bf == -2)// 0 -> 2 -2
{
// 子树不再平衡 需要旋转
if (parent->_bf == -2 && cur->_bf == -1)
{
// 左边子树高 右旋
RotateR(parent);
}
else if (parent->_bf == 2 && cur->_bf == 1)
{
//右边子树高 左旋
RotateL(parent);
}
else if (parent->_bf == 2 && cur->_bf == -1)
{
RotateRL(parent);
}
else if (parent->_bf == -2 && cur->_bf == 1)
{
RotateLR(parent);
}
// 旋转完就平衡了
break;
}
else
{
//理论没有这个 情况 加上保险
assert(false);
}
}
return true;
}
//右旋
void RotateR(Node* parent)
{
// 要更改六条边
Node* subL = parent->_left;
Node* subLR = subL->_right;
// 先处理parent和SubLR
parent->_left = subLR;
if (subLR)
subLR->_parent = parent;
//再处理parent和 subl
//因为 后面需要把 parent的parent和subl链接
//需要先保存parent的parent
subL->_right = parent;
Node* ppNode = parent->_parent;
parent->_parent = subL;
//处理 subl的 父节点
if (parent == _root)
{
_root = subL;
_root->_parent = nullptr;
}
else
{
if (ppNode->_left == parent)
{
ppNode->_left = subL;
}
else
{
ppNode->_right = subL;
}
subL->_parent = ppNode;
}
//平衡因子置为零
parent->_bf = subL->_bf = 0;
}
//左旋
void RotateL(Node* parent)
{
Node* subR = parent->_right;
Node* subRL = subR->_left;
parent->_right = subRL;
if (subRL)
subRL->_parent = parent;
subR->_left = parent;
Node* ppNode = parent->_parent;
parent->_parent = subR;
if (parent == _root)
{
_root = subR;
_root->_parent = nullptr;
}
else
{
if (ppNode->_left == parent)
{
ppNode->_left = subR;
}
else
{
ppNode->_right = subR;
}
subR->_parent = ppNode;
}
parent->_bf = subR->_bf = 0;
}
// 左右双旋
void RotateLR(Node* parent)
{
Node* subL = parent->_left;
Node* subLR = subL->_right;
int bf = subLR->_bf;
RotateL(parent->_left);
RotateR(parent);
// 三种情况 但最后移到中间的sublr 一定是0
if (bf == -1)
{
subL->_bf = 0;
subLR->_bf = 0;
parent->_bf = 1;
}
else if (bf == 1)
{
subL->_bf = -1;
subLR->_bf = 0;
parent->_bf = 0;
}
// subLR没有子节点
else if (bf == 0)
{
subL->_bf = 0;
subLR->_bf = 0;
parent->_bf = 0;
}
else
{
assert(false);
}
}
//右左双旋
void RotateRL(Node* parent)
{
Node* subR = parent->_right;
Node* subRL = subR->_left;
int bf = subRL->_bf;
RotateR(subR);
RotateL(parent);
subRL->_bf = 0;
if (bf == 1)
{
subR->_bf = 0;
parent->_bf = -1;
}
else if (bf == -1)
{
parent->_bf = 0;
subR->_bf = 1;
}
else
{
parent->_bf = 0;
subR->_bf = 0;
}
}
4.AVL树的验证
判断AVL树的每个节点是否满足平衡因子的限制
bool _IsBalance(Node* root)
{
if (root == nullptr)
return true;
int leftHeight = _Height(root->_left);
int rightHeight = _Height(root->_right);
// 不平衡
if (abs(leftHeight - rightHeight) >= 2)
{
cout << root->_kv.first << endl;
return false;
}
// 顺便检查一下平衡因子是否正确
if (rightHeight - leftHeight != root->_bf)
{
cout << root->_kv.first << endl;
return false;
}
return _IsBalance(root->_left)
&& _IsBalance(root->_right);
}
三.AVL树的性能
AVL树是一棵绝对平衡的二叉搜索树,其要求每个节点的左右子树高度差的绝对值都不超过1,这样可以保证查询时高效的时间复杂度,即log_2 (N)。但是如果要对AVL树做一些结构修改的操作,性能非常低下,比如:插入时要维护其绝对平衡,旋转的次数比较多,更差的是在删除时, 有可能一直要让旋转持续到根的位置。因此:如果需要一种查询高效且有序的数据结构,而且数据的个数为静态的(即不会改变),可以考虑AVL树,但一个结构经常修改,就不太适合。
四.完整代码 + 测试函数
#pragma once
#include<string>
#include<iostream>
#include<vector>
#include<assert.h>
#include<time.h>
using namespace std;
//AVLTree树节点
template<class K, class V>
struct AVLTreeNode
{
AVLTreeNode<K, V>* _left;
AVLTreeNode<K, V>* _right;
AVLTreeNode<K, V>* _parent;
pair<K, V> _kv;
int _bf; // 平衡因子 balance factor
//键值对
AVLTreeNode(const pair<K, V>& kv)
:_left(nullptr)
, _right(nullptr)
, _parent(nullptr)
, _kv(kv)
, _bf(0)
{ }
};
template<class K, class V>
class AVLTree
{
typedef AVLTreeNode<K, V> Node;
public:
//log N;
bool Insert(const pair<K, V>& kv)
{
if (_root == nullptr)
{
_root = new Node(kv);
return true;
}
Node* parent = nullptr;
Node* cur = _root;
while (cur)
{
if (cur->_kv.first < kv.first)
{
parent = cur;
cur = cur->_right;
}
else if (cur->_kv.first > kv.first)
{
parent = cur;
cur = cur->_left;
}
else
{
// 相等不插入
return false;
}
}
cur = new Node(kv);
if (parent->_kv.first < kv.first)
{
parent->_right = cur;
}
else
{
parent->_left = cur;
}
// 别忘记指向父亲
cur->_parent = parent;
//更新平衡因子 平衡因子 = 右子树高度 - 左子树高度
//3中情况
//1. 父亲平衡因子 == 0 ,父亲所在子树高度不变, 不再继续往上更新, 插入结束
//2. 父亲平衡因子 == 1 or -1. 父亲所在子树高度变了 ,继续网上更新
//3. 父亲平衡因子 == 2 or -2, 父亲所在子树已经不平衡了 ,需要旋转处理
//更新中不可呢出现其他情况 , 插入之前是avl树 平衡因子只能是-1, 0 , 1
//每次+1, -1, 没有其他情况
// 往上更新
while (parent)
{
// 右子树高度 - 左子树高度
if (cur == parent->_left)
{
parent->_bf--;
}
else
{
parent->_bf++;
}
// 判断是否需要旋转
if (parent->_bf == 0)
{
break;
}
else if (parent->_bf == 1 || parent->_bf == -1)// 0 -> 1 -1
{
//继续往上跟新
cur = parent;
parent = parent->_parent;
}
else if (parent->_bf == 2 || parent->_bf == -2)// 0 -> 2 -2
{
// 子树不再平衡 需要旋转
if (parent->_bf == -2 && cur->_bf == -1)
{
// 左边子树高 右旋
RotateR(parent);
}
else if (parent->_bf == 2 && cur->_bf == 1)
{
//右边子树高 左旋
RotateL(parent);
}
else if (parent->_bf == 2 && cur->_bf == -1)
{
RotateRL(parent);
}
else if (parent->_bf == -2 && cur->_bf == 1)
{
RotateLR(parent);
}
// 旋转完就平衡了
break;
}
else
{
//理论没有这个 情况 加上保险
assert(false);
}
}
return true;
}
Node* Find(const K& key)
{
Node* cur = _root;
while (cur)
{
if (cur->_kv.first < key)
{
cur = cur->_right;
}
else if (cur->_kv.first > key)
{
cur = cur->_left;
}
else
{
return cur;
}
}
return nullptr;
}
void InOrder()
{
_InOrder(_root);
cout << endl;
}
//右旋
void RotateR(Node* parent)
{
// 要更改六条边
Node* subL = parent->_left;
Node* subLR = subL->_right;
// 先处理parent和SubLR
parent->_left = subLR;
if (subLR)
subLR->_parent = parent;
//再处理parent和 subl
//因为 后面需要把 parent的parent和subl链接
//需要先保存parent的parent
subL->_right = parent;
Node* ppNode = parent->_parent;
parent->_parent = subL;
//处理 subl的 父节点
if (parent == _root)
{
_root = subL;
_root->_parent = nullptr;
}
else
{
if (ppNode->_left == parent)
{
ppNode->_left = subL;
}
else
{
ppNode->_right = subL;
}
subL->_parent = ppNode;
}
//平衡因子置为零
parent->_bf = subL->_bf = 0;
}
//左旋
void RotateL(Node* parent)
{
Node* subR = parent->_right;
Node* subRL = subR->_left;
parent->_right = subRL;
if (subRL)
subRL->_parent = parent;
subR->_left = parent;
Node* ppNode = parent->_parent;
parent->_parent = subR;
if (parent == _root)
{
_root = subR;
_root->_parent = nullptr;
}
else
{
if (ppNode->_left == parent)
{
ppNode->_left = subR;
}
else
{
ppNode->_right = subR;
}
subR->_parent = ppNode;
}
parent->_bf = subR->_bf = 0;
}
// 左右双旋
void RotateLR(Node* parent)
{
Node* subL = parent->_left;
Node* subLR = subL->_right;
int bf = subLR->_bf;
RotateL(parent->_left);
RotateR(parent);
// 三种情况 但最后移到中间的sublr 一定是0
if (bf == -1)
{
subL->_bf = 0;
subLR->_bf = 0;
parent->_bf = 1;
}
else if (bf == 1)
{
subL->_bf = -1;
subLR->_bf = 0;
parent->_bf = 0;
}
// subLR没有子节点
else if (bf == 0)
{
subL->_bf = 0;
subLR->_bf = 0;
parent->_bf = 0;
}
else
{
assert(false);
}
}
//右左双旋
void RotateRL(Node* parent)
{
Node* subR = parent->_right;
Node* subRL = subR->_left;
int bf = subRL->_bf;
RotateR(subR);
RotateL(parent);
subRL->_bf = 0;
if (bf == 1)
{
subR->_bf = 0;
parent->_bf = -1;
}
else if (bf == -1)
{
parent->_bf = 0;
subR->_bf = 1;
}
else
{
parent->_bf = 0;
subR->_bf = 0;
}
}
bool IsBalance()
{
return _IsBalance(_root);
}
int Height()
{
return _Height(_root);
}
int Size()
{
return _Size(_root);
}
private:
int _Size(Node* root)
{
return root == nullptr ? 0 : _Size(root->_left) + _Size(root->_right) + 1;
}
int _Height(Node* root)
{
if (root == nullptr)
return 0;
return max(_Height(root->_left), _Height(root->_right)) + 1;
}
bool _IsBalance(Node* root)
{
if (root == nullptr)
return true;
int leftHeight = _Height(root->_left);
int rightHeight = _Height(root->_right);
// 不平衡
if (abs(leftHeight - rightHeight) >= 2)
{
cout << root->_kv.first << endl;
return false;
}
// 顺便检查一下平衡因子是否正确
if (rightHeight - leftHeight != root->_bf)
{
cout << root->_kv.first << endl;
return false;
}
return _IsBalance(root->_left)
&& _IsBalance(root->_right);
}
void _InOrder(Node* root)
{
if (root == nullptr)
{
return;
}
_InOrder(root->_left);
cout << root->_kv.first << ":" << root->_kv.second << endl;
_InOrder(root->_right);
}
private:
Node* _root = nullptr;
};
void TestAVLTree1()
{
//int a[] = { 8, 3, 1, 10, 6, 4, 7, 14, 13 };
int a[] = { 4, 2, 6, 1, 3, 5, 15, 7, 16, 14 };
AVLTree<int, int> t1;
for (auto e : a)
{
if (e == 4)
{
int i = 0;
}
// 1、先看是插入谁导致出现的问题
// 2、打条件断点,画出插入前的树
// 3、单步跟踪,对比图一一分析细节原因
t1.Insert({ e,e });
cout << "Insert:" << e << "->" << t1.IsBalance() << endl;
}
t1.InOrder();
cout << t1.IsBalance() << endl;
}
void TestAVLTree2()
{
const int N = 100000000;
vector<int> v;
v.reserve(N);
srand(time(0));
for (size_t i = 0; i < N; i++)
{
v.push_back(rand() + i);
//cout << v.back() << endl;
}
size_t begin2 = clock();
AVLTree<int, int> t;
for (auto e : v)
{
t.Insert(make_pair(e, e));
//cout << "Insert:" << e << "->" << t.IsBalance() << endl;
}
size_t end2 = clock();
cout << "Insert:" << end2 - begin2 << endl;
//cout << t.IsBalance() << endl;
cout << "Height:" << t.Height() << endl;
cout << "Size:" << t.Size() << endl;
size_t begin1 = clock();
// 确定在的值
for (auto e : v)
{
t.Find(e);
}
// 随机值
/*for (size_t i = 0; i < N; i++)
{
t.Find((rand() + i));
}*/
size_t end1 = clock();
cout << "Find:" << end1 - begin1 << endl;
}