【哈夫曼树】简单介绍+代码(Java)

哈夫曼树

1951年,哈夫曼在麻省理工学院(MIT)攻读博士学位,他和修读信息论课程的同学得选择是完成学期报告还是期末考试。导师罗伯特·法诺(Robert Fano)出的学期报告题目是:查找最有效的二进制编码。由于无法证明哪个已有编码是最有效的,哈夫曼放弃对已有编码的研究,转向新的探索,最终发现了基于有序频率二叉树编码的想法,并很快证明了这个方法是最有效的。哈夫曼使用自底向上的方法构建二叉树,避免了次优算法香农-范诺编码(Shannon–Fano coding)的最大弊端──自顶向下构建树。1



定义

当用 n 个结点(都做叶子结点且都有各自的权值)试图构建一棵树时,如果构建的这棵树的带权路径长度最小,称这棵树为最优二叉树,有时也叫“赫夫曼树”或者“哈夫曼树”。

基本概念

路径:在一棵树中,一个结点到另一个结点之间的通路,称为路径。
路径长度:在一条路径中,每经过一个结点,路径长度都要加 1 。
结点的权:给每一个结点赋予一个新的数值,被称为这个结点的权。
结点的带权路径长度:指的是从根结点到该结点之间的路径长度与该结点的权的乘积。
树的带权路径长度:树中所有叶子结点的带权路径长度之和。通常记作 “WPL” 。

结点结构

构建哈夫曼树时,首先需要确定树中结点的构成。
由于哈夫曼树的构建是从叶子结点开始,不断地构建新的父结点,直至树根,所以结点中应包含指向父结点的指针。但是在使用哈夫曼树时是从树根开始,根据需求遍历树中的结点,因此每个结点需要有指向其左孩子和右孩子的指针。

//哈夫曼树结点结构
typedef struct {
    int weight;//结点权重
    int parent, left, right;//父结点、左孩子、右孩子在数组中的位置下标
}HTNode, *HuffmanTree;

构建思路

  1. 从小到大进行排序, 将每一个数据,每个数据都是一个节点 , 每个节点可以看成是一颗最简单的二叉树
  2. 取出根节点权值最小的两颗二叉树
  3. 组成一颗新的二叉树, 该新的二叉树的根节点的权值是前面两颗二叉树根节点权值的和
  4. 再将这颗新的二叉树,以根节点的权值大小 再次排序, 不断重复 1-2-3-4 的步骤,直到数列中,所有的数据都被处理,就得到一颗赫夫曼树
    哈夫曼树构造过程

图1中,(A)给定了四个结点a,b,c,d,权值分别为7,5,2,4;第一步如(B)所示,找出现有权值中最小的两个2 和 4 相应的结点 c 和 d 构建一个新的二叉树,树根的权值为 2 + 4 = 6,同时将原有权值中的 2 和 4 删掉,将新的权值 6 加入;进入(C),重复之前的步骤。直到(D)中,所有的结点构建成了一个全新的二叉树,这就是哈夫曼树。

图解分析

下面将以序列 {13, 7, 8, 3} 为例,图解创建哈夫曼树的过程。
首先,序列升序排序得到 {3, 7, 8, 13}。
把每个数据看做是一个节点,取出节点权值最小的两个节点 3, 7 组成一颗新的二叉树,该二叉树权值为 3+7 = 10。
节点1

在原序列中将第 2 步取出的两个权值最小的移除,然后将第 2 步生成的新节点的权值加入到原序列中,并重新排序。
节点2

再次取出权值最小的两个节点 8, 10 组成一颗新的二叉树,新的二叉树权值为 8+10 = 18。然后从序列中移除节点 8,10,将 18 添加进去,然后重新排序。
节点3

再次取出权值最小的两个节点 13,18 组成一颗新的二叉树,新的二叉树权值为 13+18 = 31。然后从序列中移除 13, 18,将 31 添加进去。此时序列中只剩下一个节点,该节点即为哈夫曼树的根节点。

至此,序列 {13, 7, 8, 3} 的哈夫曼树创建完毕。

节点4

程序代码

public class HuffManTree {
    public static void main(String[] args) {
        int[] arr = {13, 7, 8, 3, 29, 6, 1};
        HuffNode root = buildHuffManTree(arr);	// 创建哈夫曼树
        root.preOrder();	// 先序遍历
    }
    // 根据序列创建哈夫曼树
    public static HuffNode buildHuffManTree(int[] arr){
        // 把每个数全部转换成节点存放到 List 集合中
        ArrayList<HuffNode> nodes = new ArrayList<>();
        for (int weight : arr){
            nodes.add(new HuffNode(weight));
        }
        while (nodes.size() > 1) {
            // 将集合中节点按照权值升序排序
            Collections.sort(nodes);
            // 取出权值最小的两个节点组合成一个树
            HuffNode leftNodes = nodes.get(0);
            HuffNode rightNodes = nodes.get(1);
            HuffNode root = new HuffNode(leftNodes.weight + rightNodes.weight);
            // 建立树
            root.left = leftNodes;
            root.right = rightNodes;
            // 集合中去掉两个子节点
            nodes.remove(leftNodes);
            nodes.remove(rightNodes);

            // 把新的树添加到集合中
            nodes.add(root);
        }
        return nodes.get(0);    // 最后集合中只有一个根节点
    }

}
/**
 * 节点,实现 Comparable 接口,为了可以使用工具类进行排序
 */
class HuffNode implements Comparable<HuffNode> {
    int weight; // 权值
    HuffNode left;  // 左子节点指针
    HuffNode right; // 右子节点指针

    public HuffNode(int weight){
        this.weight = weight;
    }

    // 前序遍历:根左右
    public void preOrder(){
        System.out.println(this);
        if (this.left != null){
            this.left.preOrder();
        }
        if (this.right != null){
            this.right.preOrder();
        }
    }

    @Override
    public int compareTo(HuffNode o) {
        return this.weight - o.weight;  // 使用 权值 来升序排序
    }
    @Override
    public String toString() {
        return "HuffNode{" +
                "weight=" + weight +
                '}';
    }
}

运行结果

运行结果

文章引用

  1. 哈夫曼树(赫夫曼树、最优树)详解
  2. 哈夫曼树
    感谢@RonzL

  1. 百度百科:哈夫曼树 ↩︎

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值