哈夫曼编码(Huffman Coding)原理、运行步骤、python实现

哈夫曼编码是贪心算法的一种应用,通过赋予高频字符短编码,低频字符长编码,优化数据编码。文章通过实例解释了哈夫曼编码的构建过程,并提供了Python代码实现。

哈夫曼编码是贪心算法的一个典型应用。哈夫曼编码利用每条数据出现的频率(概率),从信息论的角度出发,将这些数据重新编码。哈夫曼编码的编码结果是给出现频率较高的数据一个较短的编码,给出现频率较低的数据一个较长的编码。

让我们举个例子说明一下哈夫曼编码的步骤:现在有数据[a,a,a,a,a,b,b,b,b,c,c,c,d,d,e]。可以看出字符a出现了5次,字符2出现了4次,字符c出现了3次,字符d出现了2次,字符e出现了1次。

首先,我们将这5个字符看成一个森林,它们的值是它们出现的频率,我们首先要做的是把这些森林合并成一棵哈夫曼树。利用贪心算法合并每个节点。

合并算法:先选取两个根节点频率值最小的森林,将这两个森林作合并为一棵树,其根节点的值为上述两个根节点频率值的和,上述两个根节点为新树根节点的左右节点。重复合并步骤,直到将所有森林合并成一棵树算法终止。算法过程如下图:

步骤 状态
init 在这里插入图片描述
1 在这里插入图片描述
2 在这里插入图片描述
3 在这里插入图片描述
4 在这里插入图片描述

构造完哈夫曼树之后,按照遍历路径来获得每个字符的编码即可:

在这里插入图片描述

编码结果如下表:

字符 编码
a 00
b 01
c 10
d 110
e 111

附上python代码实现:

"""
@filename   [huffman.py]
@author     [zxy]
@version    [v1.0]
@date       [2020/3/13]
"""

import queue
class Node:
    def __init__(self, x,
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值