哈夫曼编码是贪心算法的一个典型应用。哈夫曼编码利用每条数据出现的频率(概率),从信息论的角度出发,将这些数据重新编码。哈夫曼编码的编码结果是给出现频率较高的数据一个较短的编码,给出现频率较低的数据一个较长的编码。
让我们举个例子说明一下哈夫曼编码的步骤:现在有数据[a,a,a,a,a,b,b,b,b,c,c,c,d,d,e]。可以看出字符a出现了5次,字符2出现了4次,字符c出现了3次,字符d出现了2次,字符e出现了1次。
首先,我们将这5个字符看成一个森林,它们的值是它们出现的频率,我们首先要做的是把这些森林合并成一棵哈夫曼树。利用贪心算法合并每个节点。
合并算法:先选取两个根节点频率值最小的森林,将这两个森林作合并为一棵树,其根节点的值为上述两个根节点频率值的和,上述两个根节点为新树根节点的左右节点。重复合并步骤,直到将所有森林合并成一棵树算法终止。算法过程如下图:
| 步骤 | 状态 |
|---|---|
| init | ![]() |
| 1 | ![]() |
| 2 | ![]() |
| 3 | ![]() |
| 4 | ![]() |
构造完哈夫曼树之后,按照遍历路径来获得每个字符的编码即可:

编码结果如下表:
| 字符 | 编码 |
|---|---|
| a | 00 |
| b | 01 |
| c | 10 |
| d | 110 |
| e | 111 |
附上python代码实现:
"""
@filename [huffman.py]
@author [zxy]
@version [v1.0]
@date [2020/3/13]
"""
import queue
class Node:
def __init__(self, x,

哈夫曼编码是贪心算法的一种应用,通过赋予高频字符短编码,低频字符长编码,优化数据编码。文章通过实例解释了哈夫曼编码的构建过程,并提供了Python代码实现。





原理、运行步骤、python实现&spm=1001.2101.3001.5002&articleId=104853061&d=1&t=3&u=a072a226d1244b9eab92168ad4b399a0)
8475

被折叠的 条评论
为什么被折叠?



