哈夫曼编码的matlab实现,Huffman编码(哈夫曼编码)的Matlab实现

clear all

fprintf('Reading data...')

data=imread('cameraman.tif');

data=uint8(data);%读入数据,并将数据限制为uint8

fprintf('Done!\n')

%编码压缩

fprintf('compressing data...');

[zipped,info]=norm2huff(data);

fprintf('Done!\n')

%解压缩

fprintf('compressing data...');

unzipped=huff2norm(zipped,info);

fprintf('Done!\n')

%测试是否无失真

isOK=isequal(data(:),unzipped(:))

%显示压缩效果

whos data zipped unzipped

function [zipped,info]=norm2huff(vector)

if~isa(vector,'uint8'),

error('input argument must be a uint8 vector')

end

vector=vector(:)';

%将输入向量转换为行向量

f=frequency(vector);

%计算个元素出现的概率

simbols=find(f~=0);

f=f(simbols);%将元素按出现的概率排列

[f,sortindex]=sot(f);

simbols=simbols(sortindex);

%产生码字 generate the codeword as the 52 bits of a double

len=length(simbols);

simbols_index=num2cell(1:len);

codeword_tmp=cell(len,1);

while length(f)>1,

index1=simbols_index{1};

index2=simbols_index{2};

codeword_tmp(index1)=addnode(codeword_tmp(index1),uint8(0)); codeword_tmp(index2)=addnode(codeword_tmp(index2),uint8(1)); f=[sum(f(1:2)) f(3:end)];

simbols_index=[{[index1 index2]} simbols_index(3:end)];

%将数据重新排列,是两个节点的频率尽量与前一个节点的频率想当

resort data in order to have two nodes with lower frequency as first to

 哈夫曼编码(Huffman Coding)是一种编码方式,哈夫曼编码是可变字长编码(VLC)的一种。 Huffman于1952年提出一种编码方法,该方法完全依据字符出现概率来构造异字头的平均长 度最短的码字,有时称之为最佳编码,一般就叫作Huffman编码。 以哈夫曼树─即最优二叉树,带权路径长度最小的二叉树,经常应用于数据压缩。 在计算机信息处理中,“哈夫曼编码”是一种一致性编码法(又称"熵编码法"),用于数据的无损耗压缩。这一术语是指使用一张特殊的编码表将源字符(例如某文件中的一个符号)进行编码。这张编码表的特殊之处在于,它是根据每一个源字符出现的估算概率而建立起来的(出现概率高的字符使用较短的编码,反之出现概率低的则使用较长的编码,这便使编码之后的字符串的平均期望长度降低,从而达到无损压缩数据的目的)。这种方法是由David.A.Huffman发展起来的。 例如,在英文中,e的出现概率很高,而z的出现概率则最低。当利用哈夫曼编码对一篇英文进行压缩时,e极有可能用一个位(bit)来表示,而z则可能花去25个位(不是26)。用普通的表示方法时,每个英文字母均占用一个字节(byte),即8个位。二者相比,e使用了一般编码的1/8的长度,z则使用了3倍多。倘若我们能实现对于英文中各个字母出现概率的较准确的估算,就可以大幅度提高无损压缩的比例。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值