信息熵与压缩编码基础

信息熵与压缩编码基础

一、什么是信息熵

信息熵是消除不确定性所需信息量的度量,也即未知事件可能含有的信息量。也可以理解成某种特定信息的出现概率(离散随机事件的出现概率)。一个系统越是有序,信息熵就越低;反之,一个系统越是混乱,信息熵就越高。信息熵是系统有序化程度的一个度量。

二、信息熵的计算与两种编码方式的压缩率计算

一串消息包含A,B,C,D,E共5类符号,其内容是AABBBBAAAACCCCCCCCCEEEEEEDDDDEEEEEEEEEEEEE, 请问其信息熵是多少?如果分别采用香农-凡诺编码,霍夫曼编码,压缩率分别是多少?

符号 次数 log(1/p(x))
A 6 2.827
B 4 3.392
C 9 2.222
D 4 3.392
E 19 1.144
共计 42

答:字符串的熵 H ( x ) = ∑ i = 1 n p ( x i ) l o g 2 p ( 1 / x i ) = 6 / 42 l o g ( 42 / 6 ) + 4 / 42 l o g ( 42 / 4 ) + 9 / 42 l o g (

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值