@TOC
视频编码中熵编码的目标是去除信源符号在信息表达上的表示冗余,也称为信息熵冗余或者编码冗余。 熵编码技术是视频编码系统中的基础性关键技术之一。
信息量: 表示该符号所需要的位数
-
考虑用‘0’和‘1’组成的二进制数字
-
为含有n个符号的某条信息的编码
-
假设符号
${A_j}$ 在整条信息中重要出现的概率为${P_j}$ ,则该符号的信息量定义为${E_n = log_2(P_j)}$
信息量表示为以2为底数的对数是正值
举例说明:
列一 : 输入信源字符串: aabbaccbac
a、b、c出现的概率分别为0.5,0.3和0.2, 他们的信息量分别为
- 总信息量也即表达整个字符串需要的位数:
列二: 输入信源字符串: aabbaccbac => 如果使用二进制等长编码需要多少位?
解: 字符串有3个不同的字符串,又因为2位二进制数能表示4个不同的字符,所以对每个字符用二位二进制数表示
列如:
| 符号 | a | b | c |
|---|---|---|---|
| 等长编码 | 00 | 01 | 10 |
数据压缩的基石是 香农信息论的信源编码(Shannon)第一定律(失真信源定律)
如果对字符${A_i}$ 的编码长度为
设M: 信号中所出现不同字符的个数
- 平均码长
${L_{avg} >> H_(x)}$ 有冗余,不是最佳的 - 平均码长
${L_{avg} < H_(x)}$ 不可能出现 - 平均码长
${L_{avg} ≈ H_(x)}$ 最佳的编码
熵值是平均码长的下限
编码的基本思想就是使用较少的比特数表示出现概率较大的码源符号, 使用较多的比特数表示出现概率小的码源的符号
最常用算法 : 霍夫曼编码(Buffman)
熵