相对熵(KL散度)
来源:互联网 发布:双系统linux开机启动 编辑:程序博客网 时间:2024/06/01 17:59
信息熵反应了一个系统的有序化程度,一个系统越是有序,那么它的信息熵就越低,反之就越高。下面是熵的定义
如果一个随机变量的可能取值为,对应的概率为,则随机变量的熵定义为
有了信息熵的定义,接下来开始学习相对熵。
1. 相对熵的认识
相对熵又称互熵,交叉熵,鉴别信息,Kullback熵,Kullback-Leible散度(即KL散度)等。设和是取值的两个概率概率分布,则对的相对熵为
在一定程度上,熵可以度量两个随机变量的距离。KL散度是两个概率分布P和Q差别的非对称性的度量。KL散度是用来度量使用基于Q的编码来编码来自P的样本平均所需的额外的位元数。 典型情况下,P表示数据的真实分布,Q表示数据的理论分布,模型分布,或P的近似分布。
2. 相对熵的性质
相对熵(KL散度)有两个主要的性质。如下
(1)尽管KL散度从直观上是个度量或距离函数,但它并不是一个真正的度量或者距离,因为它不具有对称性,即
(2)相对熵的值为非负值,即
在证明之前,需要认识一个重要的不等式,叫做吉布斯不等式。内容如下
3. 相对熵的应用
相对熵可以衡量两个随机分布之间的距离,当两个随机分布相同时,它们的相对熵为零,当两个随机分布的差别增大时,它们的相对熵也会增大。所以相对熵(KL散度)可以用于比较文本的相似度,先统计出词的频率,然后计算KL散度就行了。另外,在多指标系统评估中,指标权重分配是一个重点和难点,通过相对熵可以处理。
在Julia中,有一个KLDivergence包,用来计算两个分布之间的K-L距离,它需要依赖Distributions包,用法详见:https://github.com/johnmyleswhite/KLDivergence.jl
4. JS散度
JS散度相似度衡量指标。现有两个分布
文章转自:http://blog.csdn.net/acdreamers/article/details/44657745
http://blog.csdn.net/victoriaw/article/details/56494922
- 相对熵(KL散度)
- 相对熵(KL散度)
- 相对熵(KL散度)
- 相对熵(KL散度)
- 相对熵(KL散度)
- KL 散度,相对熵
- KL 散度,相对熵
- KL距离(相对熵)
- KL距离(相对熵)
- 特征选择--信息增益(相对熵、KL散度、KL距离)
- Kullback–Leibler divergence(相对熵,KL距离,KL散度)
- 熵,交叉熵,相对熵(KL散度)
- 熵 信息增益 相对熵(KL散度) 互信息
- KL散度(相对熵,信息增益)学习笔记
- 相对熵——KL散度
- KL散度(Kullback-Leibler_divergence)(相对熵)
- KL距离 相对熵
- KL距离(相对熵)
- 网易2018校招内推编程题集合:交错01串 [python]
- Oracle的nvl/nvl2/nullif/coalesce函数
- 四.网络层的两大协议ICMP和ARP的工作原理
- 网易2018校招内推编程题集合:堆棋子 [python]
- 微信公众号用户管理开发
- 相对熵(KL散度)
- 买期房,你需要知道的----期房维权纪实
- JavaScript中双叹号(!!)作用
- zookeeper的工作原理与选举机制
- React Native使用百度Echarts显示图表
- QML
- 网易2018校招内推编程题集合:小易喜欢的数列 [python]
- 用过的正则表达式
- 灵魂小编又双叒叕出参会攻略了!——企服三会的正确打开方式