摘要: KL 散度又叫 相对熵,是衡量 两个概率分布 匹配程度的指标,KL 散度越大,分布差异越大,匹配度越低 计算公式如下 或者 其中 p是 目标分布,或者叫被匹配的分布,或者叫模板分布,q 是去匹配的分布; 试想,p 是真实值,q 是预测值,岂不是 个 loss function; 性质 如果 两个分布 阅读全文