摘要: 一 背景介绍 不平衡信息,特点是少数信息更珍贵,多数信息没有代表性。所以一般的分类算法会被多数信息影响,而忽略少数信息的重要性。 解决策略: 1.数据级别 (1)上采样:增加稀有类成本数 (2)下采样:减少大类样本数 (3)混合方法:结合(1)(2) 2.算法算法级别 (1)代价敏感学习方法:对正类 阅读全文
posted @ 2016-03-24 16:09 rongyux 阅读(1339) 评论(0) 推荐(1) 编辑