会员
周边
众包
新闻
博问
闪存
所有博客
当前博客
我的博客
我的园子
账号设置
简洁模式
...
退出登录
注册
登录
林文文
博客园
首页
新随笔
联系
订阅
管理
2020年5月17日
12.朴素贝叶斯-垃圾邮件分类
摘要: 朴素贝叶斯垃圾邮件分类 读邮件数据集文件,提取邮件本身与标签。 2.邮件预处理 2.1传统方法 2.1 nltk库 分词nltk.sent_tokenize(text) #对文本按照句子进行分割 nltk.word_tokenize(sent) #对句子进行分词 2.2 punkt 停用词from
阅读全文
posted @ 2020-05-17 21:40 林文文
阅读(142)
评论(0)
推荐(0)
编辑
公告