会员
周边
众包
新闻
博问
闪存
赞助商
所有博客
当前博客
我的博客
我的园子
账号设置
简洁模式
...
退出登录
注册
登录
符秋雨
博客园
首页
博问
闪存
新随笔
订阅
管理
2020年5月17日
第十一次作业 朴素贝叶斯-垃圾邮件分类
摘要: 1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 源代码: 运行结果: 2.邮件预处理 邮件分句 名子分词 去掉过短的单词 词性还原 连接成字符串 传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download() #
阅读全文
posted @ 2020-05-17 13:01 符秋雨
阅读(184)
评论(0)
推荐(0)
编辑