摘要: 1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 运行结果如下: 2.邮件预处理 邮件分句 名子分词 去掉过短的单词 词性还原 连接成字符串 传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download() # sev 阅读全文
posted @ 2020-05-17 17:37 爱飞的大白鲨 阅读(764) 评论(0) 推荐(0) 编辑