摘要: 1. 读邮件数据集文件,提取邮件本身与标签。 列表 numpy数组 执行代码: 运行结果: 2.邮件预处理 邮件分句 名子分词 去掉过短的单词 词性还原 连接成字符串 传统方法来实现 nltk库的安装与使用 pip install nltk import nltk nltk.download() # 阅读全文
posted @ 2020-05-20 19:58 CrJia 阅读(340) 评论(0) 推荐(0) 编辑