摘要: 1. 读邮件数据集文件,提取邮件本身与标签。 数据集下载: http://archive.ics.uci.edu/ml/datasets/SMS+Spam+Collection 列表 numpy数组 2.邮件预处理 邮件分句 名子分词 去掉过短的单词 词性还原 连接成字符串 传统方法来实现 impo 阅读全文
posted @ 2020-05-17 21:51 Chock17 阅读(323) 评论(0) 推荐(0) 编辑