会员
周边
众包
新闻
博问
闪存
赞助商
所有博客
当前博客
我的博客
我的园子
账号设置
简洁模式
...
退出登录
注册
登录
咳咳你
博客园
首页
新随笔
联系
管理
订阅
2020年3月13日
停用词收集
摘要: 停用词 停用词是指在信息检索中,为节省存储空间和提高搜索效率,在处理自然语言数据(或文本)之前或之后会自动过滤掉某些字或词,这些字或词即被称为Stop Words(停用词)。这些停用词都是人工输入、非自动化生成的,生成后的停用词会形成一个停用词表。 简洁的来说就是机器学习中,为了使提取关键字更加简洁
阅读全文
posted @ 2020-03-13 20:50 咳咳你
阅读(236)
评论(0)
推荐(0)
编辑