摘要: 简单示例 wordcloud.WordCloud类 在不同形状黑白图像上显示 阅读全文
posted @ 2019-08-22 18:52 -零 阅读(1707) 评论(0) 推荐(0) 编辑
摘要: jieba "结巴"中文分词:做最好的Python中文分词组件 "Jieba" Feature 支持三种分词模式: 精确模式,试图将句子最精确地切开,适合文本分析; 全模式,把句子中所有的可以成词的词语都扫描出来, 速度非常快,但是不能解决歧义; 搜索引擎模式,在精确模式的基础上,对长词再次切分,提 阅读全文
posted @ 2019-08-22 16:31 -零 阅读(501) 评论(0) 推荐(0) 编辑
摘要: 一、前言 随着互联网的发展,数据的海量增长使得文本信息的分析与处理需求日益突显,而文本处理工作中关键词提取是基础工作之一。 TF-IDF与TextRank是经典的关键词提取算法,需要掌握。 二、TF-IDF 2.1、TF-IDF通用介绍 TF-IDF,全称是 Term Frequency - inv 阅读全文
posted @ 2019-08-22 13:58 -零 阅读(2941) 评论(0) 推荐(0) 编辑