摘要: 1. nunique() DataFrame.nunique(axis = 0,dropna = True ) 功能:计算请求轴上的不同观察结果 参数: axis : {0或'index',1或'columns'},默认为0。0或'index'用于行方式,1或'列'用于列方式。 dropna : b 阅读全文
posted @ 2019-03-26 13:40 nxf_rabbit75 阅读(2989) 评论(1) 推荐(0) 编辑
摘要: 一. 三种模式 精确模式,试图将句子最精确地切开,适合文本分析; 全模式,把句子中所有的可以成词的词语都扫描出来, 速度非常快,但是不能解决歧义; 搜索引擎模式,在精确模式的基础上,对长词再次切分,提高召回率,适合用于搜索引擎分词。 二. 算法 基于前缀词典实现高效的词图扫描,生成句子中汉字所有可能 阅读全文
posted @ 2019-03-26 11:01 nxf_rabbit75 阅读(455) 评论(0) 推荐(0) 编辑