摘要:
1、简要说明 结巴分词支持三种分词模式,支持繁体字,支持自定义词典 2、三种分词模式 全模式:把句子中所有的可以成词的词语都扫描出来, 速度非常快,但是不能解决歧义 精简模式:把句子最精确的分开,不会添加多余单词,看起来就像是把句子分割一下 搜索引擎模式:在精简模式下,对长词再度切分 # -*- e 阅读全文
摘要:
1、记录个人常用的脚本 # -*- encoding=utf-8 -*- import datetime import json import logging import logging.handlers import os import shutil def create_folder(fold 阅读全文