第一章 分词
1、JieBa 库
“结巴”中文分词:做最好的 Python 中文分词组件
"Jieba" (Chinese for "to stutter") Chinese text segmentation: built to be the best Python Chinese word segmentation module.
2、特点
支持三种分词模式:
精确模式,试图将句子最精确地切开,适合文本分析;
“结巴”中文分词:做最好的 Python 中文分词组件
"Jieba" (Chinese for "to stutter") Chinese text segmentation: built to be the best Python Chinese word segmentation module.
支持三种分词模式:
精确模式,试图将句子最精确地切开,适合文本分析;