- 博客(2)
- 收藏
- 关注
原创 使用斯坦福分词器进行词性标注
使用斯坦福分词器进行词性标注 文章目录使用斯坦福分词器进行词性标注前言中文分词是中文文本处理的一个基础步骤,同时也是中文人机自然语言交互的基础模块,与英文不同的是,中文句子中没有词的界限,因此在进行中文自然语言处理时,通常需要先进行分词,分词效果将直接影响词性,句法树等模块的效果场景不同,要求也不同。在人机自然语言交互中,成熟的中文分词算法能够达到更好的自然语言处理效果,帮助计算
2022-05-06 20:35:02 2918
原创 使用JIEBA和Snownlp工具包解决文本摘要问题
1.摘要的提取方法 文本摘要是一种从一个或多个信息源中抽取关键信息的方法,它帮助用户节省了大量时间,用户可以从摘要获取到文本的所有关键信息点而无需阅读整个文档。文本摘要按照输入类型可分为单文档摘要和多文档摘要。单文档摘要方法是指针对单个文档,对其内容进行抽取总结生成摘要;多文档摘要方法是指从包含多份文档的文档集合中生成一份能够概括这些文档中心内容的摘要。 基于图排序的文本摘要生成的主要方法是通过把文章分成若干个段落或句子的集合,每个集合对应一个图的顶点,集合之间的关系对应边,最后通过图排序的算法...
2022-04-19 22:18:55 1760
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人