- 博客(1)
- 收藏
- 关注
原创 TF-IDF加权技术
#信息内容安全第一次实验–TF-IDF加权技术文章目录jieba库的分词使用的三种办法listdir方法一、实验原理二、实验步骤总结jieba库的分词使用的三种办法全模式:把句子中所有的可以成词的词语都扫描出来, 速度非常快,但是不能解决歧义精简模式:把句子最精确的分开,不会添加多余单词,看起来就像是把句子分割一下搜索引擎模式:在精简模式下,对长词再度切分jieba.cut生成的是一个生成器,generator,也就是可以通过for循环来取里面的每一个词。jieba.lc
2021-04-02 22:50:49 782 1
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人