Solr-6.5.1配置中文分词器smartcn

最新推荐文章于 2024-04-13 10:17:19 发布

写写代码AAA

最新推荐文章于 2024-04-13 10:17:19 发布

阅读量2.4k

点赞数 1

分类专栏： Solr 文章标签： solr schema 中文分词器

本文链接：https://blog.csdn.net/qq_28988969/article/details/73028544

版权

Solr 专栏收录该内容

7 篇文章 0 订阅

订阅专栏

solr的同步发行包smartcn可进行中文切词，smartcn的分词准确率不错，但就是不能自己定义新的词库，不过smartcn是跟solr同步的，所以不需要额外的下载，只需在solr的例子中拷贝进去即可。
第一步:
找到如下目录，复制中文分词器jar到solr项目的WEB-INF/lib目录下:
这里写图片描述

第二步:
在自定义的core下配置schema（schema目录可查看之前的文章）:

<types>
    ........
    <!-- 配置中文分词器 -->
    <fieldType name="text_smartcn" class="solr.TextField" positionIncrementGap="100">
        <analyzer type="index">
            <tokenizer class="org.apache.lucene.analysis.cn.smart.HMMChineseTokenizerFactory"/>
        </analyzer>
        <analyzer type="query">
            <tokenizer class="org.apache.lucene.analysis.cn.smart.HMMChineseTokenizerFactory"/>
        </analyzer>
    </fieldType>
</types>

第三步:

将需要中文分词的字段类型替换成上述类型:

<field name="goodsName" type="text_smartcn" indexed="true" stored="true" required="true" multiValued="false" />

写写代码AAA

关注

1
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
Solr-6.5.1配置中文分词器smartcn

solr的同步发行包smartcn可进行中文切词，smartcn的分词准确率不错，但就是不能自己定义新的词库，不过smartcn是跟solr同步的，所以不需要额外的下载，只需在solr的例子中拷贝进去即可。第一步: 找到如下目录，复制中文分词器jar到solr项目的WEB-INF/lib目录下: 第二步: 在自定义的core下配置schema（schema目录可查看之前的文章）
复制链接

扫一扫