Solr之fieldtype

最新推荐文章于 2021-12-09 20:34:13 发布

雨点儿

最新推荐文章于 2021-12-09 20:34:13 发布

阅读量581

点赞数

分类专栏： Solr 文章标签： solr 索引 fieldtype

本文链接：https://blog.csdn.net/u010378878/article/details/51427850

版权

Solr 专栏收录该内容

5 篇文章 0 订阅

订阅专栏

在 schema.xml 中设置
fieldtype 这个标签来对字段类型进行一系列的控制，例如，分词器的选择，停用词（所有的停用词是放到了一个txt文件中），词干提取算法（例如使用 Porter Stemming 算法进行词干提取 （EnglishPorterFilterFactory））
标签结构说明（对text字段举例说明，这里对index索引和query查询建立了两个analyzer）：

<fieldtype name="text" class="solr.TextField">
    <analyzer type="index">
        <tokenfilter class="......"/>
        <tokenizer class="solr.WhitespaceTokenizerFactory"/>
        <filter class="solr.StopFilterFactory" ignoreCase="true" words="stopwords.txt"/>
            <filter class="solr.WordDelimiterFilterFactory" />
            <filter class="solr.LowerCaseFilterFactory"/>
            <filter class="solr.EnglishPorterFilterFactory" protected="protwords.txt"/>
            <filter class="solr.RemoveDuplicatesTokenFilterFactory"/>
    </analyzer>
     <analyzer type="query">
            <tokenizer class="solr.WhitespaceTokenizerFactory"/>
            <filter class="solr.SynonymFilterFactory" synonyms="synonyms.txt" ignoreCase="true" expand="true"/>
            <filter class="solr.StopFilterFactory" ignoreCase="true" words="stopwords.txt"/>
            <filter class="solr.WordDelimiterFilterFactory"/>
            <filter class="solr.LowerCaseFilterFactory"/>
            <filter class="solr.EnglishPorterFilterFactory" protected="protwords.txt"/>
            <filter class="solr.RemoveDuplicatesTokenFilterFactory"/>
    </analyzer>
 </fieldtype>