solr 配置中文分词

    要在中文的项目中使用 Solr ,少不了要集成中文分词组件。本篇以 IK2012 分词为例,讲解如何在 solr 3.5 中及集成中文分词,使用 IK 的原因 IK 比其他中文分词维护的勤快,和 Solr 集成也相对容易。

首先需要弄到 IKAnalyzer2012.jar ,可以从这里下载到

http://code.google.com/p/ik-analyzer/downloads/list

这里选择 IKAnalyzer2012_u5.zip 下载,下载后解压,将解压出来的 IKAnalyzer2012.jar 复制出来。在 D:\apache-solr-3.5.0\example\solr 下新建 lib 目录,将 IKAnalyzer2012.jar 放入 lib 下。打开 “D:\apache-solr-3.5.0\example\solr\conf\schema.xml” ,在 types 节点下 添加

 

< fieldType name = "text_zh" class = "solr.TextField" positionIncrementGap = "100" >
       < analyzer type = "index" >
         < tokenizer class = "org.wltea.analyzer.solr.IKTokenizerFactory" useSmart = "false" />
       </ analyzer >
       < analyzer type = "query" >
         < tokenizer class = "org.wltea.analyzer.solr.IKTokenizerFactory" useSmart = "false" />
       </ analyzer >
     </ fieldType >
 

然后在 fields 节点下引用 text_zh 这一字段类型,如下所示:

 
< field name = "title" type = "text_zh" indexed = "true" stored = "true" />

这样标题字段就支持中文分词了。

 

原文地址:http://www.solrcn.com/?tag=solr%E4%B8%AD%E6%96%87%E5%88%86%E8%AF%8D

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值