Solr自定义排序

最新推荐文章于 2021-03-09 23:02:49 发布

zhangchi_

最新推荐文章于 2021-03-09 23:02:49 发布

阅读量4.5k

点赞数

分类专栏： Solr垂直搜索

本文链接：https://blog.csdn.net/zhangchi_/article/details/9039801

版权

本文介绍了Solr中如何实现自定义排序，通过设置自定义字段来消除文本相关性打分的影响。同时提到了在添加数据时利用boost参数调整全局排序，详细列举了Solr支持的数学方法，并提供了相关资源链接。

摘要由CSDN通过智能技术生成

使用Solr搭建搜索引擎很容易，但是如何制定合理的打分规则(boost)做排序却是一个很头痛的事情。Solr本身的排序打分规则是继承自Lucene的文本相关度的打分即boost，这一套算法对于通用的提供全文检索的服务来讲，已经够用了，但是对于一些专门领域的搜索来讲，文本相关度的打分是不合适的。
如何来定制适合自身业务的排序打分规则（boost）呢？经过这段时间的思考与实践，想到了如下三个方法

1、定制Lucene的boost算法，加入自己希望的业务规则；
2、使用Solr的edismax实现的方法，通过bf查询配置来影响boost打分。
3、在建索引的schema时设置一个字段做排序字段，通过它来影响文档的总体boost打分。
上面每一种方法都有其优劣，下面分析一下各自的优劣。
4. 添加数据的时候对每个文档进行boost设置，来影响打分规则。

第一种方法技术难度要求较高，需要读懂Lucene的boost打分算法，在代码层做定制.
第二种方式就简单不少，不过因为受限于edismax提供的方法，所以有些局限性。

第三种排序可完全消除文本相关性打分的影响，文本检索匹配逻辑只负责找到匹配的项，排序由自定义字段处理。

第四种局限性大，是在添加数据的时候就直接设置boost打分来影响全局的排序。

下面结合最近使用Solr的实践，着重介绍一下通过使用Solr的DisMaxQParserPlugin通过配置来制定结果文档打分规则。
DisMaxQParserPlugin提供在针对文本boost打分上，支持搜索多个schema索引字段，并针对每一个字段设置不同的boost权限。 <