Solr全量更新和增量更新
1.什么是全量更新
数据库中的数据—》solr缓存中
就是把数据库中的所有数据通过solr客户端中 full-import 就可以做全量更新了
需要注意的就,在做全量更新之前,需要clean一下,把solr之前的缓存数据都删掉
2.什么是增量更新呢
1.怎么用呢,首先你得搞得这些重要的属性
<!-- transformer 格式转化:HTMLStripTransformer 索引中忽略HTML标签 --->
<!-- query:查询数据库表符合记录数据 --->
<!-- deltaQuery:增量索引查询主键ID ---> 注意这个只能返回ID字段
<!-- deltaImportQuery:增量索引查询导入数据 --->
<!-- deletedPkQuery:增量索引删除主键ID查询 ---> 注意这个只能返回ID字段
2.数据库配置的注意事项
1.如果只涉及添加,与修改业务,那么数据库里只需额外有一个timpstamp字段 就可以了,默认值为当前系统时间,CURRENT_TIMESTAMP 2.如果还涉及删除业务,那么数据里就需额外再多添加一个字段isdelete,int类型的 用0,1来标识,此条记录是否被删除
3.data-config.xml配置下
<?xml version="1.0" encoding="UTF-8"?> <!-- pk="ID" 这个很有必要,因为其中的增量索引查询主键ID时需要 -->
<!-- dataSource="mydb" 这个引用名字是引用上面数据源的名字 -->
<!-- name="myinfo" 这个名字必须唯一,存在多个实体时 -->
<!-- query="select * from myinfo WHERE isdelete=0 query查询是指
查询出表里所有的符合条件的数据,因为笔者测试的有删除业务,所以
where 后面有一个限定条件isdelete=0,意思为查询未被删除的数据
(注意这个query查询只对第一次全量导入有作用,对增量导入不起作用)
-->
<!--
deltaQuery="select productId from product where modifyTime > '${dataimporter.last_index_time}'"
deltaQuery的意思是,查询出所有经过修改的记录的ID
可能是修改操作,添加操作,删除操作产生的
(此查询只对增量导入起作用,而且只能返回ID值)
-->
<!--
deletedPkQuery="select productId from product where isdelete=-1"
此操作值查询那些数据库里伪删除的数据的ID(即isdelete标识为-1的数据)
solr通过它来删除索引里面对应的数据
(此查询只对增量导入起作用,而且只能返回ID值)
-->
<!--
deltaImportQuery="select * from product where productId = '${dih.delta.productId}'"
次查询是获取以上两步的ID,然后把其全部数据获取,根据获取的数据
对索引库进行更新操作,可能是删除,添加,修改
(此查询只对增量导入起作用,可以返回多个字段的值,一般情况下,都是返回所有字段的列)
-->
能是删除,添加,修改
(此查询只对增量导入起作用,可以返回多个字段的值,一般情况下,都是返回所有字段的列)
–>
说白了增量更新就是在全量更新的基础上加上一些配置