搜索引擎查询层的主要检索质量优化的方法,在参加完google的互联网大会后的总结


从一个检索词,到得到检索结果,称为一次查询,那么这次查询的质量主要取决于
 
1)是否检索到
2)在搜索结果页第几页第几条检索到
3)检索时间耗时
 
很显然,最佳的结果是,首条命中,而且尽可能的快,假定不考虑检索耗时,仅从检索质量上讲,存在以下四类方法。
 
优化查询结果:(文档空间)
 
1)通过某种rank排名,比如page rank,expert rank,time rank,Hilltop等,然而不论什么方法,都不能保证让所有的用户满意,因为只有有限的条数可以排在前面。
 
2)通过查询结果聚类,比如国外的vivisimo,国内的bbmao,通过查询结果聚类,让用户在选择一次类别,实现不同关注点的展示,然而类别的命名非常困难,通常很多类别没有具体的含义,用户选择存在困难,即便选择了类别,仍然存在排序问题。
 
3)分类搜索,通过查询结果的类别,进行区分。
 

 
 
引入用户空间:
 
1)用户查询历史推测用户的搜索目的。
 
2)用户的语言,地域,性别等推测用户的搜索目的。
 
3)众多用户合作建设的搜索引擎,比如google co-op,swicki等

4)通过历史用户使用该检索词的点击信息,推测那条为最佳用户选择链接。
 
查询词优化:(关键词空间)
 
1)相关搜索提示,提示用户其他的搜索,帮助用户选择最佳搜索词。
 
2)查询纠错,可能用户输入的错别字而导致查询质量降低可以有效的通过这个方法解决。
 
不存在理想检索结果
 
1)允许用户主动创建,例如百度知道,新浪爱问。


转自:http://blog.csdn.net/pennyliang/archive/2007/03/05/1520799.aspx



  • 0
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值