ranker-Scaling Up Crowd-Sourcing to Very Large Datasets: A Case for Active Learning

版权声明:本文为博主原创文章,未经博主允许不得转载。 https://blog.csdn.net/sunyao_123/article/details/79972918

论文Scaling Up Crowd-Sourcing to Very Large Datasets A Case for Active Learning提出两种AL算法。

  首先找到分类器θ对未标注数据的不确定程度。然后让crowd对这些数据进行标定。下边介绍两种不确定性方法。
下边的u是未标记数据,但是是指未标注数据的每一个,而不是整体。

一:Uncertainty Algorithm

这里写图片描述
这里写图片描述
第二项计算公式:
这里写图片描述
这里写图片描述
这里写图片描述

二:MinExpError Algorithm

这里写图片描述
这里写图片描述
这里写图片描述
这里写图片描述
这里写图片描述
这里写图片描述
这里写图片描述
  所以说MinExpError scores算法结合了,question的难度(不确定性)和这个回答能够提高我们分类器的结果的程度(影响较大的数据)。

三:附加小知识

这里写图片描述

没有更多推荐了,返回首页

私密
私密原因:
请选择设置私密原因
  • 广告
  • 抄袭
  • 版权
  • 政治
  • 色情
  • 无意义
  • 其他
其他原因:
120
出错啦
系统繁忙,请稍后再试

关闭