准确率(accuracy)、精确率(precision)、召回率(recall)

整理了知乎上的前两个回答,https://www.zhihu.com/question/19645541

其中精度是检索出相关文档数与检索出的文档总数的比率,衡量的是检索系统的查准率;召回率是指检索出的相关文档数和文档库中所有的相关文档数的比率,衡量的是检索系统的查全率。一般来说,Precision就是检索出来的条目(比如:文档、网页等)有多少是准确的,Recall就是所有准确的条目有多少被检索出来了。

总结一下就是:

  • 召回率——查准率——recall
  • 查全率——精确率——precision

首先明确一下几个表示:

  • True Positive(真正, TP):将正类预测为正类数.
  • True Negative(真负 , TN):将负类预测为负类数.
  • False Positive(假正, FP):将负类预测为正类数 → \rightarrow 误报 (Type I error).
  • False Negative(假负 , FN):将正类预测为负类数 → \rightarrow 漏报 (Type II error).
    即:
PositiveNegative
TrueTPTN
FalseFPFN

这样之后,准确率、精确率和召回率可以用如下公式来表示:
准确率 : A c c = T P + T N T P + F P + F N + T N Acc = \frac{TP+TN}{TP+FP+FN+TN} Acc=TP+FP+FN+TNTP+TN
精确率: P r e = T P T P + F P Pre = \frac{TP}{TP+FP} Pre=TP+FPTP
召回率: R e c a l l = T P T P + F N Recall = \frac{TP}{TP+FN} Recall=TP+FNTP

例子:假设我们手上有60个正样本,40个负样本,我们要找出所有的正样本,系统查找出50个,其中只有40个是真正的正样本,计算上述各指标。

  • TP: 将正类预测为正类数 40
  • FN: 将正类预测为负类数 20
  • FP: 将负类预测为正类数 10
  • TN: 将负类预测为负类数 30

准确率(accuracy) = 预测对的/所有 = (TP+TN)/(TP+FN+FP+TN) = 70%
精确率(precision) = TP/(TP+FP) = 80%
召回率(recall) = TP/(TP+FN) = 2/3

  • 17
    点赞
  • 46
    收藏
    觉得还不错? 一键收藏
  • 12
    评论
评论 12
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值