auc到多少有意义_模型评估指标AUC和ROC,这是我看到的最透彻的讲解

本文深入解析AUC(ROC曲线下的面积)作为机器学习模型评估指标的含义与价值。从混淆矩阵出发,解释ROC曲线的形成过程,讨论不同ROC点的意义,并阐述AUC衡量正例排在负例前面的概率,以及其在处理样本不平衡问题上的优势。
摘要由CSDN通过智能技术生成

摘要171244598_1_20190917091407316原文链接:

blog.csdn.net/liweibin1994/article/details/79462554

编辑:zglg

AUC在机器学习领域中是一种模型评估指标。根据维基百科的定义,AUC(area under the curve)是ROC曲线下的面积。所以,在理解AUC之前,要先了解ROC是什么。而ROC的计算又需要借助混淆矩阵,因此,我们先从混淆矩阵开始谈起。混淆矩阵假设,我们有一个任务:给定一些患者的样本,构建一个模型来预测肿瘤是不是恶性的。在这里,肿瘤要么良性,要么恶性,所以这是一个典型的二分类问题。

假设我们用y=1表示肿瘤是良性,y=0表示肿瘤是恶性。则我们可以制作如下图的表格:如上图,TP表示预测为良性,而实际也是良性的样例数;

FN表示预测为恶性,而实际是良性的样例数;

FP表示预测为良性,而实际是恶性的样例数;

TN表示预测为恶性,而实际也是恶性的样例数;

所以,上面这四个数就形成了一个矩阵,称为混淆矩阵。

那么接下来,我们如何利用混淆矩阵来计算ROC呢?

首先我们需要定义下面两个变量:TPR表示,在所有良性肿瘤中,被预测为良性的比例。称为真阳性率。真阳性率告诉我们,随机拿一个良性的肿瘤样本时,有多大的概率会将其预测为良性肿瘤。显然我们会希望TPR越大越好。

如果以FPR为横坐标,TPR为纵坐标,就可以得到下面的坐标系:171244598_5_20190917091407519可能看到这里,你会觉得有点奇怪,用FPR和TPR分别作横纵坐标有什么用呢?我们先来考察几个特殊的点。

点(0,1)&#x

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值