数据挖掘实训 Week 1

本文介绍了数据挖掘中混淆矩阵的概念,包括真正类TP、假负类FN、假正类FP和真负类TN。接着探讨了ROC曲线,解释了假正例率FPR和真正例率TPR的定义,并强调了AUC作为衡量检测方法真实性的指标,其值在0.5到1之间,AUC越高,真实性越强。实践中,作者进行了baseline方案的数据预处理步骤。
摘要由CSDN通过智能技术生成

理论学习

  • 混淆矩阵(Confuse Matrix)
    • 若一个实例是正类,并且被预测为正类,即为真正类TP(True Positive )
    • 若一个实例是正类,但是被预测为负类,即为假负类FN(False Negative )
    • 若一个实例是负类,但是被预测为正类,即为假正类FP(False Positive )
    • 若一个实例是负类,并且被预测为负类,即为真负类TN(True Negative )
  • ROC(Receiver Operating Characteristic)
    ROC空间将假正例率(FPR)定义为 X 轴,真正例率(TPR)定义为 Y 轴。
    TPR:在所有实际为正例的样本中,被正确地判断为正例之比率。 T P R = T P T
  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值