在模式识别和信息检索领域,二分类的问题(binary classification)是常会遇到的一类问题。例如,银行的信用卡中心每天都会收到很多的信用卡申请,银行必须根据客户的一些资料来预测这个客户是否有较高的违约风险,并据此判断是否要核发信用卡给该名客户。显然“是否会违约”就是一个二分类的问题。
如果你已经根据训练数据建立了一个模型,接下来你会用一些测试数据来评估你模型的效果,即 Evaluate model on held-out(留存) test data。通常你可能会考虑的评估指标主要有
- Accuracy
- Precision
- Recall
- F1 Score
但是这些指标常常令人混淆不清,下面我们逐个介绍并加以辨析。作为一个例子,来看表中这组分类结果