【Loss】中心损失 Center Loss 解释

mjiansun

已于 2022-08-17 14:17:25 修改

阅读量4k

点赞数 2

分类专栏：机器学习

于 2022-08-17 14:15:16 首次发布

原文链接：https://blog.csdn.net/m0_37579232/article/details/119879646

版权

python 开发语言

机器学习专栏收录该内容

174 篇文章 41 订阅

订阅专栏

论文

A Discriminative Feature Learning Approach for Deep Face Recognition

原理

最近在看人脸表情识别论文的时候，看到了有用中心损失函数（Cemter Loss），中心损失它仅仅用来减少类内（比如说同一表情）的差异，而不能有效增大类间（比如说不同表情）的差异性。如下图所示：

　　上图中，图（a)表示softmax loss学习到的特征描述。图（b)表示softmax loss + center loss 学习到的特征描述，他能把同一表情的样本之间的距离拉近一些，使其相似性变大，尽量的往样本中心靠拢，但可以看出他没有把不同表情之间的样本距离拉大。

它的定义是这样的：

　　类中心c:每一个样本的特征需要通过一个好的网络到达特征层获得,这样计算完后所有样本的特征的平均值为类中心c,而好的网络需要是在有类中心加入的情况下才能得到...

优化过程：

没法直接获得c,所以将其放到网络里自己生成,在每一个batch里更新center.即随机初始化center,而后每一个batch里计算当前数据与center的距离,而后将这个梯度形式的距离加到center上.类似于参数修正.同样的类似于梯度下降法,这里再增加一个scale度量a,使得center不会抖动.

代码

首先上github代码：https://github.com/KaiyangZhou/pytorch-center-loss

class CenterLoss(nn.Module):
    """Center loss.
    
    Reference:
    Wen et al. A Discriminative Feature Learning Approach for Deep Face Recognition. ECCV 2016.
    
    Args:
        num_classes (int): number of classes.
        feat_dim (int): feature dimension.
    """
    def __init__(self, num_classes=10, feat_dim=2, use_gpu=True):
        super(CenterLoss, self).__init__()
        self.num_classes = num_classes
        self.feat_dim = feat_dim
        self.use_gpu = use_gpu
 
        if self.use_gpu:
            self.centers = nn.Parameter(torch.randn(self.num_classes, self.feat_dim).cuda())
        else:
            self.centers = nn.Parameter(torch.randn(self.num_classes, self.feat_dim))
 
    def forward(self, x, labels):
        """
        Args:
            x: feature matrix with shape (batch_size, feat_dim).
            labels: ground truth labels with shape (batch_size).
        """
        batch_size = x.size(0)
        distmat = torch.pow(x, 2).sum(dim=1, keepdim=True).expand(batch_size, self.num_classes) + \
                  torch.pow(self.centers, 2).sum(dim=1, keepdim=True).expand(self.num_classes, batch_size).t()
        distmat.addmm_(1, -2, x, self.centers.t())
 
        classes = torch.arange(self.num_classes).long()
        if self.use_gpu: classes = classes.cuda()
        labels = labels.unsqueeze(1).expand(batch_size, self.num_classes)
        mask = labels.eq(classes.expand(batch_size, self.num_classes))
 
        dist = distmat * mask.float()
        loss = dist.clamp(min=1e-12, max=1e+12).sum() / batch_size
 
        return loss

参数：

num_classes: 数据集类别数

feat_dim: 特征向量的维度

forward部分代码解析：

这里通过举例来说明代码，假设num_classes=6，即标签从0-5。

当前mini-batch中batch size=3，label=0,4,2，feat_dim=5

x: [B, feat_dim]=[3, 5]

使用S0, S4,S2来表示输入x中的三个特征，其中Si维度是5：

同样，centers:[num_classes, feat_dim]=[6,5]可表示为，其中Ci的维度是5：

此处代码运行得到的结果是：

distmat = torch.pow(x, 2).sum(dim=1, keepdim=True).expand(batch_size, self.num_classes) + \
                  torch.pow(self.centers, 2).sum(dim=1, keepdim=True).expand(self.num_classes, batch_size).t()

该行代码首先对x逐元素平方，再求和，左后再expand到[B,num_classes]=[3,6]维度：

对centers的操作也同理，最后，得到的distmat为：

distmat.addmm_(1, -2, x, self.centers.t())

上述代码运算为

classes = torch.arange(self.num_classes).long()
labels = labels.unsqueeze(1).expand(batch_size, self.num_classes)
mask = labels.eq(classes.expand(batch_size, self.num_classes))

该段代码意义如下：

dist = distmat * mask.float()
loss = dist.clamp(min=1e-12, max=1e+12).sum() / batch_size

dist*mask恰好保留了输入x三个特征与对应类中心的距离平方，最后的距离之和为：

最后，clamp使其在[1e-12,1e+12]的范围内。

使用场景

同一类里的样本差异不是太大的情况下应该用CenterLoss效果应该会好

mjiansun

关注

2
点赞
踩
37

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录