pytorch中model.train()和model.eval()的区别

最新推荐文章于 2024-05-24 16:17:48 发布

想念@思恋

最新推荐文章于 2024-05-24 16:17:48 发布

阅读量5.1k

点赞数 3

分类专栏： pytorch 文章标签： pytorch 神经网络深度学习

本文链接：https://blog.csdn.net/tailonh/article/details/111213211

版权

pytorch 专栏收录该内容

47 篇文章 2 订阅

订阅专栏

model.train()和model.eval()的区别主要在于Batch Normalization和Dropout两层。

1、model.train()和model.eval()对应的源代码，如下所示，但是仅仅关注这一部分是不够的，现在需要记住当前的self.training的值是True还是False。

    def train(self, mode=True):
        r"""Sets the module in training mode.

        This has any effect only on certain modules. See documentations of
        particular modules for details of their behaviors in training/evaluation
        mode, if they are affected, e.g. :class:`Dropout`, :class:`BatchNorm`,
        etc.

        Returns:
            Module: self
        """
        self.training = mode
        for module in self.children():
            module.train(mode)
        return self
       
	 def eval(self):
        return self.train(False)

2、下边以Dropout为例，进入其对应的源代码，下方对应的self.training就是第一步中的self.training，原因在于Dropout继承了 _DropoutNd类，而 _DropoutNd由继承了Module类，Module类中自带变量self.training，通过这种方法，来控制train/eval模型下是否进行Dropout。

class Dropout(_DropoutNd):
    '''
    	balabala
    '''

    @weak_script_method
    def forward(self, input):
        return F.dropout(input, self.p, self.training, self.inplace)

注：
如果模型中有BN层(Batch Normalization）和Dropout，在测试时添加model.eval()。model.eval()是保证BN层能够用全部训练数据的均值和方差，即测试过程中要保证BN层的均值和方差不变。对于Dropout，model.eval()是利用到了所有网络连接，即不进行随机舍弃神经元。

想念@思恋

关注

3
点赞
踩
10

收藏

觉得还不错? 一键收藏
3
评论
pytorch中model.train()和model.eval()的区别

model.train()和model.eval()的区别主要在于Batch Normalization和Dropout两层。1、model.train()和model.eval()对应的源代码，如下所示，但是仅仅关注这一部分是不够的，现在需要记住当前的self.training的值是True还是False。 def train(self, mode=True): r"""Sets the module in training mode. This has.
复制链接

扫一扫

专栏目录