计算机视觉+深度学习面试笔试题整理

最新推荐文章于 2024-05-22 22:37:21 发布

fpga和matlab

最新推荐文章于 2024-05-22 22:37:21 发布

阅读量1.8k

点赞数 2

分类专栏： ★求职1:深度学习/FPGA/机器视觉/算法手撕代码文章标签：计算机视觉深度学习 python 职场和发展面试

本文链接：https://blog.csdn.net/ccsss22/article/details/126529991

版权

★求职1:深度学习/FPGA/机器视觉/算法手撕代码专栏收录该内容

127 篇文章 54 订阅 ¥39.90 ¥99.00

订阅专栏

本文深入探讨了计算机视觉和深度学习面试中的关键概念，包括BN层的原理和加速训练的作用，NMS（非极大值抑制）在目标检测中的应用，以及ReLU函数的使用和优势。BN层通过标准化数据分布加速训练，防止梯度消失，增强模型泛化能力。NMS用于抑制非最佳检测框，基于IOU进行选择。ReLU函数因其简洁性和缓解梯度消失问题而广泛使用。此外，文章还讨论了CNN中pooling层的作用，图像预处理的必要性，以及卷积层与全连接层的区别。

摘要由CSDN通过智能技术生成

1.BN层的原理和作用？

讲解BN之前，我们需要了解BN是怎么被提出的。在机器学习领域，数据分布是很重要的概念。如果训练集和测试集的分布很不相同，那么在训练集上训练好的模型，在测试集上应该不奏效（比如用ImageNet训练的分类网络去在灰度医学图像上finetune再测试，效果应该不好）。对于神经网络来说，如果每一层的数据分布都不一样，后一层的网络则需要去学习适应前一层的数据分布，这相当于去做了domain的adaptation，无疑增加了训练难度，尤其是网络越来越深的情况。

实际上，确实如此，不同层的输出的分布是有差异的。BN的那篇论文中指出，不同层的数据分布会往激活函数的上限或者下限偏移。论文称这种偏移为**internal Covariate Shift**，internal指的是网络内部。神经网络一旦训练起来，那么参数就要发生更新，除了输入层的数据外(因为输入层数据，我们已经人为的为每个样本归一化)，后面网络每一层的输入数据分布是一直在发生变化的，因为在训练的时候，前面层训练参数的更新将导致后面层输入数据分布的变化。以网络第二层为例：网络的第二层输入，是由第一层的参数和input计算得到的，而第一层的参数在整个训练过程中一直在变化，因此必然会引起后面每一层输入数据分布的改变, 第一层输出变化了，势必会引起第二层输入分布的改变，模型拟合的效果就会变差，也会影响模型收敛的速度（例如我原本的参数是拟合分布A的，然后下一轮更新的时候，样本都是来自分布B的，对于这组参数来说，这些样本就会很陌生），BN就是为了解决偏移的，解决的方式也很简单，就是

了解本专栏

fpga和matlab

关注

2
点赞
踩
6

收藏

觉得还不错? 一键收藏
打赏
0
评论
计算机视觉+深度学习面试笔试题整理

讲解BN之前，我们需要了解BN是怎么被提出的。在机器学习领域，数据分布是很重要的概念。如果训练集和测试集的分布很不相同，那么在训练集上训练好的模型，在测试集上应该不奏效（比如用ImageNet训练的分类网络去在灰度医学图像上finetune再测试，效果应该不好）。对于神经网络来说，如果每一层的数据分布都不一样，后一层的网络则需要去学习适应前一层的数据分布，这相当于去做了domain的adaptation，无疑增加了训练难度，尤其是网络越来越深的情况。实际上，确实如此，不同层的输出的分布是有差
复制链接

扫一扫