CNN与图像应用

本文探讨了CNN在图像识别与定位、物体识别以及图像分割等领域的应用。从分类和定位任务开始,介绍通过神经网络解决图像问题的两种思路:回归问题解决方法和图窗+识别与整合策略。此外,还提及了物体识别的发展历程,从R-CNN到YOLO/SSD,以及图像分割的两个主要方面:语义分割和反卷积。
摘要由CSDN通过智能技术生成

一、图像识别与定位

  0.Classification:C个类别

   Input:Image

   Output:类别标签

   Evaluation metric:准确率

  1.Localization:

    Input:Image

    Output:物体边界框(xy,w,h)

    Evaluation mertric:交并准则

  3.Classification+Localization:识别主题+定位

    4.ImageNet:实际上有   识别+定位  2个任务

  5.思路1:视作回归问题

    (1)先解决简单问题,搭建一个识别图像的神经网络

    (2)在AlexNet VGG GoogleLenet ResNet上fine-tun一下

    (3)步骤2:在上述神经网络的尾部展开,称为classification+regresssion模式

    (4)步骤3:回归部分(Regression)用欧氏距离损失;使用SGD(随机梯度下降)训练

    

    (5)Regression(回归)的模块部分加在什么位置

      最后的卷积层后;全连接层后

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值