YOLO论文的概括理解

论文题目:You Only Look Once: Unified, Real-Time Object Detection

论文地址:https://arxiv.org/abs/1506.02640

RCNN系列都是先生成候选区域,在对候选区域进行分类回归,YOLO提出了一种不同方式,直接像CNN分类那样进行端到端的网络。输入一整张图片经过YOLO以后输出98个候选框的移动量,与属于哪一类的概率。

 

将输入图片划分成7*7个grid cell,每个grid cell 预测两个bbox。一共就有49个grid cell,所以一共预测98个。为什么要说这些呢?因为期望的输出是通过这些grid cell产生的。即损失函数里面的标记值是GT与grid cell一起产生的。

具体请看原文。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值