Learning Deep Representations of Fine-Grained Visual Descriptions

78 篇文章 0 订阅
36 篇文章 0 订阅

CVPR2016
Learning Deep Representations of Fine-Grained Visual Descriptions

code: https://github.com/reedscot/cvpr2016

本文提出了一个模型,可以用来干什么了?就是给你一句话,搜出满足这句话的图像

这里写图片描述

怎么实现这个目标了?
这里写图片描述

分别对图像 和 语句使用 CNN网络,提取出对应的特征,然后结合起来,给出每个图像满足这句话的概率。如上图所示,语义信息是 The beak is yellow and pointed。 使用 CNN网络对 每个图像提取特征,然后计算出每个图像满足该语义信息的概率。

本文主要提出了一个新的 CNN模型来提取语义信息特征的。如下图所示:

这里写图片描述

这里主要是将 recurrent models and CNNs 结合起来,先使用CNN提特征,再将特征给 recurrent models,如上图所示。

结果如下图所示:

这里写图片描述

这里写图片描述

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值