<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[Hibercraft的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/Hibercraft</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; Hibercraft]]></copyright><item><title><![CDATA[极简笔记 An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale]]></title><link>https://blog.csdn.net/Hibercraft/article/details/115098522</link><guid>https://blog.csdn.net/Hibercraft/article/details/115098522</guid><author>Hibercraft</author><pubDate>Mon, 22 Mar 2021 21:04:42 +0800</pubDate><description><![CDATA[极简笔记 An Image is Worth 16x16 Words: Transformaers for Image Recognition at Scale
原文地址https://arxiv.org/abs/2010.11929
本文是第一篇将Transformer结构运用在图像分类任务的paper，方法叫做ViT(vision transformer)

做法也非常的简单，把输入图片切成多个patch，然后将各个patch拉成向量加上position embedding输入到transformer结]]></description><category></category></item><item><title><![CDATA[极简笔记 语义分割中的self-attention变种模型]]></title><link>https://blog.csdn.net/Hibercraft/article/details/100174316</link><guid>https://blog.csdn.net/Hibercraft/article/details/100174316</guid><author>Hibercraft</author><pubDate>Sat, 31 Aug 2019 16:34:12 +0800</pubDate><description><![CDATA[极简笔记 语义分割中的self-attention变种模型
Self-attention模块在近年来取得了比较不错的成功，其核心公式就是：
yi=1C(x)∑∀jf(xi,xj)g(xj)y_i=\frac{1}{\mathcal{C}(x)}\sum_{\forall j}f(x_i,x_j)g(x_j)yi​=C(x)1​∀j∑​f(xi​,xj​)g(xj​)
与以往的卷积网络项目，self...]]></description><category></category></item><item><title><![CDATA[极简笔记 多篇weakly supervised segmentation笔记]]></title><link>https://blog.csdn.net/Hibercraft/article/details/86541164</link><guid>https://blog.csdn.net/Hibercraft/article/details/86541164</guid><author>Hibercraft</author><pubDate>Fri, 18 Jan 2019 15:43:00 +0800</pubDate><description><![CDATA[极简笔记 多篇weakly supervised segmentation笔记
Backtracking ScSPM Image Classifier for Weakly Supervised Top-down Saliency

文章主要思想是通过遮挡部分区域，观察分类confidence的改变来决定pixel-level的预测。文章没有使用CNN结构，而是使用SIFT特征+稀疏编码+SVM进...]]></description><category></category></item><item><title><![CDATA[极简笔记 From Image-level to Pixel-level Labeling with Convolutional Networks]]></title><link>https://blog.csdn.net/Hibercraft/article/details/86008556</link><guid>https://blog.csdn.net/Hibercraft/article/details/86008556</guid><author>Hibercraft</author><pubDate>Mon, 07 Jan 2019 16:04:26 +0800</pubDate><description><![CDATA[极简笔记 From Image-level to Pixel-level Labeling with Convolutional Networks
本篇文章是2015年的一篇依赖image-level标注的语义分割弱监督文章。文章主要流程是先让图片经过一个普通CNN，得到一个score map（相当于分割网络最后的预测结果，几个类别就几个channel），然后将每个类别的score进行集合，这里作...]]></description><category></category></item><item><title><![CDATA[极简笔记 The Lovasz-Softmax loss: A tractable surrogate for the optimization of the intersection-over-un]]></title><link>https://blog.csdn.net/Hibercraft/article/details/85807808</link><guid>https://blog.csdn.net/Hibercraft/article/details/85807808</guid><author>Hibercraft</author><pubDate>Fri, 04 Jan 2019 23:20:40 +0800</pubDate><description><![CDATA[极简笔记 The Lovasz-Softmax loss: A tractable surrogate for the optimization of the intersection-over-union measure in neural networks
本文提出一种Lovasz-Softmax loss，专门正对分割任务的评价指标IoU进行优化设计。由于本文涉及到的数学概念超出所学知识，因...]]></description><category></category></item><item><title><![CDATA[极简笔记 Multi-Scale Context Intertwining for Semantic Segmentation]]></title><link>https://blog.csdn.net/Hibercraft/article/details/84866829</link><guid>https://blog.csdn.net/Hibercraft/article/details/84866829</guid><author>Hibercraft</author><pubDate>Thu, 06 Dec 2018 23:00:12 +0800</pubDate><description><![CDATA[极简笔记 Multi-Scale Context Intertwining for Semantic Segmentation
本文提出MSCI语义分割算法，在PASCAL VOC 2012 test集上目前是top5算法（第一名是用了JFT的deeplabv3+）。区别于传统FCN架构，本文的分割结果融合了网络特征与传统分割算法，通过LSTM进行融合。
文章大致流程如下：


利用传统分割算法预...]]></description><category></category></item><item><title><![CDATA[极简笔记 A Variational U-Net for Conditional Appearance and Shape Generation]]></title><link>https://blog.csdn.net/Hibercraft/article/details/84587019</link><guid>https://blog.csdn.net/Hibercraft/article/details/84587019</guid><author>Hibercraft</author><pubDate>Wed, 28 Nov 2018 16:49:10 +0800</pubDate><description><![CDATA[极简笔记 A Variational U-Net for Conditional Appearance and Shape Generation
本文利用条件变分自编码器（CVAE），输入一张人体图片和目标姿态，生成目标姿态的合成人体图片，并保留原图的appearance信息。 记输入图片xxx, 姿态信息yyy, 表观信息zzz, 网络结构如下图：

VAE部分通过输入图像和图像中对应姿态学习a...]]></description><category></category></item><item><title><![CDATA[极简笔记 A Survey on Transfer Learning]]></title><link>https://blog.csdn.net/Hibercraft/article/details/81877456</link><guid>https://blog.csdn.net/Hibercraft/article/details/81877456</guid><author>Hibercraft</author><pubDate>Mon, 20 Aug 2018 20:38:50 +0800</pubDate><description><![CDATA[极简笔记 A Survey on Transfer Learning

论文地址：https://ieeexplore.ieee.org/document/5288526/

本文是香港科技大学杨强教授最出名的迁移学习survey。文章发表于2010年，对深度学习时代之前的传统迁移学习方法进行了总结归纳。本篇笔记侧重结合survey观点（并非原文翻译），梳理迁移学习概念，文章涉及的相关算法请阅读原...]]></description><category></category></item><item><title><![CDATA[极简笔记 CornerNet: Detecting Objects as Paired Keypoints]]></title><link>https://blog.csdn.net/Hibercraft/article/details/81637451</link><guid>https://blog.csdn.net/Hibercraft/article/details/81637451</guid><author>Hibercraft</author><pubDate>Mon, 13 Aug 2018 21:27:38 +0800</pubDate><description><![CDATA[极简笔记 CornerNet: Detecting Objects as Paired Keypoints

论文地址：https://arxiv.org/abs/1808.01244

文章核心提出利用关键点定位方式定位物体bbox的左上角点和右下角点，从而完全摆脱利用anchor提取proposal的two stage检测框架。 
 
文章使用网络结构如图所示，首先使用hourglass作为b...]]></description><category></category></item><item><title><![CDATA[极简笔记 AlphaPose]]></title><link>https://blog.csdn.net/Hibercraft/article/details/81228163</link><guid>https://blog.csdn.net/Hibercraft/article/details/81228163</guid><author>Hibercraft</author><pubDate>Thu, 26 Jul 2018 21:34:24 +0800</pubDate><description><![CDATA[极简笔记 RMPE: Regional Multi-Person Pose Estimation

论文地址：https://arxiv.org/abs/1612.00137

本篇是上交AlphaPose文章，采用自上而下方法，目前是state-of-art，比face++在COCO2017中champion模型高了0.2个百分点。 


文章使用网络的主要架构是先RPN检测人体，然后对ROI经...]]></description><category></category></item><item><title><![CDATA[极简笔记 Unsupervised Discovery of Object Landmarks as Structural Representations]]></title><link>https://blog.csdn.net/Hibercraft/article/details/81162342</link><guid>https://blog.csdn.net/Hibercraft/article/details/81162342</guid><author>Hibercraft</author><pubDate>Mon, 23 Jul 2018 09:34:49 +0800</pubDate><description><![CDATA[Unsupervised Discovery of Object Landmarks as Structural Representations

本文的核心是提出一种无监督的方法检测物体的关键点。这个具有语义性质的关键点不是人为定义的而是自动学得的。 


文章主要思路是利用autoencoder模型，在中间部分添加各种loss约束引导检测的关键点heatmap的生成。主要架构见上图，encod...]]></description><category></category></item><item><title><![CDATA[极简笔记 segmentation + transfer learning survey第二弹]]></title><link>https://blog.csdn.net/Hibercraft/article/details/81162322</link><guid>https://blog.csdn.net/Hibercraft/article/details/81162322</guid><author>Hibercraft</author><pubDate>Mon, 23 Jul 2018 09:33:51 +0800</pubDate><description><![CDATA[极简笔记 segmentation + transfer learning survey第二弹

@(academic)[极简笔记]



Deep Extreme Cut: From Extreme Points to Object Segmentation

本文的思路非常简单，标注分割对象的极点（最上方点，最下，最左，最右），生成4 channel的极点位置高斯响应图，与输入图片concat...]]></description><category></category></item><item><title><![CDATA[极简笔记 Weakly Supervised Instance Segmentation using Class Peak Response]]></title><link>https://blog.csdn.net/Hibercraft/article/details/81043623</link><guid>https://blog.csdn.net/Hibercraft/article/details/81043623</guid><author>Hibercraft</author><pubDate>Sat, 14 Jul 2018 14:52:21 +0800</pubDate><description><![CDATA[极简笔记 Weakly Supervised Instance Segmentation using Class Peak Response

本文是一篇弱监督的工作，利用分类网络做实例分割任务。主要思路是利用网络输出的响应图，取局部极大值之后反向计算（这个过程中分辨率也在变大），得到与这个局部极大值相关的区域信息，再结合类别信息等，从利用传统算法求出的segmentation mask里面进行打...]]></description><category></category></item><item><title><![CDATA[极简笔记 Instance Segmentation Survey]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80964244</link><guid>https://blog.csdn.net/Hibercraft/article/details/80964244</guid><author>Hibercraft</author><pubDate>Sun, 08 Jul 2018 23:59:40 +0800</pubDate><description><![CDATA[极简笔记 Instance Segmentation Survey

本篇包含多篇实例分割论文笔记，因为大多都是较为早远的论文，因此每篇笔记奉行极简原则，在叙述大意的同时，尽量缩短篇幅。

Instance-aware Semantic Segmentation via Multi-task Network Cascades (MNC)

Jifeng Dai, Kaiming He较早的实例分割...]]></description><category></category></item><item><title><![CDATA[极简笔记 Taskonomy: Disentangling Task Transfer Learning]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80915789</link><guid>https://blog.csdn.net/Hibercraft/article/details/80915789</guid><author>Hibercraft</author><pubDate>Wed, 04 Jul 2018 17:15:59 +0800</pubDate><description><![CDATA[极简笔记 Taskonomy: Disentangling Task Transfer Learning

论文地址：https://arxiv.org/abs/1804.08328

本文是CVPR2018 best paper，核心是提出了一种计算不同任务相似性的方法，以及利用不同任务相似性，在少量训练数据条件下进行多任务组合学习的分配方法。

文章的终极目标，是通过计算任务相似性，进一步计算...]]></description><category></category></item><item><title><![CDATA[极简笔记 DeepLab系列比较]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80905983</link><guid>https://blog.csdn.net/Hibercraft/article/details/80905983</guid><author>Hibercraft</author><pubDate>Tue, 03 Jul 2018 23:43:18 +0800</pubDate><description><![CDATA[极简笔记 DeepLab系列比较

之前有写deeplabv3+的论文笔记，因为最近要写调研报告，就大致浏览了deeplab系列的论文，了解发展过程。本篇包含了很多其他笔记的摘要，会在最后列出。

DeepLabv1：

https://arxiv.org/pdf/1412.7062v4.pdf 
首次提出atrous conv和网络最后加CRF的操作。 
- 主要是对原有VGG网络进行了一些变换...]]></description><category></category></item><item><title><![CDATA[极简笔记 Context Encoding for Semantic Segmentation]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80724089</link><guid>https://blog.csdn.net/Hibercraft/article/details/80724089</guid><author>Hibercraft</author><pubDate>Mon, 18 Jun 2018 14:39:20 +0800</pubDate><description><![CDATA[极简笔记 Context Encoding for Semantic Segmentation

论文地址：https://arxiv.org/abs/1803.08904

文章核心贡献提出EncNet结构用于语义分割。其中主要有两点改进，在encoder-decoder结构最深层处加入context encoding module，同时引入SE-loss计算全图分类误差。 


context...]]></description><category></category></item><item><title><![CDATA[极简笔记 Pyramid Attention Network for Semantic Segmentation]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80711498</link><guid>https://blog.csdn.net/Hibercraft/article/details/80711498</guid><author>Hibercraft</author><pubDate>Sat, 16 Jun 2018 10:14:34 +0800</pubDate><description><![CDATA[极简笔记 Pyramid Attention Network for Semantic Segmentation

本文核心提出PAN，提出Feature Pyramid Attention module（FPA）和Global Attention Upsample module（GAU），引入注意力机制用于语义分割。 


文章认为现有分割ASPP模型会导致grid artifact；以及pyr...]]></description><category></category></item><item><title><![CDATA[极简笔记 Fully Convolutional Adaptation Networks for Semantic Segmentation]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80705165</link><guid>https://blog.csdn.net/Hibercraft/article/details/80705165</guid><author>Hibercraft</author><pubDate>Fri, 15 Jun 2018 14:38:13 +0800</pubDate><description><![CDATA[极简笔记 Fully Convolutional Adaptation Networks for Semantic Segmentation

文章核心贡献，提出FCAN，探究利用GTA5游戏数据集来训练语义分割网络，并将此网络迁移到真实路况场景下进行测试。 


FCAN分为两部分，Appearance Adaptation Networks（ANN）和Representation Adapta...]]></description><category></category></item><item><title><![CDATA[极简笔记 Residual Attention Network for Image Classification]]></title><link>https://blog.csdn.net/Hibercraft/article/details/80536994</link><guid>https://blog.csdn.net/Hibercraft/article/details/80536994</guid><author>Hibercraft</author><pubDate>Fri, 01 Jun 2018 14:11:55 +0800</pubDate><description><![CDATA[极简笔记 Residual Attention Network for Image Classification

论文地址：https://arxiv.org/abs/1704.06904

文章核心贡献，提出残差注意力模块结构，提升在ImageNet分类问题上的性能。 


Attention机制听起来很玄乎，在这儿其实很简单，就是feature map多出一个分支去预测权重mask，然后把这...]]></description><category></category></item></channel></rss>