<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[Hungryof的专栏]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/Hungryof</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; Hungryof]]></copyright><item><title><![CDATA[合并多个bibtex]]></title><link>https://blog.csdn.net/Hungryof/article/details/140034308</link><guid>https://blog.csdn.net/Hungryof/article/details/140034308</guid><author>Hungryof</author><pubDate>Fri, 28 Jun 2024 09:55:00 +0800</pubDate><description><![CDATA[合并多个Bibtex]]></description><category></category></item><item><title><![CDATA[剔除文件夹中无效图片--支持文件夹中有中文名称（或特殊符号）--且保持目录结构]]></title><link>https://blog.csdn.net/Hungryof/article/details/130061060</link><guid>https://blog.csdn.net/Hungryof/article/details/130061060</guid><author>Hungryof</author><pubDate>Mon, 10 Apr 2023 15:26:31 +0800</pubDate><description><![CDATA[python过滤无法读取的图片]]></description><category></category></item><item><title><![CDATA[最大化互信息]]></title><link>https://blog.csdn.net/Hungryof/article/details/119897636</link><guid>https://blog.csdn.net/Hungryof/article/details/119897636</guid><author>Hungryof</author><pubDate>Tue, 24 Aug 2021 20:11:25 +0800</pubDate><description><![CDATA[总说
因为，一般做分类的，交叉熵很常见吧，类似KL散度或者交叉熵，本质上就是利用“编码长度”作文章。比如KL散度就是，不完美的概率qqq去编码完美信息条件下的概率ppp，从而多需要的编码长度。这种都是利用直接预测的某件事情的概率去做的。
比如，我需要预测这张图是不是猫，预测的猫的概率为 p(x)p(x)p(x)，对吧，就是表示独立事件的本身。
某些情况下，有两个事件，一个事件的发生可以去预测另外一个事件的概率，就是条件概率。互信息衡量两个变量的依赖程度，可以理解为给定其中一个变量，可以多大程度的减少另一个变]]></description><category></category></item><item><title><![CDATA[Pytorch学习(二十九) ------------torch.split与torch.roll结合进行的一种高端操作]]></title><link>https://blog.csdn.net/Hungryof/article/details/113850339</link><guid>https://blog.csdn.net/Hungryof/article/details/113850339</guid><author>Hungryof</author><pubDate>Thu, 18 Feb 2021 17:40:23 +0800</pubDate><description><![CDATA[How to reverse a multi-hot encoding ?
multihot_batch = torch.tensor([[0,1,0,1], [0,0,0,1], [0,0,1,1]])
(multihot_batch == torch.tensor(1)).nonzero()
tensor([[0, 1],
        [0, 3],
        [1, 3],
        [2, 2],
        [2, 3]])

希望得到
[[1, 3],
[3],
[2, 3]]]></description><category></category></item><item><title><![CDATA[transformer的一种加速方法Informer---- 稀疏化quary Q的方法]]></title><link>https://blog.csdn.net/Hungryof/article/details/111992624</link><guid>https://blog.csdn.net/Hungryof/article/details/111992624</guid><author>Hungryof</author><pubDate>Wed, 30 Dec 2020 17:38:26 +0800</pubDate><description><![CDATA[论文：Informer: Beyond Efficient Transformer for Long Sequence Time-Series Forecasting
transformer主要是增强网络的全局信息利用能力。因为普通的卷积网络都是local信息利用，其在全局信息利用上存在不可避免的短板。所以才会有类似non-local attn的存在。 transformer里面的核心就是attn，
一般来说，A(qi,K,V)=Softmax(QKTd)V\mathcal{A}(\mathbf{q}_i,]]></description><category></category></item><item><title><![CDATA[最优传输之浅谈]]></title><link>https://blog.csdn.net/Hungryof/article/details/110549879</link><guid>https://blog.csdn.net/Hungryof/article/details/110549879</guid><author>Hungryof</author><pubDate>Thu, 03 Dec 2020 20:18:04 +0800</pubDate><description><![CDATA[总说
最近最优传输很火啊，而且用处很大。这里简单记录，到底讲了啥问题，以及解法和应用。
简单理解：其实就是把 AAA数据迁移到BBB上，当然了。你可以理解成两堆土，从AAA土铲到另外一个地方，最终堆成BBB土。就像是以前初中学的线性规划一样的：我3个城市（A, B, C）有1, 0.5, 1.5吨煤，然后要运到2个其他城市，这两个城市(C, D)分别需要2，1吨煤。然后当然，不同城市到不同的费用不同，让你算最优运输方案和代价。
基本概念
Probability vector / Histogram （概率向]]></description><category></category></item><item><title><![CDATA[Pytorch 学习 (二十八）----- 多GPU使用时的一个注意事项]]></title><link>https://blog.csdn.net/Hungryof/article/details/108829401</link><guid>https://blog.csdn.net/Hungryof/article/details/108829401</guid><author>Hungryof</author><pubDate>Sun, 27 Sep 2020 15:40:45 +0800</pubDate><description><![CDATA[总说
有时候，我们构建一种中间特征的loss。需要拿到feature，然后这个 feature 和 target_feat 比较。不要直接在model的forward中求loss，否则只能在单GPU上跑。而是最终将feature和target_feat都返回，在train里面，此时这些返回的 feat会自动变成 主GPU上的tensor，从而不会有tensor不在同一个device的问题。

...]]></description><category></category></item><item><title><![CDATA[Pytorch学习（二十七）-------- 针对不均衡数据集的重采样Resample]]></title><link>https://blog.csdn.net/Hungryof/article/details/107609877</link><guid>https://blog.csdn.net/Hungryof/article/details/107609877</guid><author>Hungryof</author><pubDate>Mon, 27 Jul 2020 13:40:36 +0800</pubDate><description><![CDATA[总说
针对类别数目不均匀的数据，有些类图片多，有些少，如果直接训练，那么就会造成过拟合类别多的数据。最简单的方法就是重采样，直接根据每一类的数目，来重新分配权重。你想想，普通肯定是均匀概率采样的，自然数目多的图片，采样到的概率就大。
神奇的 WeightedRandomSampler
直接丢代码
# 数据集中，每一类的数目。
 class_sample_counts = [150, 200, 300]
 weights = 1./ torch.tensor(class_sample_counts, dtyp]]></description><category></category></item><item><title><![CDATA[神经关系推断 NRI: Neural Relational Inference for Interacting Systems初探（附加了一小部分VAE）]]></title><link>https://blog.csdn.net/Hungryof/article/details/107543329</link><guid>https://blog.csdn.net/Hungryof/article/details/107543329</guid><author>Hungryof</author><pubDate>Thu, 23 Jul 2020 18:01:38 +0800</pubDate><description><![CDATA[总说
作为从来没有接触过序列预测的我来说，看到这个是有点难度哈。然而经过我钻研了几天，终于基本看明白。太有意思了！！！！！！！！！！！！！
论文主要是，根据已有的数据，显示地估计出内在的离散的graph结构，用graph结构作为引导，更好的进行序列预测，而且全程是无监督的方式，来获得graph。
其实普通的预测序列的模型，比如LSTM之类的也可以预测，这种方法是隐式学习graph的方法。
另外，稍微说一句：由于encoder要预测的graph是一个概率分布（就是每个节点右边的概率），但是预测出来的就只能是离]]></description><category></category></item><item><title><![CDATA[PATH删除指定路径]]></title><link>https://blog.csdn.net/Hungryof/article/details/106550490</link><guid>https://blog.csdn.net/Hungryof/article/details/106550490</guid><author>Hungryof</author><pubDate>Thu, 04 Jun 2020 16:41:33 +0800</pubDate><description><![CDATA[别问啥情况会想要这操作，但是我遇到了。
下面代码，加入类似 .bashrc中就行。
直接删除 指定路径。
 echo "ori path"
 echo $PATH

 export PATH=$(p=$(echo $PATH | tr ":" "\n" | grep -v "/home/xxx/anaconda3/bin" | tr "\n" ":"); echo ${p%:})

 echo "-----------NOW---------"
 echo $PATH



...]]></description><category></category></item><item><title><![CDATA[Gumbel-Max trick或者reparameterization]]></title><link>https://blog.csdn.net/Hungryof/article/details/106472341</link><guid>https://blog.csdn.net/Hungryof/article/details/106472341</guid><author>Hungryof</author><pubDate>Mon, 01 Jun 2020 15:10:00 +0800</pubDate><description><![CDATA[总说
下面主要摘自链接文章。
参考链接：
https://www.zhihu.com/question/62631725/answer/507940806
知道一个离散随机变量X的分布，
比如说p(X=1)=p1=0.2,p(X=2)=p2=0.3,p(X=3)=p2=0.5，然后我们想得到一些服从这个分布的离散的x的值。
但是，采样了之后都是离散值，没法对 p1, p2, p3求导，则神经网络中就没法 BP。这是因为，很多时候我们只是要x的期望，那么我们就是x=p1+2p2+3p3，x对p1,p2,p3的]]></description><category></category></item><item><title><![CDATA[Pytorch学习 （二十六）---- torch.scatter的使用]]></title><link>https://blog.csdn.net/Hungryof/article/details/106264591</link><guid>https://blog.csdn.net/Hungryof/article/details/106264591</guid><author>Hungryof</author><pubDate>Thu, 21 May 2020 19:00:06 +0800</pubDate><description><![CDATA[总说
一个非常有用的函数，主要是用于“group index”的操作。
from torch_scatter import scatter
import torch

src = (torch.rand(2, 6, 2)*4).int()
index = torch.tensor([0, 1, 0, 1, 2, 1])

# Broadcasting in the first and last dim.
out = scatter(src, index, dim=1, reduce="sum")

prin]]></description><category></category></item><item><title><![CDATA[Pytorch 学习（二十五）---高级DataLoader技巧----每次返回的Tensor的size可以任意]]></title><link>https://blog.csdn.net/Hungryof/article/details/105717728</link><guid>https://blog.csdn.net/Hungryof/article/details/105717728</guid><author>Hungryof</author><pubDate>Thu, 23 Apr 2020 21:39:42 +0800</pubDate><description><![CDATA[总说
大家都知道，默认的DataLoader每次返回的Tensor的尺寸都是固定的，因为batchsize&gt;1时，默认需要stack一下，比如__getitem__()返回的图片return img，其中img是 CHW, 你在外面拿到就是 N*C*H*W了。因为，默认return torch.stack(batch, 0, out=out)了一下。如果每次img图片不一样，就会出错。
有些...]]></description><category></category></item><item><title><![CDATA[Pytorch 学习（二十四）----- 高级Tensor技巧(Advanced Indexing等多种操作）]]></title><link>https://blog.csdn.net/Hungryof/article/details/104371012</link><guid>https://blog.csdn.net/Hungryof/article/details/104371012</guid><author>Hungryof</author><pubDate>Tue, 18 Feb 2020 11:04:10 +0800</pubDate><description><![CDATA[总说
这里记录一些比较难的操作：
Advanced Indexing 可以用于赋值
import torch
a = torch.rand(5,5)
x_indice = torch.LongTensor([1, 3, 4])
y_indice = torch.LongTensor([2, 1, 1])
value_put = torch.rand(3)*10
print('Before')
pr...]]></description><category></category></item><item><title><![CDATA[ICCV 2019几篇自己感兴趣的论文阅读]]></title><link>https://blog.csdn.net/Hungryof/article/details/103179806</link><guid>https://blog.csdn.net/Hungryof/article/details/103179806</guid><author>Hungryof</author><pubDate>Thu, 21 Nov 2019 11:41:27 +0800</pubDate><description><![CDATA[总说
只是随意看了看名字，下载了几篇论文读读，方向很局限。（待更新，最近更新 2019-11-21）
Content and Style Disentanglement for Artistic Style Transfer

]]></description><category></category></item><item><title><![CDATA[/lib64/libstdc++.so.6: version `CXXABI_1.3.9' not found]]></title><link>https://blog.csdn.net/Hungryof/article/details/102854316</link><guid>https://blog.csdn.net/Hungryof/article/details/102854316</guid><author>Hungryof</author><pubDate>Fri, 01 Nov 2019 11:28:42 +0800</pubDate><description><![CDATA[如果跑anaconda时基本出现这个问题，说是required by matplotlib,
那么说明没有吧anconda的 lib加入进去
 export PATH="/home/zhaoyi.yzy/anaconda3/bin:$PATH"
 # add this lib, then ok
 export LD_LIBRARY_PATH="/usr/local/lib64/:$LD_LIBRA...]]></description><category></category></item><item><title><![CDATA[SuperPixel 的样例代码]]></title><link>https://blog.csdn.net/Hungryof/article/details/102664311</link><guid>https://blog.csdn.net/Hungryof/article/details/102664311</guid><author>Hungryof</author><pubDate>Mon, 21 Oct 2019 15:08:35 +0800</pubDate><description><![CDATA[总说
这个给自己看的，对读者应该没啥用。。
超像素的例子
import sys
import os
import cv2
import numpy as np
import math

img = cv2.imread('people.png')

#------------- SP Generation -------------------------
num_superpixels = 50...]]></description><category></category></item><item><title><![CDATA[蒙特卡罗求定积分]]></title><link>https://blog.csdn.net/Hungryof/article/details/101019092</link><guid>https://blog.csdn.net/Hungryof/article/details/101019092</guid><author>Hungryof</author><pubDate>Thu, 19 Sep 2019 13:24:41 +0800</pubDate><description><![CDATA[计算积分：
∫abh(x)dx\int_{a}^{b}h(x)dx∫ab​h(x)dx
如果h(x)h(x)h(x)的原函数不好计算，这里可以将h(x)h(x)h(x)分解成两个函数的乘积，比如 h(x)=h(x)p(x)∗p(x)h(x)=\frac{h(x)}{p(x)}* p(x)h(x)=p(x)h(x)​∗p(x)。 有：
∫abh(x)dx=∫abh(x)p(x)p(x)dx=Ep(x...]]></description><category></category></item><item><title><![CDATA[Pytorch学习（二十三）---- 不同layer用不同学习率（高级版本）]]></title><link>https://blog.csdn.net/Hungryof/article/details/100313525</link><guid>https://blog.csdn.net/Hungryof/article/details/100313525</guid><author>Hungryof</author><pubDate>Mon, 02 Sep 2019 17:01:00 +0800</pubDate><description><![CDATA[简易版本,
pytorch文档上，不同层用不同学习率，可以用这个。
optim.SGD([
                {'params': model.base.parameters()},
                {'params': model.classifier.parameters(), 'lr': 1e-3}
            ], lr=1e-2, momentu...]]></description><category></category></item><item><title><![CDATA[NVIDIA NVML Driver/library version mismatch]]></title><link>https://blog.csdn.net/Hungryof/article/details/99233087</link><guid>https://blog.csdn.net/Hungryof/article/details/99233087</guid><author>Hungryof</author><pubDate>Sun, 11 Aug 2019 21:30:24 +0800</pubDate><description><![CDATA[卸载现有版本的cuda，装其他版本的。
其实只要直接remove 文件即可。比如
sudo rm -r /usr/local/cuda-9.0
sudo rm -r /usr/local/cuda

然后，重装cuda。可能会出现NVIDIA NVML Driver/library version mismatch问题。
lsmod | grep nvidia

比如出现下面4个：
nvidia_...]]></description><category></category></item></channel></rss>