自编码神经网络 c语言,自编码器 Autoencoder

最新推荐文章于 2023-10-10 12:37:15 发布

weixin_39930711

最新推荐文章于 2023-10-10 12:37:15 发布

阅读量165

点赞数

文章标签：自编码神经网络 c语言

而 VAE 实际上就是GMM的 distributed representation 的版本，先从一个高斯分布中采样出一个向量 z， z 的每个维度就表示某一种特性，再根据 z 来决定高斯分布的 μ 和 σ。由于 z 是连续的，所以有无穷多个z，就有无穷多个高斯分布(在GMM中有几个高斯就是固定的)。在z的空间中，每个点都可能被sample到，而每一个点都对应到一个不同的高斯分布。

那么如何得到 z 和高斯的 μ 和 σ之间的对应关系呢？干脆就用一个NN来描述 μ(z) 和 σ(z) 的函数关系。

所以在整个 VAE 模型中，关键不是使用 p(z)(先验分布)是正态分布的假设(z服从别的分布也可以)，而是假设 p(z | x)(后验分布)是正态分布(GMM)。

但直接这样处理的话会导致梯度更新出现问题。因为 z 要从后验分布中 sampling 得到，这种随机性会导致 encoder-decoder 不可微。所以采用 re-parameterization trick ，引入一个新的变量来表示不确定性，把采样过程移出计算图，就可以梯度更新了，而新引入的变量处理为一个 weight 固定的输入。例如下图，本来是想要从 N(x, Φ2) 中采样 z ；现在从 N(0, 1) 中采样得到 ε ，然后令 z = x + ε*Φ 即可。

回到 VAE 的目标函数。估计 μ(z) 和 σ(z) 的方法就是最大似然估计，令 μ(z) 和 σ(z) 的取值使得对手上所有的数据x的似然越大越好。

任务就是要通过极大似然估计来更新 μ(z) 和 σ(z) 这两个函数，也就是更新对应的NN参数(decoder)。此外引入一个任意的分布 q(z | x)，作用接下来再说，它也是由一个NN来表示。

接下来求解 log p(x)，先引入一个任意的分布q(z | x)再把它积掉，其中 p(x) = p(x, z)/p(z | x)，代入展开，发现对数似然函数的下界。

然后展开 Lb看如何最大化它，其中第一项为 - KL(q(z | x) || p(z))，最大化 Lb的过程中，q(z | x) 和 p(z) 的 KL散度会最小化(q(z | x) 会越来越接近 p(z))，这就是 VAE 目标函数中 Σ (exp(σi) - (1+σi) + (mi)2) 的作用。

而最大化第二项即为最大化 Eq(z | x)[logp(x | z )]，也就是给定一个 x , 根据 q(z | x) 来 sample 一个 z，然后要最大化log p(x | z) 。这就是 autoencoder 的拓扑结构的作用。因为高斯分布在均值的位置采样概率最大，所以就忽略σ(z)，让最后的 μ(z) 和数据 x 越接近越好。

VAE 的问题就是不会生成新的数据，产生的数据是训练集中已有的、最多可能也只是训练集中已经有的数据的线性组合。这是被定义在 component 层面的目标函数所限制的。

weixin_39930711

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫