变分自编码器 (VAE) 解释:从理论到 ELBO 以及重新参数化技巧

清晰、以数学为先的 VAE 如何学习生成新数据后变分自编码器 (VAE) 解释:从理论到 ELBO 和重新参数化技巧首先出现在《走向数据科学》上。

来源:走向数据科学

简介

。它们在瓶颈内压缩数据的能力使它们能够比其他方式更有效地解决下游任务,从而避免处理高维输入数据所需的过多计算。

此外,我们在有关自动编码器的文章中看到它们可以用于解决其他计算机视觉任务,例如图像去噪、对象去除或图像修复。

还不熟悉自动编码器?我制作了一个视频来介绍它们:

虽然普通自动编码器可能看起来很强大,但它们仍然有一些可以改进的限制。鉴于此,研究人员开发了一种更高级的版本,称为变分自动编码器。我们将在本文中研究它们。

动机

在上一篇文章中,我们主要讨论了数据压缩作为自动编码器的主要应用。事实上,我们还可以看看其他有趣的方面。

相似度

如果您进行实验并尝试计算潜在空间中对象之间的距离,您会发现,在许多情况下,对象之间的相似性属性并没有像其他常见嵌入算法那样得到相同程度的保留。发生这种情况是因为,在训练期间,模型主要关注重建原始图像,而不是潜在空间内的内部表示。

例如,如果您拍摄两个相似的图像并将它们传递到学习的自动编码器中,则它们在潜在空间中可能比其他算法更不接近。对于可以彼此靠近的不同物体也是如此。因此,相似性保留是普通自动编码器的弱点。

图像生成

解码器非常擅长重建原始图像。因此,引起许多研究人员关注的一个问题是,利用自动编码器架构是否可以生成高质量的新图像。

方法

我们已经有两个不同的空间:

近似思路

ELBO*