原创:王稳钺
资料来源:二可
GAN最神奇的地方在于它可以生成新的信息,这是其他算法很难甚至根本就做不到的。因此,通过GAN,可以完成很多有趣的应用。本文章将从GAN在CV中的应用、GAN的理论与框架、应用GAN的实际项目和项目优化四个部分详细的介绍GAN的神奇之处。
1. 对抗生成网络(GAN)在计算机视觉(CV)中的应用
左图展示了可以通过自身的面部表情,来驱动其他物体的表情。人如何动,狗就会跟着改变。右图展示了一个瘦脸特效,这其实也可以通过GAN来实现。
通过GAN,还可以让静态的图片动起来。进而延伸,GAN也可以应用在虚拟偶像领域,可以通过算法,让三维像二维一样动起来。GAN还能非常好的完成老照片的修复。老照片通常情况下可能存在颜色失真、模糊、细节及内容缺失等问题。通过GAN,可以很好的解决这类问题。
同时,通过GAN,可以单纯的利用数据生成卡通图像,不需要经过任何的人为干预。相应的,也可以生成人脸图像。算法可以生成世界上不存在的人的人脸图像。
刚才展示的应用,都是GAN的经典应用,为什么叫经典应用呢?这些应用的主体就是GAN或者GAN的结果就是项目的最终结果。那么GAN能不能起到其他作用呢?
GAN在数据应用方面也有成熟的应用。在做一些计算机视觉的项目中,有的场景需要大量的数据。一旦涉及到利用人工智能或者深度学习等等这方面的算法的话,那么通常情况下就会需要大量的数据。但是很不幸的是,有些特殊的场景没有那么多的数据。这时,就可以利用GAN网络生成一些虚假的数据,这些虚假数据又非常像真实的数据,这样就通过算法补充了需要的数据。例如在元宇宙中,需要对人们的眼动进行追踪。不仅需要知道人的眼睛在哪,还需要判断眼睛的注视方向,这就需要大量眼睛的数据。而获得眼睛数据很困难,