神奇的“GAN”

本文详细介绍了对抗生成网络(GAN)在计算机视觉中的应用,包括面部表情驱动、图像生成和老照片修复等。GAN通过对抗式学习,能够生成新的信息,弥补数据不足的问题。文章还探讨了GAN的理论框架,以及在数据增强、虚拟偶像和手部追踪等领域的潜在应用,强调了GAN在创建符合目标分布的新样本的能力。
摘要由CSDN通过智能技术生成

原创:王稳钺
资料来源:二可

GAN最神奇的地方在于它可以生成新的信息,这是其他算法很难甚至根本就做不到的。因此,通过GAN,可以完成很多有趣的应用。本文章将从GAN在CV中的应用、GAN的理论与框架、应用GAN的实际项目和项目优化四个部分详细的介绍GAN的神奇之处。

1. 对抗生成网络(GAN)在计算机视觉(CV)中的应用

左图展示了可以通过自身的面部表情,来驱动其他物体的表情。人如何动,狗就会跟着改变。右图展示了一个瘦脸特效,这其实也可以通过GAN来实现。

通过GAN,还可以让静态的图片动起来。进而延伸,GAN也可以应用在虚拟偶像领域,可以通过算法,让三维像二维一样动起来。GAN还能非常好的完成老照片的修复。老照片通常情况下可能存在颜色失真、模糊、细节及内容缺失等问题。通过GAN,可以很好的解决这类问题。

同时,通过GAN,可以单纯的利用数据生成卡通图像,不需要经过任何的人为干预。相应的,也可以生成人脸图像。算法可以生成世界上不存在的人的人脸图像。

刚才展示的应用,都是GAN的经典应用,为什么叫经典应用呢?这些应用的主体就是GAN或者GAN的结果就是项目的最终结果。那么GAN能不能起到其他作用呢?

GAN在数据应用方面也有成熟的应用。在做一些计算机视觉的项目中,有的场景需要大量的数据。一旦涉及到利用人工智能或者深度学习等等这方面的算法的话,那么通常情况下就会需要大量的数据。但是很不幸的是,有些特殊的场景没有那么多的数据。这时,就可以利用GAN网络生成一些虚假的数据,这些虚假数据又非常像真实的数据,这样就通过算法补充了需要的数据。例如在元宇宙中,需要对人们的眼动进行追踪。不仅需要知道人的眼睛在哪,还需要判断眼睛的注视方向,这就需要大量眼睛的数据。而获得眼睛数据很困难,

  • 0
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值