[CVPR2022]FENeRF: Face Editing in Neural Radiance Fields

53 篇文章 48 订阅
11 篇文章 6 订阅

标题:FENeRF: Face Editing in Neural Radiance Fields

链接:https://arxiv.org/pdf/2111.15490

本文做的是迭代式的3D人脸重建。文章整体结构基于pi-GAN,通过分支结构让NeRF预测每个像素的语意,密度和纹理,从而构建出密集3D对齐的语意图,纹理图和密度图。进而可以通过逆映射(inversion)来编辑人脸(旋转,风格,局部变换)。

模型结构

虽然看着大不一样,但文中基础模块都是照搬的pi-GAN:使用基于siren的网络做NeRF空间,然后使用单独的mapping网络来将纹理和形状隐码转换到适合网络的空间后输入网络。其中形状隐码直接输入整个网络而纹理隐码只输入颜色分支。

其中有一点不同的是作者还从图像中提取了一个基于3D像素的特征输入颜色分支,说是可以加强颜色细节。

可以很清楚的看到,NeRF网络的输出有三个分支,分别是语意分支,密度分支,纹理分支,三个分支的输出都是点对点对齐的。最后通过体渲染得到语意图与合成图,进而用两个判别器分别做损失。

损失函数

(这里作者只列了式子,并没有详细介绍,因此只能连蒙带猜)

本文的损失函数分为三个部分,分别针对语意判别器D_s,图像判别器D_c,和生成器G。

针对D_s有最小化语意坐标与纹理坐标的距离损失,以及用于判断语意图和真实图片是否是正确的对抗损失,和一个梯度惩罚项(应该是为了避免模式崩溃)

针对D_c有判断输出图像是否真实的对抗损失,和一个梯度惩罚项

针对G有两个判别器分别产生的对抗损失,以及用于将3D脸对齐到基准姿势的相机位姿修正损失

实验

文章开头就提到,这个模型最终的目的是使得得到的3D人脸可编辑,但模型中似乎只是多提取了个语意图而已,到底怎么编辑呢?这里就用到了一种名为反演(inversion)的技巧,即给定一个GAN模型和真实图像,要求找到GAN的隐空间中这张图像对应的那组latent code,使用这组latent code就可以使得GAN生成一张和真实图像非常相似的图片。进而可以通过改变这寻找到的latent code来调整生成图像的各种特征。而文中引入了语意图真是希望借此来改变图像中的各个特征。

比如下图:

作者可以通过直接修改语意图,然后让网络反演出对应的形状隐码,然后再将形状隐码与真实图像的纹理隐码一起输入网络,生成符合对应语意图的人脸图像,最终得到这些特征被改变过的图像。

个人想法

对于图像反演我这还是第一次接触到,因此本文阅读多有困难,需要进一步补充知识。但另外有一点值得吐槽的是,这篇文章的对比实验实在是有些问题,比如图5

 作者说sofGAN的语意图预测错误,且有的图左右眼不对称,但自己的FENeRF用的根本不是人家的困难样本,而是另外挑了不同的样本测试,这能证明个什么玩意?

另外,图11中:

作者想要通过消融实验证明他的基于3D像素的特征是有效的,但问题是他三个消融实验又用的不是同一个样本,这咋对比。

另外,关于反演怎么做,文章中提都没提,但这明明是支持文章图像可编辑性的至关重要的技术,操作起来也并没有那么简单,不知道咋想的。

总而言之,个人感觉槽点颇多。

  • 6
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
### 回答1: CVPR(计算机视觉与模式识别)是计算机领域中颇具知名度的顶尖会议之一,每年都会吸引全球众多顶尖科学家和企业参会,分享最新科研成果和技术应用。2022年,CVPR会议将继续举办,本次会议将会涵盖很多领域的研究和技术应用。 根据官方发布的信息,CVPR2022的主题为“计算机视觉的进一步发展”,会议涵盖范围广泛,包括但不限于深度学习、计算机视觉、图像处理、机器学习、数据挖掘等方面的研究。 其中,会议主题包括但不限于: 1. 计算机视觉:特别关注图像和视频的理解、分割、检测和跟踪等方面。 2. 深度学习:针对对计算机视觉领域中涉及的多种深度学习技术进行深入研究,探讨其原理和优化方法。 3. 图像处理:主要关注图像生成、超分辨率、去噪以及图像重建和复原等技术。 4. 机器学习:探讨智能化和自主化技术,涉及到机器学习、增强学习、无监督学习、以及半监督学习等方面的研究和应用。 5. 数据挖掘:主要针对海量数据下的分类、聚类、降维和预处理等方面的研究,以及各种机器学习算法的实现和应用。 总之,CVPR2022是一个专注于计算机视觉和深度学习等领域的知名学术会议,各大领域的专家学者都将通过会议分享其最新成果、经验和技术进展,推动相关学科领域的发展和前进。 ### 回答2: CVPR2022是计算机视觉领域的重要国际会议,将于2022年6月19日至24日在美国纽约举行。具体来说,CVPR2022主要聚焦于深度学习、3D计算机视觉、机器学习、计算机图形学以及视觉与语言等热门前沿领域。 CVPR2022将包括口头报告、海报展示等多种形式的会议论文。此外,本次会议还将举办工业界论坛、计算机视觉教育论坛、图像生成竞赛等各种精彩纷呈的活动。 此外,在CVPR2022会议中,也将有一些分类比赛。比赛包括:视觉目标跟踪、图像分类、物体探测与分割、视觉问答、场景还原等等。这些比赛不仅考验了各个领域科学家的技术水平,而且也为人们提供了一个深入了解最前沿技术的机会,也为产业界提供了一个展示智能产品研发技术的好平台。 总之,CVPR2022是计算机视觉领域的盛事,各界专家云集,汇聚了数百篇最新的论文和客题演讲,将为大家带来前沿的研究成果和业界的最新发展,为该领域的研究进展提供有力的帮助。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值