CVPR最有趣论文 | 再模糊的照片AI都可以可以恢复

人工智能
大量的实验表明,新方法在合成数据集和真实数据集上都取得了优于现有技术的性能。

生活中,我们都会遇到图片模糊状态下,很早之前我们是不可能恢复;之后通过PS进行修复,也会有畸形或者差异的表现;但是,现在AI可以准确完整的恢复出blind face。

一、简要

B lind face 通常依赖于facial priors,如facial geometry prior或reference prior,来恢复现实和真实的细节。然而,当高质量的参考无法访问时,非常低质量的输入不能提供精确的几何先验,这限制了在现实场景中的适用性。

所以,有研究者提出了GFP-GAN,它利用封装在预先训练好的人脸GAN中的丰富多样的先验来进行blind face恢复。该Generative Facial Prior(GFP)通过新的信道分裂空间特征变换层融入到人脸修复过程中,使新方法能够实现真实度和保真度的良好平衡。由于强大的 GFP 和精细的设计,GFP-GAN可以通过一次共同恢复面部细节和增强颜色,而GAN inversion methods在推理时需要昂贵的特定图像优化。大量的实验表明,新方法在合成数据集和真实数据集上都取得了优于现有技术的性能。

二、效果先知道

HiFaceGAN [ 69 ]: Lingbo Yang, Chang Liu, Pan Wang, Shanshe Wang, Peiran Ren, Siwei Ma, and Wen Gao. Hifacegan: Face renovation via collaborative suppression and replenishment. ACM Multimedia, 2020

DFDNet [ 46 ]: Xiaoming Li, Chaofeng Chen, Shangchen Zhou, Xianhui Lin, Wangmeng Zuo, and Lei Zhang. Blind face restoration via deep multi-scale component dictionaries. In ECCV, 2020

Wan et al. [ 63 ]: Ziyu Wan, Bo Zhang, Dongdong Chen, Pan Zhang, Dong Chen, Jing Liao, and Fang Wen. Bringing old photos back to life. In CVPR, 2020

PULSE [ 54 ]: Sachit Menon, Alexandru Damian, Shijia Hu, Nikhil Ravi, and Cynthia Rudin. Pulse: Self-supervised photo upsampling via latent space exploration of generative models. In CVPR, 2020

在本研究中,研究者利用GFP来进行现实世界的盲脸恢复,即先验隐式封装在预先训练的人脸生成对抗网络(GAN)模型中,如StyleGAN。这些face GANs能够产生具有高度变化的 faithful faces,从而提供丰富多样的先验,如几何,面部纹理和颜色,使它能够共同恢复面部细节和增强颜色(如上图)。

然而,将这种生成先验纳入恢复过程中是具有挑战性的。以前的尝试通常使用GAN inversion。他们首先将降级的图像“倒置”回预先训练好的GAN的 latent code,然后进行昂贵的特定于图像的优化来重建图像。尽管在视觉上有真实的输出,但它们通常会产生低保真度的图像,因为低维的 latent code不足以引导精确的恢复。

三、新框架

GFP-GAN 框架的概述:它包括一个degradation removal模块和一个预先训练好的face GAN作为 facial prior。它们由latent code映射和几个Channel-Split Spatial Feature Transform(CSSFT)层。所提出的CS-SFT调制实现了良好的保真度和保真度平衡。在训练过程中,使用1)Pyramid restoration引导来消除现实世界中复杂的退化,2)Facial component损失和识别器来增强面部细节,3) identity preserving损失以保持面部身份。

Adversarial Loss

Facial Component Loss

Identity Preserving Loss

总体模型目标是上述损失的组合:

训练数据

和之前大部分工作类似,GFP-GAN采用了Synthetic数据的训练方式。研究者们发现在合理范围的Synthetic数据上训练, 能够涵盖大部分的实际中的人脸。GFP-GAN的训练采用了经典的降质模型, 即先高斯模糊, 再降采样 , 然后加噪声, 最后使用JPEG压缩。

四、实验及效果可视化

在Synthetic的量化 指标上, 该研究提出的方法在LPIPS、FID、 NIQE都能够取得最好的结果,Deg.是指人脸识别 模型ArcFace的Cosine距离, 较小的值说明identity也保持的很好。 

责任编辑:张燕妮 来源: 计算机视觉研究院
相关推荐

2023-04-03 09:44:18

2023-06-14 17:15:41

Sniffnet开源监控工具

2022-03-31 08:15:59

递归代码非递归

2020-09-07 14:10:26

AI 数据人工智能

2009-11-12 09:51:11

Visual C++项

2014-09-24 13:04:13

微信企业号

2013-04-08 12:41:35

JavaScriptJS

2011-06-17 14:36:50

Linux

2023-03-20 18:34:02

营销大促质量保障稳定性

2022-03-07 10:27:03

Linux开源社区

2013-07-04 09:46:06

X Phone

2022-12-26 09:13:36

ChatGPT数据转换器

2023-12-03 08:40:18

微软模型

2012-11-15 11:00:00

2018-12-04 21:38:33

2019-08-09 10:52:58

Linux内核Spark

2019-08-09 10:35:54

2023-07-06 14:43:46

数字化转型数据资源

2022-11-03 07:35:47

OS内核异步

2023-02-09 23:03:22

前端后端json
点赞
收藏

51CTO技术栈公众号