对抗攻击之利用水印生成对抗样本

本文介绍了一种新型的对抗样本生成方法——Adv-watermark,它通过在水印上添加对抗扰动,既能作为版权保护的水印,又能使深度学习模型产生误分类。文中提出了一种名为BHE的优化算法,用于在不显著影响图像视觉效果的前提下,寻找最佳的水印位置和透明度,以实现高成功率的攻击。实验表明,即使水印大小仅为宿主图像的1/16,攻击成功率也可达65%以上。
摘要由CSDN通过智能技术生成


本文为52CV粉丝鬼道投稿,介绍了对抗学习领域最新的工作Adv-watermark。

论文标题:Adv-watermark: A Novel Watermark Perturbation for Adversarial Examples

论文链接:https://arxiv.org/pdf/2008.01919.pdf

引言

对抗样本生成的方法有很多,但它们都是在原图像上添加对抗扰动。本文提出的生成对抗样本的的方法很有趣,它是利用水印的不可察觉性,在水印上做文章从而生成对抗样本,即在干净图像中添加有意义的水印也可以攻击深度神经网络模型。如下图所示是分别是字母水印对抗样本和logo水印的对抗样本。

1.论文的贡献

本文的贡献可以归结如下三点:

  • 作者提出了一种新的对抗样本算法Adv-watermark。水印同时具有水印特性(版权保护)和对抗样本的功能(导致训练好的模型误分类),需要注意的一点在于除了水印区域并没有其它的对抗扰动。

  • 作者提出一种基于Adv-watermark的优化算法论文称为BHE。该优化方法采用基于种群的全局搜索策略方式生成对抗性样本。

  • 实验结果显示,当水印大小为宿主图像大小的4/9(个人感觉扰动的像素过多,有点违背对抗样本的定义)时,它可以获得97%以上的攻击成功率。水印大小是宿主图像大小的1/16,也可以达到65%左右的攻击成功率。

2.算法介绍

2.1对抗水印

论文中使用除了R,G,B以外还有alpha共四个混合通道来生成对抗水印, 通道是指背景图像中前景区域的透明度。论文中用 表示alpha通道的值, 表示尺寸为 的宿主图像(称为宿主图片很准确即为无对抗扰动的图片), 表示尺寸为 的水印图像, 表示生成的图像,当 , 时,其生成对抗水印公式为:

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值