|
|
|
机器之心报道
4 r9 S/ k2 u7 L/ ^6 h4 L: H# U机器之心编辑部用来刷脸解锁的 Face ID 也可以被「对抗样本」攻击了。最近,来自莫斯科国立大学、华为莫斯科研究中心的研究者们找到的新型攻击方法,让已经广泛用于手机、门禁和支付上的人脸识别系统突然变得不再靠谱。
. ~1 s6 L' ]1 _, S8 }. s" x 在这一新研究中,科学家们只需用普通打印机打出一张带有图案的纸条贴在脑门上,就能让目前业内性能领先的公开 Face ID 系统识别出错,这是首次有 AI 算法可以在现实世界中实现攻击:
+ X# k4 Q" z, Q- G. T- e4 D0 o- H% z9 f& N
" W; x5 u) n- ` n
AI 人脸识别系统在正常情况下的分类效果,它识别出了特定的人:Person_1。
: h- R1 t! j" o# V
8 e& q0 {6 w! t9 L& ]! @& n1 `
" T; Y8 m* ^5 W3 Q/ @# P贴上纸条以后,即使没有遮住脸,系统也会把 Person_1 识别成另外一些人「0000663」和「0000268」等。
( \* \0 R7 g( ]
) R0 j# `0 `3 v. w! R/ E
4 G$ }* B& A! n9 @变换角度、改变光照条件都不会改变错误的识别效果。加了贴纸后,我们可以看到 Person_1 的概率非常低。0 w7 J' j* G! _0 ?$ ]3 \ X( \
1 |( O" E q) o
使用对抗样本攻击图像识别系统,在人工智能领域里已经不算什么新鲜事了,但是想要在现实世界里做到无差别攻击,还是人脸识别这种数千万人都在使用的应用技术,这就显得有些可怕了。使用这种新方法,人们可以轻松地打印一个破解纸条贴在脑门上,随后让 AI 识别的准确率显著下降。5 t, q4 Q5 A; R
9 ~/ \3 k; G' `# T9 ~ U
从上面的动图可以看出,研究者实现的是非定向的攻击,且对抗信息都集成在贴纸上。那么如果我们要找到一种定向的攻击方式,让系统将我们识别为特定的某个人,然后解锁 ta 的手机,这也并不遥远,只要我们将以前定向攻击的方式迁移到贴纸上就行了。
* U% i% H" q) l9 N. j. j4 G9 R1 m, ^5 z# n* L7 A8 M
研究人员不仅发布了论文:https://arxiv.org/abs/1908.08705: u8 S/ j+ R. Z! t( q o7 Q7 a
6 l+ d, j9 [9 D# s: x b6 M9 P; {
更是直接公开了项目的代码:https://github.com/papermsucode/advhat
# e! h) s; D. R L" t4 l& P/ r, w( b/ l0 f q
「对抗样本」是人工智能的软肋,这是一种可以欺骗神经网络,让图像识别 AI 系统出错的技术,是近期计算机视觉,以及机器学习领域的热门研究方向。- _' \, z2 w- {$ R% }* }
' H% L& S, Y0 j+ m在这篇论文中,研究者们提出了一种全新且易于复现的技术 AdvHat,可以在多种不同的拍摄条件下攻击目前最强的公共 Face ID 系统。想要实现这种攻击并不需要复杂的设备——只需在彩色打印机上打印特定的对抗样本,并将其贴到你的帽子上,而对抗样本的制作采用了全新的算法,可在非平面的条件下保持有效。
. y" h% \$ \: ~; J; e
" U6 J5 p5 Y1 C研究人员称,这种方法已经成功地破解了目前最先进的 Face ID 模型 LResNet100E-IR、ArcFace@ms1m-refine-v2,其攻击方式也可以迁移到其他 Face ID 模型上。
% f( _' ^ }4 `( S; P0 @8 S0 L3 ^' L7 X- I3 r% c
现实 Face ID 也能被攻击; z7 U* C- a- m* w
4 V/ s- a2 Q* b4 k2 ~% c n& {! E
以前对抗攻击主要体现在虚拟世界中,我们可以用电子版的对抗样本欺骗各种识别系统,例如通用的图像识别或更细致的人脸识别等。但这些攻击有一些问题,例如人脸识别攻击只能是在线的识别 API,将对抗样本打印出来也不能欺骗真实系统。
/ k& w' M% S) J- e5 F) G7 c# q0 a
: h* w X8 G3 k B0 h! q* S7 V. `
一个标准的线上人脸对抗样本,它只能攻击线上人脸识别模型或 API,无法用于线下的真实人脸识别场景。
( i, S9 [4 Z7 l0 g9 R
) _ s7 K6 A: l7 |对抗样本的这种局限性,很大程度在于真实识别系统不止有人脸识别模块,还有活体检测等其它处理模块。只要活体检测判断对抗样本不是真人,那么它自然就失去了效果。因此,很多研究者在思考,我们能不能将对抗信息打印出来,贴在脸上或头上某个位置,那么这不就能攻击真实的人脸识别了么。甚至,我们可以把对抗信息嵌入到帽子或其它饰品内,这样不会更方便么。7 q- ?( W# d) z# E |
/ q: K- p) q( Y. \沿着这样的思路,华为莫斯科研究中心的两位研究者就创造了这样的对抗样本。他们表示在以前 Face ID 模型还需要大量的私有数据,而随着大规模公开数据的发布,ArcFace 等研究模型也能与微软或谷歌的模型相媲美。如果他们的对抗样本能攻击到 ArcFace,那么差不多就能攻击业务模型。3 @. J3 Q/ E9 G* q# n' F& a
; r( n6 I# Y8 E7 l; x X研究者表示他们提出的 AdvHat 有如下特点:
* \, s1 _5 W# s$ _7 X% |, O- b- T4 H6 [# w1 W/ x
' M9 N. j/ X# b+ |7 M4 y( Q
- AdvHat 是一种现实世界的对抗样本,只要在帽子加上这种「贴纸」,那么就能攻击顶尖的公开 Face ID 系统;3 m% ?/ J) I- |2 v1 a9 @) d! D
- 这种攻击是非常容易实现的,只要有彩印就行;2 ~9 z# v/ T9 e: k3 A
- 该攻击在各种识别环境下都能起作用,包括光照、角度和远近等;5 F2 ^' G( W9 x' H2 M
- 这种攻击可以迁移到其它 Face ID 系统上。" R3 V$ @( u7 {" [
* g3 r, ]+ `5 J- L
: m' W- b& G' ^1 J8 ^5 W/ `( @
Face ID 该怎样攻击
+ M" F4 R; t& C: r
" X$ o" h. c4 H' n' I7 B& `在 Face ID 系统的真实应用场景中,并非捕获到的每张人脸都是已知的,因此 top-1 类的预测相似度必须超过一些预定义的阈值,才能识别出人脸。& m* Q6 g$ z5 r+ ]
# X* u K+ s3 R) J! r7 a' @( x# i' W这篇论文的目的是创造一个可以粘贴在帽子上的矩形图像,以诱导 Face ID 系统将人脸与 ground truth 相似度降到决策阈值之下。
2 F3 w* a7 D K1 `+ I$ f2 ^* D$ w
) Z7 A! W* H8 B k9 N这种攻击大概包含以下流程:
) b( n* V- k- p& i0 z
$ K8 H6 U$ q, U; c8 q: l1 D( D8 I$ S( w
- 将平面贴纸进行转换以凸显三维信息,转换结果模拟矩形图像放在帽子上后的形状。
( s/ L' Z/ F+ h T& a5 z - 为了提高攻击的鲁棒性,研究者将得到的图像投影到高质量人脸图像上,投影参数中含有轻微的扰动。
! e6 c3 e% ^1 y" i0 Z9 G5 [ - 将得到的图像转换为 ArcFace 输入的标准模板。
9 k7 d* | x, a1 q - 降低初始矩形图像的 TV 损失以及余弦相似度损失之和,其中相似性是原图嵌入向量与 ArcFace 算出嵌入向量之间的距离。9 W' J* T. P- M [, G! y
* W& d6 u% s9 S' }& M) z! Y* P+ u! x/ @8 ~; `# ?; j
流程图如下图 2 所示:
9 o: k8 V# [1 M" [' T- P# l* n+ |' o; D4 Z$ j% [
7 P8 Q* D& F0 E
图 2:攻击流程示意图。8 k0 q$ }/ L8 Y/ k; i3 q
* p3 B1 m8 f! ^/ z/ i首先,研究者将贴纸重塑成真实大小和外观的图像,之后将其添加到人脸图像上,然后再使用略为不同的转换参数将图像转换为 ArcFace 输入模板,最后将模板输入到 ArcFace 中。由此评估余弦相似度和 TV 损失,这样就可以得到用于改进贴纸图像的梯度信号。$ C$ S/ ?2 N1 [7 y, v- Y8 A
' [3 T7 W& l% \
0 S2 C/ d) D8 x9 p2 l) {* `
图 3:步骤 1 转换贴纸的示意图。, {/ q F: J" e k, \
& |: ?* K7 O9 B7 t' q贴纸攻击试验细节) b2 Y9 ^: l- G9 ?
b- g( R# j0 p$ [2 Z6 D: d' {5 U3 |
如前所言,在将图像输入到 ArcFace 之前,研究者对其进行了随机修改。他们构造了一批生成图像,并通过整个流程计算在初始贴纸上的平均梯度。可以用一种简单的方法计算梯度,因为每个变换都是可微分的。
, [* [5 k* e R1 S2 p% _
- d2 f) ~7 e7 f* n$ y注意,在每一次迭代中,批中的每一个图像上的贴纸都是相同的,只有转换参数是不同的。此外,研究者使用了带有动量的 Iterative FGSM 以及在实验中非常有效的几个启发式方法。
0 U9 ?+ _: E7 p6 o* n( Z9 ^0 O) D
研究者将攻击分为两个阶段。在第一阶段,研究者使用了 5255 的步长值和 0.9 的动量;在第二阶段,研究者使用了 1255 的步长值和 0.995 的动量。TV 损失的权重一直为 1e − 4。) L6 m2 M5 w* }' [
' A8 [% p+ w2 j0 A9 {+ S
研究者利用一张带有贴纸的固定图像进行验证,其中他们将所有参数都设置为看起来最真实的值。) N( f& i4 A( o8 }4 k R& }: S
& _0 g; o. W5 @6 B
他们使用了最小二乘法法,并通过线性函数来插入最后 100 个验证值:经历了第一阶段的 100 次迭代和第二阶段的 200 次迭代。如果线性函数的角系数不小于 0,则:1)从第一阶段过渡到第二阶段的攻击;2)在第二阶段停止攻击。
) [9 o: {# v: v/ j1 u( u" K1 h9 F2 N+ z. l' M5 Q
「对抗样本贴」效果怎么样# l' b* b) u" h6 |8 n5 B
: l9 R0 Z' C' X% K) l. R/ L' P* m
研究者在实验中使用一张 400×900 像素的图像作为贴纸图像,接着将这张贴纸图像投射到 600×600 像素的人脸图像上,然后再将其转换成 112×112 像素的图像。
! V9 E( w4 G% J# Q% G4 p+ _& Z8 {$ E
为了找出最适合贴纸的位置,研究者针对贴纸定位进行了两次实验。首先,他们利用粘贴在 eyez 线上方不同高度的贴纸来攻击数字域中的图像。然后,他们根据空间 transformer 层参数的梯度值,在每次迭代后变更贴纸的位置。
. Y0 a4 u% C& e1 z/ m# B+ A V2 m: E8 m
下图 4 展示了典型对抗贴纸的一些示例。看起来就像是模特在贴纸上画了挑起的眉毛。5 Q% d4 T( H- U' l1 e5 r
' x- h+ y$ M) O; {, k6 H* N! p
/ L" [' ?6 t4 Z0 D9 z' S图 4:对抗贴纸示例。+ @& N: }! W, I* U' l6 [3 h
, X+ {0 W; v( _4 Y, ^! @1 K为了检测 AdvHat 方法在不同拍摄条件下的鲁棒性,研究者为最开始 10 个人中的 4 人另拍了 11 张照片。拍摄条件示例如下图 6 所示:
$ u4 K/ ]* L) Q; I5 T- \% H* v/ ~, f) [9 Y1 l7 `5 k. X7 v

- w! \2 f8 G; v4 k图 6:研究者为一些人另拍了 11 张照片,以检测不同拍摄条件下的攻击效果。
; G+ k. Y4 _$ e' k; { g. h. ^6 ^5 d( C: i- Q- k+ P
检测结果如下图 7 所示:虽然最终相似度增加了,但攻击依然有效。5 ^" S8 ?1 o1 d) u4 z6 B
9 L y. Z. ~3 e* a

. R- s" s! ]8 p1 \/ s7 ?图 7:各种拍摄条件下的基线和最终相似度。图中不同颜色的圆点代表不同的人。圆表示对抗攻击下的相似性,而 x 表示基线条件下的相似性。 [) E$ {! G0 \) o- D1 [
4 b7 ~7 E6 \5 O" q
最后,研究人员检验了该方法对于其他 Face ID 模型的攻击效果。他们选取了 InsightFace Model Zoo 中的一些人脸识别方法。在每个模型上均测试了 10 个不同的人。
' M. J0 X3 q9 I% ~
3 f; C. ^, Y, }. C2 O( b
) t0 y8 A$ e, I( Z6 ` |; E1 q图 8:不同模型中,基线和最终相似度的差异。% z, [/ C7 _7 @4 M
4 @% z% y3 s, q6 D虽然 AdvHat 生成的对抗样本很简单,但这种攻击方式看起来已适用于大多数基于摄像头的人脸识别系统。看来想要不被人「冒名顶替」,我们还是需要回到虹膜识别?( e9 C9 s, H, l4 e8 \" _3 ?
) k9 w9 s3 n- k! ]- g8 J) J% I
本文为机器之心报道,转载请联系本公众号获得授权。
2 g3 j' X3 x4 h* z/ u& `✄------------------------------------------------加入机器之心(全职记者 / 实习生):hr@jiqizhixin.com投稿或寻求报道:content@jiqizhixin.com广告 & 商务合作:bd@jiqizhixin.com
, b P3 s3 ~3 Q) d. J" @$ z! _/ p来源:http://mp.weixin.qq.com/s?src=11×tamp=1566896404&ver=1815&signature=*oejD6KZNIeFBedjGfko-HVWxUK5JqJymcLMEI2vQKpnGBbeLDP70080UA4XKxKdpIqy8GtZ8Ak8dD6y3mZXTrdi2HDgNe5e17ZDjbih8ZOWHLwlikFYQ99AEVxcEl0F&new=1( H2 {- F$ U2 ~5 S1 O
免责声明:如果侵犯了您的权益,请联系站长,我们会及时删除侵权内容,谢谢合作! |
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
×
|