TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview7 k P5 e! G: Y" Y5 N2 h1 _
$ q G$ c: r, r' H6 `5 T' Z4 v" Z" x; a" H0 R8 L& k
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……: n# X' ?0 v2 ]* Q X; ?
4 C( c) ?4 ` b3 Y" x3 n故事是这样的。
7 \) q, g9 H) Z% i2 l
, N/ a4 ~ V- R. Y* s我今天看到这个新闻,看完之后愣了好几秒。
4 E* z/ Y ?6 R9 l( D/ c" d2 e( |+ }/ U9 J1 V! }
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。7 R' ]1 J: m/ C4 Q3 N& t
8 v D0 r0 `% r n* F# s
结果被一个AI模型给挖出来了。
/ Q0 Z" ~2 o! J+ P G4 I* ^% M9 U' R0 I* O, j6 [3 ~6 k
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
% ], K( k2 M; M) ~" Q& \6 @& h4 B6 L3 R) y2 d
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。 b$ g/ r _0 l3 g# X0 D. Q! N
8 H( |2 |! {/ l0 xFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
k! j6 c7 b/ X2 V; n; B
! X# g- w9 T- y6 v7 H然后呢?8 R. r2 G" R6 l; P) b& | r
) [ [5 ^" \; S然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。3 D8 v: c+ m. w. O& S" g1 b/ E
) }$ n' {1 l. G2 w
这个项目,叫Glasswing。
6 [$ R& t) d1 U9 E7 g3 G+ j, c7 r/ f1 q# d" _
glasswing
. b- H1 W6 G5 Q, P, U
9 ^8 z E, [% }1 q9 K6 u: u7 t+ L) G% h2 q! Z
先说清楚Glasswing是什么。
8 ^9 Q( n" F# Q/ X4 j6 r
1 W2 z) _$ S3 B1 T, k- e# D _3 h简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
2 N- q7 G" {) y+ a' G* h: s0 I) R+ y* r/ k
有多强呢?
+ U0 K; M2 x+ P: G+ {8 t1 U
0 V5 P/ k& s, o2 ECyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
/ K* ~9 w# L1 y( V \4 G& P, q6 N9 l# w0 y: \; t
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。0 n8 Q9 A2 o" d
2 o# ~: [/ @& ]3 }# h* p差了13个百分点。
4 j* _! N+ R, o y; q. g5 |8 t+ ~3 @& G2 d, y _* i$ m, T; f2 J
你说这13个百分点意味着什么?
5 @# j/ M, {1 w+ Z5 @1 H4 R
& T! h- \, b9 k7 G9 ~- b0 g意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
' w% o2 e& n; m- R4 T. s( e+ _* V
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
2 _8 E b& f$ O
5 @' ~- L. }0 O6 x- w5 `% w或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
7 [" |, y/ B0 G0 n- v3 ] d! {; [- @+ C" ^" E6 L, G6 H
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。+ y3 a/ c- V: F# i; E% I
l$ Q6 M9 V, A1 ?0 Z
OpenBSD是个什么存在?" |# x% a3 i0 M! e; v" {
9 x! s# A2 ?: s- r7 L( c ^/ b它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。; C& w& }" O7 i/ ] l( ^6 R
: u7 d1 |( I; Y9 m* y& J这样的项目,代码审计了多少年了?二十多年。
2 G2 l1 P1 E# X: w- e1 Q+ ]) P) g9 s' `' ~
然后,一个漏洞,在里面躺了27年。
) F& E1 P4 G' N! K; f# I! G
( M. }5 a8 ]1 A! ]+ W这说明什么?
5 T) h; ~) d6 h4 p( O$ ^: r6 L, G! H3 B
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。* _- Y0 Y% o; Z% j; z, x
7 c- f/ k# N! H6 y9 b/ g
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。6 Z! y$ J0 k" G' F5 u% W
! O6 c6 m# Z. {* M3 ]& N6 _Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
8 J, Z5 l* ?. r E* Q9 \' u/ o* A1 R5 o# K" W* R9 y: A8 d3 z
这种漏洞可怕在哪?9 [8 @) \( l2 Z6 P2 r6 i
; ~0 {0 Q+ t5 D2 A# h$ k( z它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。7 L0 i P5 j0 b1 {# I' q
8 I2 U. p6 T( y8 d2 E% ^传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。 y% {1 B+ n% ]( U
3 Z3 Z: m; m: a, F9 o& o: Q9 ?FFmpeg那个例子更让我震撼。
. q* C2 `. s5 {# [% B( O
9 v4 }1 c9 s0 c! i16年。! ]* n, m2 d7 J
+ Y9 b. h$ Y4 K# p& K; B0 ]# t0 y. GFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。: M" V" E/ ~1 O) W6 f2 O, ^
1 m* ^2 l: j+ J) C. z7 V
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
/ Z9 T3 {2 j2 [$ q8 o; ~0 Z8 j2 z1 B, ~* _6 y
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。" @& }7 v4 f9 E8 R
! \/ o& _: Y( b' n. k, _, u6 v
这是主动防御,不是被动响应。. F( }- I/ O8 p. [2 A i: D
6 S* J& K; F* Q6 A' M传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。! S& o4 f( p( l- ^/ y
D- e% J2 }- ^" u' \
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。: I s' |0 n N7 E9 [) d5 J7 \
6 T# T+ X+ t4 N* y7 Y% u! m( q
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。9 v" a- u8 t8 M- @4 v4 Z$ Y
( X" H9 j& c) Z1 C1 Z4 L0 X) S
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。( V: K& M M1 q0 o1 `# ?
. D+ ]$ \5 u% x. L% K: j
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。% s" e/ H6 `4 Q$ |6 k: v
+ @; W6 L" W+ [! E$ v' t
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。' `" j" g. O# Q0 o: m
! ^8 _8 I/ e- b# P; i, m! _6 h4 o8 W: Y
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。: Y" _+ w/ f# e& W V
6 p% c4 q1 a4 J# b, \; @& k- \
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
: e8 E" }4 u' f# { `5 O |& G! E* b$ Z5 Z; \( _. `" B
这个价格贵不贵?4 F$ T4 Z0 m$ P0 s: W
9 T+ S: H/ r; x% B7 k8 R
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。7 L3 S; I( [. |6 W1 e" ~" Y
0 }. f" k+ ]4 A
Mythos Preview能发现那些工具发现不了的漏洞。
& w- J; ^; u- ~3 X' U& W, d
+ X1 {3 U# t0 z8 D. A: p这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
8 |+ a1 c: _5 G; r& s4 \. P' A9 \2 p! e# q" |' i
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
( I* i" N. d _8 T. N1 x6 f' N$ C( k" \9 w; F) x
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。8 p2 D) t' W- ]7 ~# s# ~
' p1 G% M6 D/ P, p2 TFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。+ |* K; P, M2 Q' j, ~
0 }* Y- v D; t; `
还有一个细节,我觉得特别有意思。
5 n2 S% Y4 R+ [8 h: j( H' S" H" A, D+ a7 c S
漏洞发现之后,公开披露的时间是90天。4 x" R% K# F c* U
) c5 O- u/ d. P5 h90天是什么概念?
! K* F5 ^5 N; L, m
% i" w1 m; Q: ` k行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
% y8 J% R { m+ J9 H& s5 |+ E9 t; e0 H0 S e
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
/ f, f+ y: L; @5 X8 t/ O$ l+ c& P* X- P- m5 x# r; J4 o
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。: a! `1 e3 e1 M- P; e, _5 I" F
0 T. Q. G1 |0 V
这意味着,漏洞披露的节奏,整个就变了。8 J' u& j8 y. b; M9 R; r+ i4 }0 a
+ {. a- W/ N' J3 `, F+ e4 ]6 ]+ x w
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
# a9 o: X% |2 u8 r9 E! a/ b
% K/ b% e/ e8 D S厂商的补丁开发速度,能不能跟上AI的发现速度?6 g4 @. ^. E! y5 P* O- c
, {' v- m+ _5 M o' H- A* W7 u: N这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
( d; [' |" g) n6 G
' K5 y! X' }0 V7 p2 r写到这儿,我突然想到了一个更大的问题。; ^- Z. F/ Q" y- j1 P
. F7 _- z; W2 N5 l/ qGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
- ^: _( e( @$ Y; {( P# y, d7 }) ?7 Z% e- X. k5 F+ M
透明,意味着隐藏的东西变可见了。% H6 A H6 x2 D. k* }" \
: T; Y# |' J: V, g$ f
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
& ?5 `6 f! G! C1 t( C! d1 \) C3 E; K' W6 K W
这个意象,放在漏洞挖掘上,太精准了。 l; B9 y' E4 a; M7 f% x1 `
: v# q0 F* i* k6 @7 U9 E2 \/ u
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。0 J4 p5 ~; ]5 F* Y; B4 Q. g
" c) u2 M- M: a' T& A
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
. L' }# \, ~/ S( ~7 b0 i+ ^% M
, o7 t" B: j9 E3 Z但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
6 k) O; Q3 j, x" m% ?7 r( M! J$ U |, p* J+ o0 R! w
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。6 D0 {% z7 @* H- Z
, x4 e# w V, Y% M8 J# q) ?/ e. a
这是一件好事吗?
8 f( W& V, O+ D& U" I+ ?2 |) `5 D) o
$ b1 [9 H4 j: E* o8 b. B+ [. m3 v我觉得,短期内,这是一件非常非常好的事。
2 n" m% o7 V' q1 y9 Q
1 S! b) l |; m3 f$ k全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?: v$ N+ L, u8 D
' q( X; D% `; k这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。' R3 Q- I! Q6 P' w3 ~* q, b- m$ w2 ]
4 S9 h; O: H+ P' \, o) q. ?8 H) FAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。+ T! W, {3 i( M0 j& R- p
4 _5 D# J/ g2 j
但长期呢?
$ B+ `) q( q: Z* F& l
W( Z& a0 l* b, b% _! I; B* E4 Y0 |当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
7 n4 Y% x/ B/ _5 D8 Z; W) g8 J. e& i1 V! I+ g0 a+ ^$ T
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?3 e* l5 |3 Q! l, T' T0 @
% e) b r; Q% j: t6 }1 N
我也不知道。# l0 D% [- @9 H" a0 W
w' Y7 p4 @; o6 W
但有一件事我特别想强调。
0 n0 L1 b* {5 l+ w$ `4 y" q1 _ \* X, [# I; C; |! T
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。4 A# T, ]* @8 i, s/ s0 W/ L
$ Y2 K+ J' P u; s
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
" E3 S. C/ m$ S7 \+ W5 O& p
# Y! S ^' I: z! d9 i他们为什么还要加入这个联盟,用别人的AI?
, Y, f- z0 H0 x& A' r1 L9 q/ E) _
( q- O$ z) d% _& p+ @我大胆猜测一下:因为挖漏洞这件事,规模太大了。
5 a# N$ S* H; E: @$ ?6 i; P/ T7 t, V/ V: i, Q; [
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
4 H7 f6 {. s/ {1 f9 Y( A) ?5 o
6 s, z+ G( N x8 t" tMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
5 F# f2 R; A# Y8 O; c! G
6 P# o0 W8 M1 |/ e, t" C% ^9 `- ^' O8 d o这是规模效应。6 T* ~ U* {1 i5 B0 }. A( n
9 t' |! O5 s, y+ v- E就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
5 r( j: h4 C5 x. t! i% e4 z6 Q8 |+ v t% {: u: E* Z' l" G+ p4 g5 Y
这个规模,是人类团队根本无法覆盖的。
) d, I( N0 R' J3 ]( {7 L- {) O% ]% M0 S f) m
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。7 d; ]% \: L0 J
- P1 B3 O' M0 d& w, [ J g$ u! x什么意思?
, _ [, C6 y( s3 f2 V5 x. ]* f7 I* Q, C N. c
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。5 ^! p1 @; d/ [- W
& x' X) M& {* R! ]1 i! G; D S1 X
类似现在的ISO认证,但针对的是代码安全。
7 {/ v0 S5 i( A+ k4 |4 e, q" Y6 W& L- k. `0 Q W$ ]
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
5 E, E% g L6 \9 M( {) }' ?8 E' @3 {5 d+ G" j+ d8 k
这不是不可能的。
% Y5 @- j& h) u9 P+ ?0 L8 s) m' v r+ l% e- \
当然,路还很长。现在还只是第一步。但方向是对的。/ m# C8 y+ V( e3 |" F j& I/ ?
7 Z, o) _& D9 g" M7 }) i好了,写了这么多,让我最后说几句掏心窝的话。
1 z9 x- _' c& ?5 o. i$ `# B* E, b
' Z* ]# ^1 A/ Q1 L& E我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。( i4 v/ J# _( e/ b
: E# T- I" c# k- \& `' f) q1 X: Y9 c' @兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
* z2 J! k2 {2 T7 y+ c6 M6 @( q+ z2 i2 x! M. a% Z* B
这次不一样。这次是AI在帮我们发现自己的脆弱点。( A# r) z9 x& _0 Z$ H9 B
; H) [- o4 a) @6 t' z5 k3 O
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
& E) u4 i4 v) d( B" y( [! }1 g4 m/ M C
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。" |5 @- r& c& @7 m4 V; x
3 Y' q2 |& G% z8 o- v我怕的是什么呢?8 I8 ]" k) i$ D( a& @3 d# u" \$ O
# c$ j4 n0 ?1 P5 K. _- |# W我怕的是,这个工具,只有大公司用得起。
6 F, U# m- x |1 d" \; b/ d8 ~/ @6 m }
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?* o6 N; Z" N) U" d1 z* T
% X: i$ y6 T1 c g/ g
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
. _/ H) T0 `7 l1 W* b1 \# o) d/ V+ N/ }3 E- N0 X
这些问题,现在还没有答案。
) j* Z1 y3 h, [$ ~) N! v' {5 X
, ^3 b2 e2 s0 b2 f$ }但有一点我特别想强调。
* | H) ~" `) g5 l3 N. R$ x: V E. o# ~0 I
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。, ]& T4 C) S; D: V/ ^8 d6 P H& @
: }! S" o7 F# l: [# N9 B
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
$ {4 M$ Y3 N+ @
g8 X5 s2 S' U. P ]AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。0 V( Z4 ]- O0 H! I! y
8 E+ ]; H9 P& i4 S, R4 b9 S当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
; B3 i% I, `0 O$ j$ P! b0 W" e+ e5 d+ n5 J0 R1 C, d+ Y
这一天什么时候来?我不知道。可能5年,可能10年。
/ F& }3 K5 \2 R) M' O- _" J6 @7 [0 _* G2 w& L
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
' M5 D/ H4 K( `# q# O* ` |
评分
-
查看全部评分
|