TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
0 z% q1 X# j, q/ d8 h" c0 B6 J: o# {! E D+ G
. p% U5 \! y/ [- x一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
3 g. d( W/ ~5 z1 |: P; r! G
' _& j) X1 o. Y& {$ Q故事是这样的。+ O* u# e5 t/ j2 j, Q
& f3 e# f$ U; Z, S
我今天看到这个新闻,看完之后愣了好几秒。/ X2 G& |9 b6 y; ^( x1 q$ V9 o
1 J2 p. X) N* y/ o一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。) t5 ?% u- ^9 P
3 e# W- x" f; b. C* `结果被一个AI模型给挖出来了。
* {. e+ `# m7 `& _* L! I' g# g6 c, Y
% Q- K% R' T) F& B) r, L' l这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
+ Y+ Z) s. U7 m* D# V2 s
, k" u. F) @9 E! g( K7 U然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
0 n8 C: m+ A1 a) ^$ S
2 \, W H4 w! m- WFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
# q0 P) d( w- O; _% M; V6 u9 Y$ E& T. g7 I4 i2 r
然后呢?- Y, u% |% y) m3 s+ k
, ~, Q3 L4 v& N. l: P6 [. \4 ]' d
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
( {( G; ^$ J4 F% v$ V. G/ S0 t9 D9 ?3 ], h
这个项目,叫Glasswing。+ Y9 Q' f" V9 Y" @5 R* K$ R9 u, Q
+ o0 r1 l% P! Z7 W! U7 [
glasswing( x O7 x* _0 D8 N; d# ^; a& }
% N6 R j/ g( d
1 L: D) }9 t# e6 }: o9 V
先说清楚Glasswing是什么。3 q( o( C- ?+ ]! E" k2 {, U9 x
4 b6 o+ i( r4 F: {简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
$ W" U, q* t1 ]/ W" Z( Y$ j% U+ S8 S
有多强呢?
8 T( W# B2 Y! g1 \# F# Y5 p; B
) j4 r) O: I, R1 I7 q: HCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。7 r# v1 z. A# z) c H" @
( O8 p% O8 G& N: c' {
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
9 x& }; R+ B8 \9 v; s8 K! @! ]" d' }4 O9 w, Y) x6 K
差了13个百分点。
7 m& P, \. h( E8 a2 A6 p
# I1 P7 h7 Y$ \" a你说这13个百分点意味着什么?
! F, D1 ]6 }0 E9 Y& \0 o$ Z; }7 s* t0 g8 V& V% s
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
% S, G. l% e& D1 ]
; f* x( H8 O6 L J/ Z9 F; c7 M意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
8 K4 z3 ]; G: S2 k/ T7 v1 D9 y- x! O- A1 W/ e6 v0 t
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。% b: r' G, ^$ j* @
( T/ V. y- V5 q& x( y& W1 \说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。& q0 C# ^2 B4 V' h& K1 L; p$ N
% P; ]( C+ W4 m, h/ ?% D) HOpenBSD是个什么存在?* y( S( F. Q" u& {) K
& V( }+ U* W9 C9 u. @$ T它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
- H z; G' V2 L$ ?4 s% q8 D5 C. `5 H
这样的项目,代码审计了多少年了?二十多年。1 P) Y" I6 Q) y$ H% C% x
) m$ k3 X- I* d7 z0 i9 i
然后,一个漏洞,在里面躺了27年。: D3 l3 N! R! G
; t% y4 \$ N! W
这说明什么?
8 T& \/ G0 S6 w6 n5 w2 O8 e8 q q2 a) Y3 L! q
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
5 N' O% q$ u/ _( k
1 c: i7 a2 K; N0 d" Z+ ]但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
j; Q( @* o T7 ~0 d7 X: i; S. J: G. B* H% S
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
. g! c4 T9 V! ~: P; t
2 b( R9 r3 `# I5 M& h3 \这种漏洞可怕在哪?
+ K# w* j @2 J
7 m' m8 J! S8 M$ E它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
, [; w. `! v7 {, B- j- q6 R
2 x# D; v: C6 X! q传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
8 N4 E' [- X3 O
1 k# h5 d- c) g6 AFFmpeg那个例子更让我震撼。
# i2 a: ], s7 Y# Y# g1 G6 {8 m3 j& Q) Q) P
16年。, J$ [' d/ k. ^" W
( h8 K" n6 | C! U1 {6 MFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
% p8 C( p6 o/ x* r) X: z6 g8 J' I0 h5 [, A5 E, o
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
* G1 h6 U+ @2 X/ {# T! D7 e* c- N" p l/ m* ^% D$ p. @; U, Y
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
* k1 b" D& F' w7 P# f8 w7 r" k$ J9 X' N; {4 ?6 z
这是主动防御,不是被动响应。
; g7 r# }. j! L' R/ l J; \$ J7 w: ^2 v" i/ O3 i/ g
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
- m+ ?* l! q7 I' ?& K& p* }
% r5 B# j; I5 B7 h9 S6 H% N1 iAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。/ [1 [8 I( {- i! x, f; i/ _ u/ T
3 ]" O. b7 x( L6 }$ A2 o, R& L
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。. [3 h1 h- G0 d8 f8 l
a" Q3 l6 e1 Q; ]. ?; K- ~: [
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
" P5 v% |% P4 v8 _
" D ]1 Z0 A1 @/ C. \4 a' FGlasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
5 G7 d b4 L$ r0 k* n7 O# j* I, R. c9 A4 P5 U, L0 b6 A
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
4 L p4 v9 V0 x) f* I8 Y7 Y9 M" t& B: n3 y
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。& E# f+ i, ^1 h1 y. ~3 i. F
) A% e; i- v4 w* ^" B% T
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。' O1 W( E5 h' _; O h
( ^9 f0 |; h% M! @这个价格贵不贵?
7 A0 a- Z; W+ S* ]# b# x# L3 j$ s% ]# _$ g
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
- p8 o! S+ w. _: ? h
: F3 z9 E4 m' I( U. r5 NMythos Preview能发现那些工具发现不了的漏洞。
7 r" H, N3 B. y' k9 ?6 x+ A# ^* ]3 Y0 i% f
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。 m) @- F& \3 J6 i
- m( I% _: S5 R' |7 b5 a X+ \
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
$ H' ~+ {; {" ^+ }( U4 z+ m$ j3 l. J2 H6 T; s
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。& U( s% o) R- `. n" t2 _* Z
% k2 d% @- N9 A+ G
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
h- ~+ g% c! h/ [% K6 q0 j& c
% e$ a9 ~1 @* E* L( F. H还有一个细节,我觉得特别有意思。
& j+ x6 P4 h4 {9 f, s- ? d8 |1 d# l; s
漏洞发现之后,公开披露的时间是90天。: O( g$ X7 m7 E# e7 a; C4 Q1 F* _
- R6 l. m2 l# a90天是什么概念?
# g; v4 q& Y. Y+ d- {4 U+ N$ w' d" Z* `1 ]! e* o" b2 I. C$ C
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
a1 o' e5 e% I X9 v% ?2 R% R3 e8 ]$ n! |
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
( Y3 t" z/ _9 O: B# D. f; w$ b H
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。( J4 {' l- \6 u
& D: H t: X* i, o7 O- H! t这意味着,漏洞披露的节奏,整个就变了。, }6 p3 [! D1 Q
5 I: k. k8 u* m7 W; `
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。( v0 r3 {9 E0 y V% R
* D8 Q3 o7 _4 T
厂商的补丁开发速度,能不能跟上AI的发现速度?5 J$ A" C1 o+ f% O; F8 V$ d1 l
+ D5 h8 H" p4 `
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
: b& H- n1 A3 ~$ r" @+ d* ~. {* h1 H0 a8 m/ s# _9 j
写到这儿,我突然想到了一个更大的问题。
2 o8 V0 W7 ~3 I3 e! W+ n* j+ b! y$ s: C0 K# P1 r6 Z
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。5 r. W+ ^2 g4 g( ]5 G
6 l! C% v6 a* u) C
透明,意味着隐藏的东西变可见了。4 }& }- R" ]! S2 ]5 r6 m0 t
" j2 B! l6 Q, T
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。% f& _+ Q$ y& u1 q. V3 M! `& ~/ e
2 K' c" j$ P$ [' a8 L0 b! ]这个意象,放在漏洞挖掘上,太精准了。
9 w' ?1 M6 Q) X3 O, J. Y' \5 _. `9 P, h, u9 L/ V
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。6 o* R% D; T& y6 O+ B
5 M6 f. d2 x& P& s/ y
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
( g; U' b. w8 L) n* h1 I1 b& n7 {/ ~0 s+ B8 K/ m$ ]7 R b
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。( J2 H2 @& `4 ~& K6 _' h
) s0 y+ F- j. S- k3 @4 C
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
?. Y6 }4 H1 `" X7 Y; c5 n8 L) w3 n' ^7 c1 M+ b* g
这是一件好事吗?' R2 a: ~5 t1 A4 m/ @ j: W( t+ w
& H! x8 X' x$ M. C& C+ Y! ^# W我觉得,短期内,这是一件非常非常好的事。
$ G( i" W- J% C
4 ~; l+ @1 L; N( _3 G3 @ L2 |* s0 A全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
( @' U) b1 Z, K' o
& t `2 t" `' ]% N这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
# {, @6 ^8 m$ R5 @8 C: o. N. W1 A# u8 ^1 Z
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
) M- H6 ?* P- g0 B) e4 C k U, L9 |3 Y# @+ M m
但长期呢?1 x: i; m. j }
! h0 \' m/ s8 A a' ^1 S
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
4 X" w, s9 K9 M8 D5 f ]2 Y
! J( E: U) d4 G! r) l) P; T是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界? d; _$ [/ L4 H4 x* L
+ t3 B- h* P" e/ U+ O7 E2 |+ w
我也不知道。/ Z# r) V* Z1 e4 D$ I% x8 E7 @2 |
4 j4 m% o7 e6 N+ A但有一件事我特别想强调。/ H0 [7 r1 M& J$ E3 T. B8 w
' q6 Z6 Q- e' H; h. f: U这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。9 V4 u/ [8 E- k5 x/ a T
" i6 m" C+ t1 n, p. j# k- A, i8 ?他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。7 h5 J" y' c2 ?
# T9 i p; q6 d" J0 g
他们为什么还要加入这个联盟,用别人的AI?: A+ `2 E' @9 _8 |' r# q5 C" s/ F
7 g: L4 Y$ Z3 T0 d- n7 \$ c; [: u我大胆猜测一下:因为挖漏洞这件事,规模太大了。! m' g9 o2 ^0 A* {) b
) w' Y9 ?- j7 f/ f% R5 P9 s: F& Z
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。5 L1 X- _/ a* m: q: l5 ]: L
8 z' d9 a& H$ M
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。( s0 U8 t3 P% A6 g, O
' O! o! Z# I M7 w6 Y这是规模效应。, D4 A: l0 Z% }* f3 h
3 h7 s8 m$ e, l3 g7 ]就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
8 |: N/ c' s4 J
# F7 z, ]( u$ G/ j! C# y) J/ ]这个规模,是人类团队根本无法覆盖的。( Q+ F9 {( G& J6 i) t
$ C; k' [ }$ ]/ q% Q: y% _+ Z
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。' R+ U e' ^8 q1 z: o# F. w
# O7 M/ P3 N" u8 ~, e" |什么意思?7 q( d7 O! S& ]' }# o( u9 {
" y- q+ e. C2 ?) N* C5 v
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
' f o9 y! R1 p+ ~& J, B# N5 `6 v2 F7 U8 ]7 Q) v; `
类似现在的ISO认证,但针对的是代码安全。: K& Y: R; o8 k7 o( d& ]' g# O
( @, @2 B0 e7 Q; j想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。. v1 ?% H% n4 s2 Z8 _# B- S
. O& i! M! _7 H0 j' D! T, Y) A这不是不可能的。
( W% L$ K, N3 c) I
: t: h) A5 e9 h9 O7 `, [( {9 r当然,路还很长。现在还只是第一步。但方向是对的。
: }( \6 W h" e8 W0 e# P
0 q5 v* p+ C8 z5 e/ a* |' ~$ Q8 x" M. D好了,写了这么多,让我最后说几句掏心窝的话。 E, y3 z Y X b2 [5 n2 \; J
" Z! b8 A4 G4 _$ R+ Z9 F7 B' ^. U我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。0 `4 w W2 ]! C! _6 G6 I3 P
" x# n! f' A o m: }/ [
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
7 i) q0 P* S# a6 c! P9 k) N* C7 K4 @
这次不一样。这次是AI在帮我们发现自己的脆弱点。& S% h. Z% b( \5 j% o- I
) Z7 X' r' j( a% d
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
3 g$ x2 Y0 g, G, N( e' H2 D4 o h8 v/ D% Q% M( N- o$ [8 O# y% d2 k
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。$ e: v4 Q. W1 m5 J
! K8 N& b; O6 p
我怕的是什么呢?( p( U( U8 {; L/ Q2 f i# x
0 D0 y- |3 @ c7 n+ F5 p7 S- V我怕的是,这个工具,只有大公司用得起。
# N3 A2 U$ c1 N* h5 [- T8 N6 r h) R6 P
( z! O5 e, f: R: b4 Q1 ~7 wAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
1 k* }) t; p) A* e j, P
6 j t! y6 i& Z+ f: Z- A+ @Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?. D0 l# z0 g: p6 m. b% Q- t$ J
4 T% d& i: t9 a" J' U
这些问题,现在还没有答案。( s+ @* I$ K/ ?- H) }/ `1 Q
0 w/ S$ P- u% J9 Z
但有一点我特别想强调。
# c* t) f" m( b k: ~: G* K& v. o+ v& m9 r9 F: K/ K9 ]6 G2 k; J
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
# ^, w& k' l+ t8 g% D% `
4 P4 f# ]4 t, O! Q) [以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。5 _6 ?! f8 a% s T/ @* T6 n
: N) x+ c: y6 _' E: l; Y
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。$ _1 s7 W2 N6 v8 h- n
( Z& v8 x& D; v# M) z9 C
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
X* S% E% V7 J; y6 {. S/ j8 a$ p& n r
这一天什么时候来?我不知道。可能5年,可能10年。3 J* V4 w# [, j2 p( R5 B. L
* ?# n) g, ?' p) _; o
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。% K1 j! l, v- n, C2 E( W
|
评分
-
查看全部评分
|