TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview: @: L' m% V9 n
% G4 q5 l5 w0 N
. i4 U/ }! e. R. k一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
+ h! t8 l6 _- o5 ~$ p* r! B
! F& I; O0 x8 Y8 E9 w3 o故事是这样的。
& \2 ?# e% `$ s, }' q
k& c( s+ s$ B, U) z我今天看到这个新闻,看完之后愣了好几秒。
/ d9 z8 ~% Q% S( z
) P/ K @5 u# }' J5 ?一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
! V% G5 L+ m$ K; V5 W3 U* {) W
5 y ?7 y2 f1 y. X3 j* s* \结果被一个AI模型给挖出来了。
0 K# V2 i" H. w) [9 P: Q) t6 o+ `1 G; E
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。3 M; I2 \& L" Y: X2 I' `
\+ m' t# i0 T: V然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
8 T j, _" e! w' k% r- d* `; c) K
% N3 q( f1 s1 Z O* S: w$ UFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。3 z* p' J6 e" j! w
8 }- [& l+ G# c
然后呢?) i: J' ^: L* r! ?. H( c
. p: G) H! A: k: I
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
- T7 t, W# Q& s( }( F! F6 @
* \ p( T! F0 `. y. `$ L这个项目,叫Glasswing。! L' j ~, L, }& E. _
[% |( A% r$ K6 Hglasswing% s/ ^6 R. u8 N* S' k9 P
0 G- y: Y6 z' M2 \: N; a! E
- l6 O& a6 i* f. T先说清楚Glasswing是什么。6 o$ ~ D8 l4 ]+ G. {
: \+ G5 Z! l% c. G. _. f& K) I简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
. I- k( V4 ^% {% U% x, p( U/ w& B
+ {; P/ a4 ?6 | L k( K- ^有多强呢?( m8 T$ P2 a& e1 [2 a- P' q& Q3 C
) G2 n/ Q+ X# V/ ^: s, d; D! U2 J& r
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。5 k* M$ I- x% `+ `* m% `
8 Q: Y! E5 d" e7 dSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
# j0 n/ H/ q0 { [+ L* W6 p
9 m7 ~$ f1 o2 [# Y差了13个百分点。
' x; E* t5 w% F8 Q
6 c! N) {$ Z( X. f. g' F你说这13个百分点意味着什么?
' _' F0 h: ?0 b4 Z; _! |& g
' a2 e: |! s) ]% y) u意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
( I" A/ E. f" e3 U7 C7 ?- Z5 T0 ]$ K" `( y- h
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
! v5 R0 u2 `+ K6 A! {8 W! C! ]7 D
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。, n3 \, H, |2 N* ]
7 }/ I" f9 d2 r3 l, R4 c说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
! p" \1 ]( z. d
/ Y2 t9 a" J$ G; B6 m/ ^ EOpenBSD是个什么存在?1 Q% a/ p4 u' g# X
; v2 G1 Q4 R, Y+ R5 U. W% V它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
7 B5 L/ V) S4 }3 |. ?9 y, y& F9 `! B# G3 W
这样的项目,代码审计了多少年了?二十多年。2 G8 }& r- E7 q2 U) M
! F5 U$ _' O1 R6 v) F1 n1 J6 {然后,一个漏洞,在里面躺了27年。
y+ D5 ~3 D$ B8 K9 F$ L% a5 {: N( d) Y$ J) K3 j* D! ?
这说明什么?( p& B! h5 R0 o* {$ b/ n
: ]& [3 j1 ?+ C; S* ]) K% z T# S不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
7 @: ~- p& ^) J8 d
& M$ e# O8 x$ Q$ e/ [) y但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。' m# W- x* Y( e W G9 V
7 D# O, D3 n$ J7 [, @2 nMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。" _: \- V0 H" e) E
1 g$ C& d4 J4 H这种漏洞可怕在哪?/ y/ q! V" G8 N9 T8 a2 l' f
1 x$ o X8 [9 Z# U6 o: ]
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。2 u8 k4 Q3 p2 h" h0 n
S3 W- e8 U' [% l% J+ y! t传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
. H0 H+ w7 H" V. \7 U
- K6 p7 j- s- p- ^FFmpeg那个例子更让我震撼。
. K! A8 c [6 k9 F, ]8 x
$ i- K4 ^- ]' S9 D' y! z16年。- q: C& { I! L2 m
# |1 g) k# r; mFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。' i' S$ `; N3 E* @* r+ f7 S
2 z6 l) s1 y* a% h' H* U
16年都没有人发现。然后Mythos Preview扫了一下,找到了。8 Q; Q$ \) H# N5 ?5 V: P
# [0 O* _1 e* c3 k. p
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
3 H" Y: I/ P# C) p5 O6 O: ?1 \# \5 Y
这是主动防御,不是被动响应。
# G1 `" W) ^+ @: @8 y9 y2 T" N, o' ?: o
: {' w2 ~ C' ~; ~0 F传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
' }$ w- i6 u' B, e* o, M" b! C; K
' ~) g7 D2 _; ZAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。( J% {( ?. n. W- l& }! Q
4 t: M/ c% G- j+ ]这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
( s. n8 [. p; L$ Q$ y" R6 J) R6 `# f6 a% H" C0 C W
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。4 k5 v( D+ c. F N3 o
: G D- x1 d5 k2 q6 \( p, w# AGlasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
* S' x7 [0 _2 V% h% |' v1 v0 O) o8 f- X
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。5 c, ?4 S4 g5 O+ v2 L0 h
; D: s$ K, E2 ]3 y1 f4 f" O3 Y; ?
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
6 x4 V Z: j6 A& [& s8 p7 J$ I. r, |# P7 Z7 D8 n
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。' |; [1 N# K* M, v
6 Y8 o9 A; P2 ^7 y( k, _
这个价格贵不贵?
$ `3 i5 Z% K- z* Z
& e z+ Q+ e1 f) H9 b8 F对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
# j+ N; T$ Q* Q$ U: L/ L* h- N) [( J$ A4 L4 s* H) w8 `# a
Mythos Preview能发现那些工具发现不了的漏洞。! b* D: s2 F- d6 v Y
: x, S6 ^0 m9 E m. i$ k6 T/ C这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
5 O. N3 g! ]5 n4 O( K5 Q$ w1 p$ }$ O: i4 E% ]8 w# y" I
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
" f3 N# @. g: e. c
% ?. ~! A8 d7 f" N8 l6 o# I# L这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。
% d3 _1 j' G8 I' z$ t' I1 G& N8 b2 `4 ]7 ^. l$ ?4 L, O' v
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。: }* s* }) ^7 a' H
7 K' A! y/ @+ c' _5 C: C$ p
还有一个细节,我觉得特别有意思。
# w5 U& U- _6 z% f# i5 P: A9 `$ U$ I( a d* G* \
漏洞发现之后,公开披露的时间是90天。
. I4 }; U( n i% a6 \ A$ ]
/ _, O% _; m" x90天是什么概念?' w/ |* e8 |4 Q' K- m
6 ^% z5 H7 M' b- A
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
- c' j, m; d' y0 H. Q) y+ i! M
( V6 Q: R. I: c5 W但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
* r) i; ~0 ~+ u7 C3 O, n* z6 `% j
* \ ]0 H1 Y: [$ r$ @) ZMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
" F( J3 G+ M6 b" Q
1 H! R- p4 _4 ^+ j( M这意味着,漏洞披露的节奏,整个就变了。 S7 ~) S6 o# n9 i) {& G
% p& s6 p2 N8 D) \, g* V以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
' Y, W- Q& s' F7 B; w3 a
2 K" ]# z/ ]4 X4 W, m) Q7 m }厂商的补丁开发速度,能不能跟上AI的发现速度?0 B, w# W' z3 _ z
" t. @9 x4 e) l3 T% x( P
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。7 n6 V8 q* l3 t; p' X4 a; a/ m! p4 Q
. H) B8 }+ u' r5 F8 m. b5 U/ K写到这儿,我突然想到了一个更大的问题。
9 p4 }8 e1 i8 V* J+ s! x
- T! a9 ~8 L% C3 |- g+ yGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
: ?2 N6 q# d3 R$ C3 E, S; [8 e) x' s# }# H
透明,意味着隐藏的东西变可见了。! [7 E3 a3 h4 V0 w/ z
. S/ @0 k% V9 i7 N0 ?! v2 q' x1 }一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
2 j7 k8 L6 o7 X( t8 s* u# z! N8 y' D7 L3 R5 ^5 A
这个意象,放在漏洞挖掘上,太精准了。( J& w* C0 q0 h0 Q3 z
7 I/ g7 V; g2 e2 u% F+ ?+ y
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。9 w- V2 R3 F$ D' c/ Q
$ U7 \7 ~. Z0 c9 G% W2 T% i以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
% W. H9 a1 z3 n2 E4 _! ]+ r1 ]
3 z$ y0 w# c M1 A6 L! S/ f( K2 o: H但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
5 ]' ~: G4 P( ?' O* z. d4 F) y5 l/ n7 ~: j; ?8 ~# d
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
% J, _6 i# k; X( R6 w8 ~; i8 K* {6 l! @- V3 d
这是一件好事吗?
$ V1 A; Q3 J5 _& Z+ x7 U; w2 x- |' ]8 }- k7 T1 ~9 T6 \+ s) Q
我觉得,短期内,这是一件非常非常好的事。9 ?4 A; v! p7 h* H0 Y, Z& b8 [
" W/ t2 q* N1 l( o' d全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
* B' R3 \- A+ i, H6 j' q
- k. D; r% C, A. N这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
: v! B& x1 ~2 w( B$ s4 S$ ~2 P; G" b
% S6 y! D: S: l# d3 @AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。5 q. T3 M q* D
& C+ l7 c& B. e2 D4 l但长期呢?0 i6 X7 j" Z# U6 l
4 z0 L8 ^& Q: Q" J9 z2 y当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?7 {. u0 A+ x( m3 a( b6 w g. Q- u
3 [! P! N( w q3 U( R
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
* b$ X" _* X% l2 O# S
& T1 N7 d, O% {! M* ?5 R我也不知道。- B, Q8 R) V6 \: t
) K2 e* i( m1 b
但有一件事我特别想强调。7 b3 k$ C7 F2 U+ r
( ^6 B4 W, q, Z# _5 Q) C" U8 R这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。$ }5 m! O( T% x
2 `' N4 T% s6 w$ q
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
4 p5 |2 O% @+ E$ U' B* U$ v0 F
5 O9 F- j% t6 |+ F9 i5 H% G他们为什么还要加入这个联盟,用别人的AI?$ J+ u' _2 _6 r) m
& ]3 R& @* Y+ U& p& W7 i6 G3 |我大胆猜测一下:因为挖漏洞这件事,规模太大了。& x: X1 `3 `3 [; F2 v
1 j, `" w3 P' h+ H, W, d# I全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
# y! N0 q, F+ v8 @! E* F Y6 q' a6 W1 w7 u/ o& V
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
4 \- R( ?2 P z4 I# d5 ]+ M2 r0 S. I8 o3 A0 J0 t* q% y5 {- x
这是规模效应。
" ~" P0 |) x# c3 Z+ ^" Q& e% R: y" ]0 Q& g" B
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
. y" N H, ~0 @9 b+ }2 C) i3 \& O9 M$ c# D/ J5 {! P
这个规模,是人类团队根本无法覆盖的。1 d v* K( C+ P
. m1 `/ y( Q6 I c2 H$ D# j
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。$ m# ^% j) V: n' I& k: h
: K1 l5 j) S4 P: Q6 L
什么意思?4 W2 r$ W+ J. s, n* q. q7 e
7 t$ ]# A; H% r7 z* V
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
- g8 U6 A, X7 E4 N/ ]7 `
9 X, {7 f9 a; C/ f9 W! _5 N类似现在的ISO认证,但针对的是代码安全。
0 A4 h4 l4 I/ u% j) O: p8 ?1 ^6 R& {! _4 [8 }4 P
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
# z+ ~* u! Q5 d8 \' T' ^7 v8 O' W. K9 m4 |; V/ p
这不是不可能的。
3 F' T. E& Q: @; t! J8 t6 X
) n$ N& s: v, z1 N; U/ w3 Q当然,路还很长。现在还只是第一步。但方向是对的。
4 a% X- H# w3 a4 `. u# B, J
9 j+ o' w: ~( S好了,写了这么多,让我最后说几句掏心窝的话。
; @. t" g* z$ ?+ F/ d5 [1 e
1 g9 g0 m$ l; |; t v' Q我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。4 t, f5 N F& c8 O4 C
2 v8 A1 m& \% m( r
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。& s I2 r& j/ s: p) p/ Q
& ^' B4 F+ G. P1 ?; S! L0 K- X
这次不一样。这次是AI在帮我们发现自己的脆弱点。+ r* X( [( Q: T$ @- k
1 G+ F( F4 ?7 v" |: M
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。% n5 m) n/ E4 W
6 [& p/ D3 A* u' g' ?- k3 n" P& V5 F( f8 A3 I
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
6 z* f7 m- n* K% L& i& P" f; l: B; D; p J! ]
我怕的是什么呢?
% o+ s1 ~) C4 ?% B' M9 |
) {$ z6 w4 ~" E' b我怕的是,这个工具,只有大公司用得起。" `$ v# p9 D: e* T* V1 y0 P: Y0 e
6 N9 X0 a, ?: M8 P8 h' PAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?# ]1 U2 _1 H+ u' ?
6 B$ G+ a0 p3 [+ ?. e9 IAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?! E- ]! e" Y4 ]
* D0 y" ?* n y+ B
这些问题,现在还没有答案。) Z$ R& P9 P& P& W# M7 z
# P1 @% u8 F7 A# ~% V
但有一点我特别想强调。3 v7 J) o- l& l- X; G/ Z; C
2 q: G; U |" X$ R! i$ dGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。. n3 a8 R" N' `
$ {% z3 T% y. C+ b! D以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。/ e+ R1 O9 S) c4 H
. V9 C1 d s' l1 P
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。6 A4 m7 ?1 n/ g9 V
4 f. M+ R9 R) }7 S
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
0 O" f) V( |7 \" y9 [4 l( O" ^% V- \3 M n6 Q- B, }: ^/ H
这一天什么时候来?我不知道。可能5年,可能10年。: O1 P7 t1 ?3 a- Z
4 \ K% `& D2 H: o' P: }但Glasswing,让我第一次觉得,这件事不是痴人说梦了。/ r$ Y& k/ Y! @7 x9 w: p4 S2 Q
|
评分
-
查看全部评分
|