TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview' X5 m. p! Z: }* r! I/ b
1 Y$ I3 X" V7 S' y4 L
% x" Q9 H( H4 P4 w
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……- v% _0 g/ e6 G
+ q7 Z% E6 `0 Y故事是这样的。
9 f! _, ~$ g x3 h* S- S( m
6 {" D1 a* ~1 `$ S' i# ~我今天看到这个新闻,看完之后愣了好几秒。
" q! j% M4 B$ F& F+ H/ ]) J& b
2 ]# s1 X6 f9 [ q$ e一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
9 D/ s/ L5 f& h$ {1 c; V' i. E( B- n* @! R* K: m2 d8 t; w
结果被一个AI模型给挖出来了。
7 N3 Y. \) L& s7 f+ I- b. j3 |- ]7 j, O4 y, p& c$ d
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。4 f3 A& u2 |) j1 G. N) e" q' Y
0 f2 e6 B4 |$ C+ V3 c. b. t$ U然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
2 |( n: d4 R: J# G
! e' U7 F7 _ ?4 D0 UFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
+ N0 d" t9 B/ [" U
0 X: f- H$ g, r \7 R- U# {& ^然后呢?% p5 o, a" v# @3 {1 ?4 E
/ P& T! u* v6 d( j然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。0 g, A+ s7 V6 m* p8 L) S: A |
& u4 D+ T7 h7 \# v! s2 N" b1 w这个项目,叫Glasswing。
4 r, b9 }' S# X% @, `) [ {( O0 {1 a
glasswing- f6 `+ v) \$ f) i+ A/ t4 t/ e
/ }5 F/ y6 ~5 T4 ]7 y C: v, d$ X) U3 ~' L
先说清楚Glasswing是什么。
7 f+ w4 x( ~' E! f1 @6 _; x' r
0 u, U* [" T2 x7 c简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。% F+ y6 a: k/ P7 }% }9 v |
3 h8 _# [% s+ ], u3 J
有多强呢?
0 f1 h6 V3 `3 L1 Q& h. ?
, ~. ^9 ?# g' ]# q) h2 u4 P" b& JCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。2 E7 g6 p$ q$ ]2 i( T" S6 S
2 i7 J" K$ U7 ~: ?, |+ K
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。4 S; X% R0 c9 v2 Z4 T& J; b
8 h! h( r" r& d$ D2 i
差了13个百分点。! a {1 n V* T' G/ S, x
2 l H' W4 B# t; }9 [3 \你说这13个百分点意味着什么?) }. i0 u; N5 k
5 a/ W+ H" C* f
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。+ l7 C1 ]$ W; J4 `) R
( O" @: `" W6 Q. \) U& O
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。8 O; `" A6 u( }
5 l; _, [2 ^6 S" t( ^$ E' S! P' O
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。9 ^1 O" `8 C T! l4 g B Q
+ }2 u% u8 W) ` v, e
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
* g) N8 ?9 [8 \4 ]3 }# n! ]# [7 j; v8 u$ W1 l. I" M" S; w
OpenBSD是个什么存在?- v0 B7 `& d' ]( l8 r9 `" j
( [' ^ X4 t$ P+ v( C
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
- W8 ^% _$ X& K* q1 K; W" {. D. E2 I; N( ?
这样的项目,代码审计了多少年了?二十多年。" `% P7 Z ~) }+ u
; A$ w) w* C1 W( L) D5 n然后,一个漏洞,在里面躺了27年。
# K& ^/ ]9 }5 r! I1 ^* r
" k% o2 ?6 N1 s8 S, k这说明什么?
3 k# E9 a3 O; o( ^6 w+ h# ^7 `
2 U* }+ m' `9 Y% f B: E- r3 b不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
( F- L C& G* D8 T# f, ]
3 Y3 R- s. T" i0 L/ H. J! T7 n但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。+ z- a5 g* b( k9 p# C- {
# w: b1 m2 V- I# U- cMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。1 e# A7 C! H- _. i( W
4 x0 V& ]* j: O" C* Z) c这种漏洞可怕在哪?) {: R j, s0 l" y! `
) D$ |4 J5 D5 @
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
9 ?& U8 b% {6 ]4 }. d
6 y# I# y- @+ u9 F4 k传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
1 r. T+ U" {. R2 \1 B6 n U
# s- `& b$ T, Q8 ^& T# ^. @8 f! ^FFmpeg那个例子更让我震撼。
/ O% e0 ~8 j4 Y B
1 A+ y) ^$ ~- w8 n B0 c8 m2 A5 ~% x; A/ w16年。
* U; s% h1 r4 y) k7 }2 z* f
6 |9 T9 T# ]8 u& t: C6 `FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
8 R8 b; Z T0 D
5 A6 K! C# g3 x+ _. t0 H+ U6 q16年都没有人发现。然后Mythos Preview扫了一下,找到了。& _# c8 Z" W" D2 c5 F& V
6 O- O! y: i# V6 y; {" r) V7 F注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
& i6 p* A5 l/ p
) v* L: h5 U2 Z( B' Y$ F! \! T这是主动防御,不是被动响应。
: L; w. f! Z' T* p, {2 I7 z8 h0 W6 ?. x4 V7 u. y+ @3 I0 a* ]
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。! y5 l5 l) b( G
, r O2 g y& Y, a2 wAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。4 Q$ z3 c* }7 {! p0 Y
8 l2 \, k9 I8 P- h, m; b. J" T6 B: i
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
' S; ?+ s4 m: a/ u* \! _- V4 y4 e0 h8 b$ F3 w
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。/ }9 \% j1 g% u! P2 z
0 P2 x# e9 q7 ]: V. v
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
4 W) |9 r! e4 U% s& t! P
* U" ~6 K$ k) t9 R* m, w3 C$ `/ k) A这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。- z9 [9 C3 X$ {6 d
f* b& b+ }% \6 k5 l( w; m& P" N你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。( H* o5 J3 O; F" W' h1 [
+ ^ I4 k; V' z# J' T价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
/ [6 F$ A4 T5 S" h7 `+ O" U: E D) O3 _5 @
这个价格贵不贵?
+ l. w A( ]7 E+ q5 \/ \& A! _3 {6 j" Q, v" T
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
3 j: v% O, R1 S+ i9 V( t! `8 Z) k- |; x
Mythos Preview能发现那些工具发现不了的漏洞。
4 @: Y. |# C3 D) v' H, K* L5 f
5 A' c. r! Q0 o" R" ^这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。/ i5 d9 d# W9 Y: R. n: g5 c& B- |
^) C, s( r0 v6 c另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
2 t. j6 ?+ `& J# n: ^2 c' l3 Z% w; b6 @9 w0 E8 e2 k/ p% R6 M
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。. ^8 d- D' l/ P |& k, Q
) \# w8 _2 K! d) W$ b1 F4 sFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。& W: B) |* @/ H y, C7 V1 f2 _
/ G" [5 l( ^) [) A0 J+ y
还有一个细节,我觉得特别有意思。: B4 L( K5 k& g5 M
( l" G6 f& e" \& V0 r漏洞发现之后,公开披露的时间是90天。( T% I8 }6 k9 d
. V/ Q+ d/ B9 r x1 a7 i
90天是什么概念?2 a7 f2 {* @2 f
u2 ~ H, l$ q8 T2 c# O% v行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。/ q1 H! m! |" Q6 D+ P m# Y2 W0 Z
; x" P, e5 E$ Z! p- c但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。, a7 h' K6 d. G4 F0 J6 \
! J6 s! c8 _. `' H
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。3 r T7 V% ~2 d5 @/ [
! ~+ R2 d/ ?- i
这意味着,漏洞披露的节奏,整个就变了。' n" @0 Z" A/ T0 A; d1 J
8 Z% o) @, |4 q$ O4 g+ ?, j" z" s
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。+ S( G0 P( ]- N1 n1 W
0 }# ]# D% B0 r+ R& E3 A
厂商的补丁开发速度,能不能跟上AI的发现速度?
; B" O7 K; L& b; Y8 x1 k5 W* {7 ~0 `5 [
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
: F# U' K, V5 J2 s e( ~ c" R; f
写到这儿,我突然想到了一个更大的问题。4 k: d3 w- Q' s, }: o# g: [
( M, s$ ]+ C5 F9 UGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
; W m! L! n2 R9 M* D( j
) y! j4 I& ?1 C$ O- f$ _2 I$ g. O# v透明,意味着隐藏的东西变可见了。
6 f4 l, o' `+ u& ^4 C6 v6 Q/ S
8 F/ k7 @5 W& R2 X一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
7 k9 ]2 W* t! M5 q; Q3 }! q
+ l8 y# ^2 i) S! E7 }- Y这个意象,放在漏洞挖掘上,太精准了。" c- V% s3 u% J
1 L- O9 Y1 z" L# ~2 c$ O) M
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。7 d) z. `* K: c ~ j( ^
! J0 r2 `5 r5 D# q8 Q" s& C
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
# b2 u/ o2 G( c! u- L- J; z
( K% V+ f5 Q( ?$ A/ G7 m: J但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
9 i3 n# q8 n3 A# w5 b4 J1 A+ a. z3 g e: \" F$ F9 K
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
+ P! e! R; k1 K, j
1 ?6 g( U. W! z" S& U( Q9 |这是一件好事吗?9 D# Q/ T. u8 x4 }( d( B" L
5 x. G V3 E7 _- w' v
我觉得,短期内,这是一件非常非常好的事。% g- I" t1 C* b# |
2 l, L# t) ~/ {% v2 p$ p3 {9 E全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?( V$ o0 G9 n8 g! ]
" R1 w+ j6 E- m, J! H
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。* ]5 Y x; q" E, ?) [$ I& u! g, ^
, L5 i& |$ l8 L" R5 lAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。8 Y! i4 P! `, U5 t" Z" `
; K) h- q- v; l5 S, ^7 V7 `
但长期呢?6 L" l' b: a( l6 E
/ V& V, l3 l, p8 q) }/ ]
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?6 E2 ]( Z; M+ [4 E
8 @: a5 D; {" \是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?0 ^8 b' Y: p( }9 n R ]
/ o( p; a' B" h/ O
我也不知道。2 ~9 h6 t. c7 b
N, n" H+ q1 G7 r, e
但有一件事我特别想强调。
3 @! e! C( ~' b# L7 ~: n& r1 K; p8 [* i6 f% p5 G
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
! u2 T) t' Z9 V7 `# t- K6 K5 a. u/ v. ?. E7 }9 V- l% r d
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。, y: S: \# c# d: H4 H0 X8 u
2 x2 N' w( x/ }: ^& o' x
他们为什么还要加入这个联盟,用别人的AI?
4 q. F0 j+ n, v4 o
) S9 L5 `7 i# l& L我大胆猜测一下:因为挖漏洞这件事,规模太大了。, L" S" K; p) s5 x9 ~# v) X4 A6 J
# X- T# \. F( {+ B; y& Q' i. n T
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。1 U# J. ~ [& b' ~% J' j1 ?6 E
: v+ A4 c0 D6 A0 a( c4 F
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。+ O. \' N! c* c3 v& Q
+ }6 u+ M: Y+ j8 y( w0 F1 W1 H这是规模效应。
: K3 g8 M* h4 w+ w) o; G- `: j a
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。3 A7 m- f# p4 N& F) p" d9 `
8 M& J n) P: e
这个规模,是人类团队根本无法覆盖的。8 S9 A9 i7 i7 ?# Z% r$ T( ~& {
( y4 O& V# x' s4 A- E# @
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
( b$ a: L1 e" H& ]* M- K6 u
5 H& x. @; i" L8 Y0 x# j什么意思?
+ r3 k* Y7 Z& \, T" B8 r/ H
4 C1 ?# Y$ @. A; A/ \现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
" I. |5 m7 D. m' D' E# }8 ~5 E& R d9 A6 s
类似现在的ISO认证,但针对的是代码安全。
. t4 D3 I, X# X# [' u f; |% t8 V- D7 P% Z+ P5 ?$ f
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。; t. D' {" `8 n7 X/ ?/ R( L# w
/ t) h- }* \' s: Y0 U: c" q$ F这不是不可能的。
; u/ v0 S$ G( I$ V. K& q
0 p* e5 Y! u E1 F% `9 c当然,路还很长。现在还只是第一步。但方向是对的。
+ }5 T# a: q7 S- P
$ T0 }5 @! v' B: i好了,写了这么多,让我最后说几句掏心窝的话。
8 G5 P; S d- g- s7 z7 n5 _
; o* u. ^; a( D6 h* `) h- O我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
! n9 z( L" |! \/ w1 [& M
* Y0 [# n8 @- }兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
$ S$ V5 C! o+ ^7 f: ]+ A0 M0 _$ W7 B# [* ~- ]+ @1 _
这次不一样。这次是AI在帮我们发现自己的脆弱点。2 ~! t2 `: f7 T( m) H
; b9 L) ?6 m5 p6 Z8 N, N2 ?
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
0 S" G% g' d* H/ l k- F* @! g0 L* p' G2 W% j
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
0 H7 T' I5 R% E9 A3 `2 h; H3 w* L$ b. i7 W0 Y. @# K; {
我怕的是什么呢?7 p# `/ ?6 T+ F9 @/ {
0 u% {$ o6 j8 x: v: G我怕的是,这个工具,只有大公司用得起。
. ^2 p- Y) r" t1 j0 { W
) h+ b1 p% ^$ [) }! ZAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
0 M* v8 W: [+ q- w( h
- p% j7 _( H" O, N7 i1 ~Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
' B# W% J( H g0 d' w& n4 X8 s
( t7 d+ u- o: T3 n1 x+ }这些问题,现在还没有答案。% _# C. s j+ x( ?& w
+ A7 E9 D! j; _5 g) C; Q但有一点我特别想强调。
8 i2 }5 d- t- s: L& ^# L; b- X8 T) r1 B# z+ L" Y9 n
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
8 w! P7 D5 @" Z3 {! @5 K! e+ p1 j! S* w a+ r
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。% ~0 e# x! m7 y4 ?2 E+ }' K3 i
7 w! t2 W3 e# y# Z3 x' J
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。' V* l! |, V+ p: I. i+ ~4 d& ~4 |
2 V* m$ p7 `$ M6 g0 N7 a
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
5 q* [* ^2 P% D9 o. K+ m8 c5 a" ?: l/ @; }
这一天什么时候来?我不知道。可能5年,可能10年。1 o- `4 p6 n* X3 p
/ ?; ]$ s% q/ [6 `# U但Glasswing,让我第一次觉得,这件事不是痴人说梦了。$ Z* V* X+ n, Z1 v
|
评分
-
查看全部评分
|