TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview+ a1 j; h% O$ K2 f7 j4 i3 G
2 q5 e' b. h0 z. n i0 K8 j9 b2 n
, y7 |% C. J5 S3 D
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
$ g. i# i- d' h
1 M) q. S' W# R5 O, W: _" r& j* Z故事是这样的。" Z( c3 K2 V# o* D" }8 J! ]
5 D& m- O! T( x; ~6 G我今天看到这个新闻,看完之后愣了好几秒。
# M. Z( H1 X d+ A; n8 w: X5 _* J4 t1 B
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
o9 k( w: t; n$ \( I2 Q/ g- t
! k$ z) |' J8 G. l结果被一个AI模型给挖出来了。
% Z+ h+ z2 ?) [/ j3 v, m, e( Z" P: W- m* @* H- d1 t
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
+ c: q& f7 o3 \* W* X$ j3 Z8 b f' Y
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。' z" |, {" J' h$ d# D
, t* P! h4 Q2 y0 kFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。0 ?1 N3 U; G" r q
* @# ~3 }7 o2 c4 ?* s+ t5 m: P然后呢?+ d. k8 V# Y5 I! e3 {
6 t, s6 X" {$ G0 N9 c0 @5 E4 E
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
# A' Q: [7 Y6 H U+ t S) x( r
" D: E7 M P9 p7 N: Z3 F这个项目,叫Glasswing。
+ }) h4 ?* R6 Q2 N. J5 H" J- @6 [; y
: ~1 I5 e7 M [glasswing! I1 {4 n c# T
, K( o s! l: V; F2 @- n( E, v! J
5 Z! c' h) [: y0 K先说清楚Glasswing是什么。' E' @" z- g8 |( x+ d' S+ m, w2 J+ s4 f
& Y d: {$ e6 \3 J4 c+ I简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
" L9 `% {3 l+ ~* B' m/ D
, b1 ^! t9 T- z' x) Y有多强呢?
3 U, ?5 K: E0 q! }
5 y% ~: W h* G7 o; V, _" MCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。+ \9 e, ]. D) S9 s9 `
0 c+ g" t- E3 ]' I& c I. Q2 D$ VSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
" S1 V+ k$ {9 T/ r" `, f
6 D/ h4 ?! O5 W1 I( T# H* U差了13个百分点。, h0 o% Z& C2 o7 e* X
! Q( d$ N* p& X
你说这13个百分点意味着什么?+ S. |* N+ X) o3 h5 y0 j% ?
' N& a6 i( R( z4 E# V3 M意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。1 R( N6 r6 N: a8 \1 h' o0 z- S3 k% f2 b
5 X) F( F6 E$ H
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
' |$ D% f7 K' T8 w0 Y' A7 j) F y. a+ x0 B0 v2 e/ U/ Y
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
& I" P/ |7 R. x% r$ m
5 C, j# v% Q) ?, f4 t说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
! `1 H! x1 q5 x5 X. d# w- k7 z- U" U
OpenBSD是个什么存在?/ I Y6 R$ [) k M2 {, q
0 \* V' \% l$ Q8 ?9 a' {4 R) _3 u它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
, v) D0 t5 S. }8 Q* k- L) }' Q4 h* F" Q: H9 Z# h" z/ o
这样的项目,代码审计了多少年了?二十多年。
% X* `$ N3 W& p0 v( D5 Q6 J) i& |! \) i$ E. v
然后,一个漏洞,在里面躺了27年。, p' _3 D. z( o6 O% ^
. Q9 K1 q' ?* ~' i8 ]1 k2 ~这说明什么?" x+ r0 u: [) w; K; |1 |
, |: q- \( y+ u/ V2 t
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。2 D( q2 j4 Z$ Z% L& a
7 R% D( \5 G, a) f6 O# f但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
% I4 S2 p' |8 B$ l; l. E
% b3 ^# ~/ F, \ }$ H/ I5 sMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
$ v5 I- d/ K. y7 W* b. {
+ u& L1 h* o$ c5 Q3 C' F3 K, _这种漏洞可怕在哪?6 K+ \* c" [1 A: c+ K" H
/ ?( X5 L2 H- ?& \/ |+ ^4 \
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
6 H& f8 a0 m' `, w4 F5 y' x" m- m; S) O2 s: R" E
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
3 u% B( |, {; y* a
0 b5 {/ Q* Z4 H. t& i- ^9 DFFmpeg那个例子更让我震撼。* ^3 F0 q3 ?4 `+ G% e/ h5 w( V
( h7 Y5 }' i6 ~2 K
16年。+ q/ u5 b) n5 `& p; t/ a3 x
, x+ _& F. T. j$ k$ _" C- j
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
: ^& c0 q4 V. c) U9 S6 Z& a& x+ r3 C) @6 L
16年都没有人发现。然后Mythos Preview扫了一下,找到了。9 r' D# J3 K8 g! x: f# r% a7 U" S
% S; j! Q3 N1 j注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。; g J$ M# Z" B/ {" S0 |$ U
, U0 k* T% r: H2 g这是主动防御,不是被动响应。/ X; |- X- w! t- x p$ q
0 c& T$ @, @' G( W9 W) k: y& N传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
2 B/ f8 ?8 F# ]+ F/ Z" Q; ?% Z- P8 M& r3 L5 S0 [4 M4 |' S9 n
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
7 W5 w6 ?* l) I5 u$ [. C' ?8 M# a
/ F& a# e8 f. G- \$ g9 ]这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。! w5 y0 Z* _; q% J
! L1 @# @- C& Q$ B
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。+ Z$ w' t8 ~3 M) I0 c
: D; G7 @( Z0 d. DGlasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
! u4 g# D8 K- i M, f) J U
2 S0 g, ^ N+ x, R/ b& U* c9 u这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
* c6 l- d9 w$ D4 ^7 m9 B
/ K) U- R! e8 c3 B' ]7 _你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
5 _: i3 f( |. b8 X6 w* R, k
S' Z5 \( _- |价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
8 J, `- K4 O# R6 D8 ?, ?* K% O( v Z5 N4 K$ {/ J
这个价格贵不贵?
. t! U; V; y9 A8 g
/ X* @. b; h$ }+ u对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
5 `) _1 L- a4 B+ }: i2 _" o$ P1 s# o2 c* E$ j+ ^7 r
Mythos Preview能发现那些工具发现不了的漏洞。/ v; W( g3 h7 u( M( t8 C+ B' }; {
7 Q% H0 s& V# |, q0 u! e8 N这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。; J4 P3 y, [; S/ V5 D' o
( Y+ z1 n# A# _; i1 W另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
5 Z, C8 Y" Q( S+ a. I% L. }0 S
2 C' B+ w# x2 _这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。 \" Q. G+ I* f. N) O* C9 B9 a
! D* M9 n8 |, ^# A
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
4 W, X" S3 \) o. S1 A0 }
! F6 k9 L' y8 l" `. G2 _( m0 T; D* f$ r还有一个细节,我觉得特别有意思。
' V- A2 W/ G6 X! f
* E7 b( ]8 y0 o7 H1 T漏洞发现之后,公开披露的时间是90天。
4 H+ f- y8 K: @) V4 ?: O$ `6 k8 l* u, ]6 h- M5 }8 w
90天是什么概念?! |& P3 G7 O% i( ]( D
$ p4 s" K2 A$ \. J; y! z3 }
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
* L: @7 y0 ~8 r2 f% ]' E" e! z
- h8 m5 t, o4 _但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
1 ~" }% z2 c1 b4 @$ {) k
" L/ v6 l, Z, e- d: y: @3 CMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。$ q$ w% @0 d0 Y9 i3 J
/ `9 S; F9 G }/ ~这意味着,漏洞披露的节奏,整个就变了。
. I2 }! y2 H6 E$ q: Y6 R
) b8 g" p& }' _/ H以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
# ^" `1 k- ~/ d' L/ i% O2 w, |% ?% n
厂商的补丁开发速度,能不能跟上AI的发现速度?) u7 }8 B9 [; X# r5 z# T' r
. z6 r' n" ?- c3 `6 ]
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。2 N9 x$ K0 k- @( [8 r- [
1 N! u; [+ K- O8 s s. V! m4 Z写到这儿,我突然想到了一个更大的问题。
3 O) J' h e: c; V0 x
3 _& Y" {+ U0 K8 }: b: L! bGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
; m( O8 q T) ]" I0 H& l
, e9 b$ E4 \& B" O j8 q透明,意味着隐藏的东西变可见了。' j. \+ i, ^& @9 F, F
`5 P9 f. d5 v3 S; l1 u# N一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。0 N2 d% @: D1 ^+ G
4 S' q3 Q0 Q( d7 U$ r5 y这个意象,放在漏洞挖掘上,太精准了。
* c' E4 A x& @9 z. u( b' B# D" ^" L
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
) o# D S8 S. |: _' x8 K; y: q% J& H+ H4 V7 v$ q
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。# Z$ a7 @: m7 ]: c. e; W
+ |, X8 Z, W& U: I& {) G- S
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
' h+ W7 T& Q' S* ~( Z. v6 l1 D5 M4 n/ f; U+ j. j" ]/ f) j: u: Q
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
# A$ `' E! [; s
. t( k+ N& Y2 @$ r9 u4 I这是一件好事吗?/ L. {; U/ A, d$ k: J" |7 H
7 V6 @+ V$ l+ N* o% `/ H* P
我觉得,短期内,这是一件非常非常好的事。
" m6 q/ J2 B/ e# b, V9 m& w+ T F. L! o
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
6 v# A( P! T) G
' z. Q+ a. f7 |% Z/ m2 k这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
% |0 X. M0 R5 p4 u' J3 u Q% u) d5 u
C9 f6 u$ v3 a- v* |6 t. eAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
: p3 Y: S& f% T- ?' E- {; Y# C0 p: R( F) H/ s
' {2 |+ n! N. c但长期呢?. f6 J( v9 _. ]
# D0 b5 I- p# L0 l
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?5 r& w* `8 c& u" g6 g: f) D' Z6 {, [. S
3 c5 V/ L; O {0 d5 r% g
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?' k( v: n, C; [5 R, H) G
3 ?2 W3 Z- h5 [$ z4 k. M2 ~我也不知道。
. K) j9 }9 U( Q2 h9 z2 h& ]& Q* D" I" b# ^6 x/ z$ B! R( E1 s
但有一件事我特别想强调。
+ b! `# w7 |) |; R7 o3 R, a) j: @: L$ d) d; i: X$ H
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。 z7 D+ p* _1 ^+ n% s \; u: r
+ B& ]- a' d- Z+ V" F$ @% V
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。* C i" L+ D+ t
( U9 c) Z! `1 h* N8 L* a他们为什么还要加入这个联盟,用别人的AI?
. h! ^# U8 k+ a9 {
( _6 ~5 Z: Q5 ]2 t+ {* J; B! J5 K我大胆猜测一下:因为挖漏洞这件事,规模太大了。8 l" i% ]5 r) R2 `' }! H; _
# N/ ?, _! f/ s2 V% E% |全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
/ T) }8 l& T# c& a+ H! _/ O4 R: c: D* R" ]8 \/ e y" B6 w
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。- E9 t b8 f! M# |5 j; j
- a4 q. N/ I; n' ?' A, O% ^& n h这是规模效应。7 M7 K ?! |8 U6 m2 N* P: I
0 \: ]4 L$ I! C ?* Y5 x8 k" ~' J# ~# k就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
; r. e# E! |. v& L# O) ^7 z; W7 q% r5 z3 M# ^1 @- |+ p/ k
这个规模,是人类团队根本无法覆盖的。
* h, M5 n- T! Q0 }6 q+ p+ W( ]! p8 X/ V$ r* i+ J8 J
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
2 B" @6 n# _9 P" n0 B6 \' I9 {2 |; e7 R- `- ~* r
什么意思?
* N2 L, o+ o# Q) L. T! b5 \5 M( ^ ]6 L
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。5 H- Z; V$ {* f5 ^( y
% g; U3 v0 A) O. L0 p
类似现在的ISO认证,但针对的是代码安全。; T4 V, I6 D( J4 n
2 J& F0 J* D3 m" j1 L- a. K
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。4 V# L: v$ L6 l6 k8 k
- K" C9 H: |, `. r' \- l
这不是不可能的。
/ z) t1 _6 Q) k' _- m9 s+ O x. A9 a, _& V" ?8 o
当然,路还很长。现在还只是第一步。但方向是对的。
) F% V7 ]* A& \" u4 ?' y* ]6 H+ l2 M, U, p x) X
好了,写了这么多,让我最后说几句掏心窝的话。
# p6 ^0 O" e- M( ?6 x4 M
) R8 u5 `$ e( \5 F0 C1 H我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
1 s1 e0 b+ E5 \) T
7 u A8 y& t n0 A% s9 @' j( ?/ b兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。5 t; W2 S: y! ?3 e5 M% }; g! k" o! A
! k, G3 @* E+ m; z& g
这次不一样。这次是AI在帮我们发现自己的脆弱点。
, D! Z) u& D8 a3 f* @. G
3 D9 {( Y% \& d# K# C这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。 T- i5 o5 I. V8 L% K+ F) u
* M4 T7 ~! k3 V& a这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。9 l+ @7 |% K E$ z
0 w, h7 O, t% I9 Q( t6 ^
我怕的是什么呢?! c6 z2 T7 y$ k5 y% K1 K+ i
4 F( T; g& l7 F2 ~. K+ i我怕的是,这个工具,只有大公司用得起。
/ `0 a5 a: S6 H& o* S2 Y% r
* L& ~5 [0 |" J, _$ A- |AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
2 j3 d' s. B# _3 f, P6 h" z
) f/ M1 R% X: Y& oAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
; Y3 Y1 E: h0 `) `( f0 V
* B* u. Z- N/ e s/ w$ \这些问题,现在还没有答案。
0 o# Y# `/ b) e% A2 }0 a% q
, V, ?1 S* N7 o: Q但有一点我特别想强调。
8 n" N$ D& c) C9 l+ Q. v* t9 S/ Y$ F
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。, y7 f! C, ^ D; H, o
0 J9 {% ?+ D9 I& I% u& x% Y9 V以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
6 l0 S" o) }" M- f7 s" i8 C
9 ~. s& G, z8 D+ i, K2 rAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
) H& x2 |1 `3 _0 e% M. Q& ~! S" x7 n4 ~, @6 F7 B- q) S0 u
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。& c- v: F( K1 f/ A; E& T
6 i0 P2 ?( x# B0 `8 Y/ D. O$ \! H这一天什么时候来?我不知道。可能5年,可能10年。1 W( e8 J }8 R: e4 @
1 B7 l# h, q8 Q0 f \
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
$ U7 \9 E8 ]" L: N9 G |
评分
-
查看全部评分
|