爱吱声

标题: 玻璃之翼降临——Glasswing计划与Claude的Mythos Preview [打印本页]

作者: xiejin77    时间: 2026-4-9 07:45
标题: 玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
. [6 U% x4 B" L# J5 b# g0 [( W' m  q9 j& Z. H' C9 Z" K0 x5 b" O" X

, ~; ]& f; J; `$ O一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……+ W7 X' D& o( _
6 [' c+ T8 _) W, r! }" f
故事是这样的。
0 u( u' c# w# p9 N4 S. h7 Z
3 C3 J8 q* |# m1 c/ a7 B+ k我今天看到这个新闻,看完之后愣了好几秒。
. P1 ^3 q1 c, A( _, q  M2 H2 s" W- F# ]
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
+ O$ [) P5 b& Q3 n6 F( a9 i" S3 c# N5 H8 x$ n+ E" J5 K- ~* M
结果被一个AI模型给挖出来了。
& ~. C% O+ U) X  R7 L& @7 d4 ]
' |8 B+ y$ c( V$ S这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。: N" n5 {5 N! q2 k) ~& i# [  E8 Q% K6 U
! n2 q, U( ?+ m- T9 W2 D; Q
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
6 @0 }: j: Q0 B$ ^+ d1 r3 j, H( M3 x& ]! {
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。) @1 H9 O) V; {# {

6 k0 \; ]0 N! Z然后呢?
/ V8 g4 X0 H4 R6 K, O9 \- m- D( y% x$ _
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。+ g7 D" Q: d: H6 I/ J, Z- X! L

4 o4 u- \. P1 `+ D/ F* h这个项目,叫Glasswing。
; A0 J4 A* C. ]$ A4 ]+ T
+ X" ~' W! \- G5 Z
glasswing
+ F- }) F& v+ s0 s
4 T5 o9 P9 N1 |* T: |! y% X; B* r+ F# X: }. b3 n% \
先说清楚Glasswing是什么。8 f; `" q- e" l7 m/ |( S% w  s

9 p2 f. g  v/ Q) b简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
/ W4 _7 x7 H3 X. U- r, n" w8 l  m% |2 }# y* I
有多强呢?
4 W0 Z0 U! b# |2 g/ b/ ]
7 l* D! b5 C* p5 u/ C4 G% vCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
# K) ?7 w) x" t' N4 F: t4 d" V; L! r. G% ?
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
6 x6 ~9 Z* x  R
; \$ `( A$ C, s' \& E& k差了13个百分点。
( w' U' j' ?1 v& {8 k3 w. h( d0 k/ |
你说这13个百分点意味着什么?
- f- G8 _- B+ C4 r( n; U2 J% w
! H8 g2 Z+ c! y$ L, U5 a* N意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。0 j, o2 {' c: q2 Q+ G

+ p& S7 h2 T& Q- ]8 B  {' O' Y2 l' S- T意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
- \" E- D/ b' p+ P$ w/ X8 ~% V$ E. P+ i' A% ]
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
6 s, Y1 k4 V: E2 c# X8 c6 l# h/ y* I& l) n  v8 M' ~6 k* F' B
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。3 p! K* ?- T9 d+ v
6 r; `- s: p  R- t$ v
OpenBSD是个什么存在?* F% y4 O  c) q* x" L/ |7 }0 |7 x
7 @& m" O; \  F1 O* R  Y
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。6 ~5 Z- |7 D1 i' F* g6 I* R0 S1 s
' j8 h) K" D/ |6 \+ W
这样的项目,代码审计了多少年了?二十多年。* C7 B5 B. b, A+ x! f4 l) g. f6 o
/ d0 u6 ?* V( T% ^
然后,一个漏洞,在里面躺了27年。5 {* H2 {4 I  t. u  ?& j
% |' ^- U" P# p3 m5 j0 U) w( n
这说明什么?7 r8 N3 J' Q) L# c- v" ?
* J' {+ G2 i1 u; Z' h$ U, f
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
: ]" e, n( N- ]
& p3 u- f; f9 ]2 u2 Z, Y但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。  x0 i+ W) R  r

+ ~- G/ D0 d+ k% v4 hMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
5 Y4 r$ b% X( {. J; x' H1 C* `' X/ t9 ^9 N' _7 V( I
这种漏洞可怕在哪?
. e7 c9 m1 B: J" \$ U7 U% y$ O" {2 a+ z9 q
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
8 p" f' \# }5 r) {% x
2 e  J1 y; r5 J, F. Q( i: a传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
( l5 d2 I1 f6 Q! M
% b& ?6 j( }4 g0 w0 HFFmpeg那个例子更让我震撼。
. g% U$ c8 \( E. K* b9 q3 y% |, n* X1 ]' d0 r
16年。" U/ y( I! _6 D7 ]  E6 m
% ^$ N+ O+ `/ O1 F! o
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
# T& |) }* E5 A1 Z
) h; z' ]3 U6 k% H* v16年都没有人发现。然后Mythos Preview扫了一下,找到了。9 Z! ^1 Y9 D+ |+ J

( G  {4 R7 a8 X+ ]: L注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。. ]6 U2 n& n: v3 @3 @( I$ E) X

$ p! F3 u) d, w  e4 `这是主动防御,不是被动响应。
2 p. c- p( B$ K) x, u
& U/ J6 W% y5 {: S: D% |传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
" f- m$ K, ]1 A* X) g9 _. R* F9 c# ?; k
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。- x, U* N8 H. @: n- ~" }" W9 x

% y6 k, H% }  j# z这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
' v  R: q/ T2 l; W8 g8 Q& c& [. {" x5 t/ H; z
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。$ K- ?9 u+ R$ W$ s$ N

* h7 s% e/ Z$ O( O- L& GGlasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
) [! `9 N  M; J* R8 r3 t1 R# P3 z0 H1 |; ]
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
; Z5 h6 @: B& n9 k
: e6 X/ N* L0 N( X你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。3 k0 V0 d8 t3 n! M  Y
0 x% c# `, x* h& r* o& b
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
5 r2 U# f+ K) Z
# }) T- r; B% K+ m4 i这个价格贵不贵?
$ p7 k6 E/ B( P* a; F4 R, Q+ ]# S- Z& A+ M
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
( r$ Q/ M$ z- W/ `% q  m1 S( i% v  O) M; T9 d! g# A
Mythos Preview能发现那些工具发现不了的漏洞。
7 @  N, `. R! Y6 ?
& L! \4 P" P4 L, C4 |" A3 f这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。: |) J5 k6 ^+ T! x& r" f

- v% r1 E/ ^- f$ L另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。& R' Z! s% n1 U0 H; A$ v5 g

, d% g1 y/ w0 N/ W6 F9 \. o这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。1 H% r) L5 s" h
. v8 D  N. x2 d4 {3 h% j# L( G
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
9 |, b" r2 D2 [, q/ N7 a- p+ C' d# y, p. E
还有一个细节,我觉得特别有意思。$ g4 t; z+ f$ {+ M9 m/ X  g
3 _0 j- u2 _0 ], F( r4 \1 {
漏洞发现之后,公开披露的时间是90天。! s' @. W# @& [) E& l
7 g+ i+ j7 r( ^2 e) g3 G4 t
90天是什么概念?
( k* o4 }0 ]6 @# Q, o8 A
! b* N( J( i9 M% A1 Z行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。# ^; G1 r& P; T( ?

( y0 B3 _4 k/ Y. y6 w3 x. i" r: x; C但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
3 t! ^2 K9 c9 I" M6 _# @8 j" B$ `" W  O% E
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。# P; l) N* U# v2 r

4 m6 R, b! c8 ?这意味着,漏洞披露的节奏,整个就变了。
) T+ l; _5 q: ~1 K% a! N$ W. u8 w. c
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。  L! m. y% }0 Y0 ^+ z

' H- }) u# e2 X2 L& X5 v厂商的补丁开发速度,能不能跟上AI的发现速度?. o9 i; F+ n& D# L
. ^6 l8 ^2 |, \9 f
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。* m* q' s" j; G, @+ p# h$ \' d& Z
' Y4 }5 D$ R8 {& \* x5 v! K
写到这儿,我突然想到了一个更大的问题。
6 |7 c( L# {# M' x" E' Y- Y/ W" r3 d
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。( I" K1 r& `9 J
0 j, @5 y/ F, s' J4 y0 o& B5 n
透明,意味着隐藏的东西变可见了。. r0 v6 _( c& w6 f

: v& s+ w% I* f9 L. o: `一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。) r: J8 J# C9 W& Y( r, a
0 d( z5 l: B0 f& }4 ~
这个意象,放在漏洞挖掘上,太精准了。' l5 d4 \  l  S# ]% X; _; P( a

8 t, S( ~" b  f2 E! S* A8 |0 ~代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。& _) r7 T( \( i2 j+ W- n; ]* l. p* d
. I9 r4 a, E& s& q+ ~
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。) m. c* ]# J6 \* C7 L$ \! Y
+ k. P# x- C& L6 E, c9 T* A) q
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。! h6 D( \$ M! W& f5 N3 `
# c* ?. r6 V6 p& a* d7 J
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
+ L+ A- A7 d# [9 E5 P
$ s2 X' b- L5 _0 J这是一件好事吗?
) b7 q2 g! r. l) ]: k3 E/ _! C+ S& M7 k1 [
我觉得,短期内,这是一件非常非常好的事。
% }9 j. |: c  H6 |" O
. A* S. R' ?9 d2 T! A9 J全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
- g# @9 y" U; Q# x0 n# l$ h  C
! g. X2 z. B- p$ @! N7 e' D# l4 f这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
) c( j0 F, c! s3 D, V4 u" R& j. c) {
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。: \6 S, h; x# U; e

. O6 \, y7 }, l) N# i但长期呢?. \1 |! J% d8 E
. M) n. Q# ^1 a9 [- R
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?! G1 Z) l7 ]8 R! j8 [8 Y1 x

/ l% H$ h  B  A& m  B- l; d是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
' F' K8 q7 K' M+ S
/ p( p; o9 M- A) o  T) X  g: `我也不知道。
! _" ?4 V3 Q5 W- Y; I; c$ |$ x
5 g# {) S. ]5 l但有一件事我特别想强调。' `' K! E5 z) ^! f

, K# M8 }4 ]& e' V( w: d这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
( Y5 t2 K$ d- h- E3 Y4 B8 U# M( I1 t/ G3 ~; f/ d6 v: w7 ]& z
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。' d" s/ _0 W( T- q% }0 d
' m& ^2 f( Z3 O" D
他们为什么还要加入这个联盟,用别人的AI?
+ Z9 M" a0 x& s3 D' o! Q5 V  x8 }, z
9 }) s3 z$ ?3 G, z+ a我大胆猜测一下:因为挖漏洞这件事,规模太大了。7 {  h! O4 ~. \5 I- C

. m3 C: D" W4 a1 l全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。; `7 V6 T9 b* k, X" O) K- e6 m

- s; Q1 r4 D4 ?! h: mMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。( N; ?2 k' d  |' J

0 ]5 F7 C( V" O, _6 T* w1 C这是规模效应。3 D* R; Q* e- y' y: F

8 W! M( p2 I* u$ d( ^- O7 y就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
  k. E6 @* d4 z8 W. Y9 ]6 X; W: P6 L
这个规模,是人类团队根本无法覆盖的。0 R+ s% q) C9 q5 S3 T- v
& O+ o6 R6 q2 L: s% d
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。, ], ]$ }( ~8 V
4 m) J& W: Q" K" F  B" y3 o2 ]
什么意思?5 y/ j6 T, j5 E0 k% w1 s2 Y
6 _- _3 o$ b) U" }
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
1 m7 l# U4 o0 D8 S0 o2 H/ X1 ]% u3 |9 V
类似现在的ISO认证,但针对的是代码安全。
3 `+ w2 _( u: h5 z
! s- v& g2 @, J* |9 X) E想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。% }0 }3 `1 Z9 s" D2 ^, ]# V, D( n
6 d- w0 X8 E0 j3 A" F
这不是不可能的。
* l4 y' Z$ I3 ~1 e0 `
0 v( H% ]* S5 ~4 c$ z1 V0 `当然,路还很长。现在还只是第一步。但方向是对的。
' {2 h# K( p: s& R7 G0 j8 |6 g! U5 q$ ^, R# \: z. x
好了,写了这么多,让我最后说几句掏心窝的话。
8 ]" f' y! [0 R0 V- ^
2 i: z" j4 k3 ?) X! A# Z我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
) b3 b% ~: t; l+ L7 d% Y
6 d# @( h6 h* J. v兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
5 D: m" d# W- z( z* z9 w' `' k  F7 u# s+ S
这次不一样。这次是AI在帮我们发现自己的脆弱点。
) ~% \; W* v+ X% B2 _2 {! J- F
. E7 o' E6 g. k8 Q* Q* _这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。( {" x4 _7 a" s( `$ r

! C  O1 Y" G7 R' `4 `$ ~这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
6 j) G7 [3 b7 W2 Y& {( _1 O3 y' }" a8 H1 ~5 e9 h' q: f; |
我怕的是什么呢?
) |$ h, ~) g4 e( z( y' M  A5 Y% o# @/ n: m( I
我怕的是,这个工具,只有大公司用得起。
+ O, \: O4 G0 e$ G' J8 d% n) S) V9 X5 ~8 H
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?: R- e4 c, l6 k( n. W6 L

; w  y7 m9 N: f0 c' j  ]$ L, hAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?% j  K! X- W  K, R$ u" a) H

+ p; z% C4 _$ e8 }8 z# [$ E) o这些问题,现在还没有答案。
& D* r0 w0 [- Q2 b9 q  G9 H  w$ k$ t2 Q5 h' Z8 }
但有一点我特别想强调。
' ]6 U8 K* I7 H0 S2 J5 H' v6 k( \+ X* M2 U, Z1 ]. |1 }
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。/ a* N8 |# @; o0 {! [  `2 M' t
$ d* i+ m1 K3 C8 ~
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。* {2 O- t3 w3 G+ X8 C

, Z& G6 n- g5 K7 xAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
( t0 j, I/ d& |" C* `5 v) q4 T" D; G5 p6 x
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
1 v, h% L! e% O8 x' O
. ^4 I" l2 A3 ]( P这一天什么时候来?我不知道。可能5年,可能10年。
) f. J0 b# }5 q9 Q$ ]
* }2 m( h2 a  d4 X# h但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
! x- m! I* c3 @6 Q; H( N

作者: aniu    时间: 2026-4-9 09:53
联想到了Snowden曝光的棱镜PRISM
作者: xiejin77    时间: 2026-4-9 09:56
aniu 发表于 2026-4-9 09:53
' y# i6 l' W; m$ k1 v' C联想到了Snowden曝光的棱镜PRISM
$ o1 P9 T% E1 l) T  r+ H) L' V
大模型大大降低了此类工具的门槛,之前国内的安全夺旗竞赛,几个夺冠的团队好像都用了AI,最狠的一个用了五个codex自动渗透攻击;反复迭代。




欢迎光临 爱吱声 (http://129.226.69.186/bbs/) Powered by Discuz! X3.2