爱吱声
标题:
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
[打印本页]
作者:
xiejin77
时间:
2026-4-9 07:45
标题:
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
4 F0 |% @9 ~3 }0 Q
2 v9 F9 c- _9 F3 H% p2 ?
7 Y, I- d* ~: Z" K
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
9 ?% |1 P+ u9 `- `. v" [# r* Y, f
4 S! S( O0 k |! h6 k9 p
故事是这样的。
1 t" O, Y- v+ r# f0 X4 X+ u
" ]. s, d9 y( Z
我今天看到这个新闻,看完之后愣了好几秒。
4 G- S& q: i; A
7 o& N, ?, Y2 z* {
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
2 Z8 E1 S, F8 \! h; {
4 o" q6 s3 w5 P+ w4 H9 y8 D
结果被一个AI模型给挖出来了。
6 p% X: r8 u6 ~, R& a. | Y( d! g
8 Y8 t" K: L/ p- Z& e! Y
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
9 Y* A# G! s# z8 I9 N/ U
( m' y( L- F% C& j8 M
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
5 F" [* b- H2 ^8 r1 T* A' G8 g
8 X- p. L) W9 m3 c" m3 l* S+ n
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
B8 X: y+ G8 B" q% b D6 L3 c
8 R* T8 z* L8 v/ k
然后呢?
# r( C3 k: z: g9 c
) z' ~8 S% _* W) i# v& x
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
/ j. g, x: r: Y
! h6 F# X; ~3 a( C/ q1 G, M
这个项目,叫Glasswing。
8 [: Y8 Y9 l, _9 V- h3 ~4 x! k, E
) I* I& d$ w9 B
glasswing
4 c! K, o ?* A1 Y
0 u; G$ _5 ?& a
" k6 o- V" P, \
先说清楚Glasswing是什么。
% A. z* _% j4 q6 [+ T
1 C0 P+ T( I0 M
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
8 I. Y$ F6 Z7 e! e8 o
+ B6 P2 t6 c3 `" ]
有多强呢?
) a+ \" o/ Y& Z7 ^
4 N' j. M8 c/ ^' C2 Q
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
# ~2 F \, n4 [6 B! W# J, a* d% W
$ x* D5 Q: `; O5 W6 K# g
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
- V2 ?" O2 P7 `
7 O" ]' C* d0 ~& }. B
差了13个百分点。
4 N C! n" M$ y3 _# X
( }, Y3 j2 m6 o3 b3 A; b
你说这13个百分点意味着什么?
! S6 Q3 A8 ^: v4 S
' x& P! e0 C! _
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
+ H, R7 W) z1 E2 R0 k6 d" z
7 q- S; h8 i1 P3 I
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
# T9 l3 O7 h/ S" d
: d8 A& N; J% X) I. [+ U; j
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
, O. L+ E2 c' d9 i7 l5 x: ]! M- u8 {
% l$ L: f% |3 Z5 s6 j
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
! ^/ l& w9 }, u/ d) Z3 a
, u, I- H& x7 [9 t/ l# _! n" a
OpenBSD是个什么存在?
" ^& G8 m0 w3 M
5 N( S6 k. c' c1 b
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
6 h2 @* K8 ^' i' `, p
; I! U/ i; ~6 x8 w: m) E% v
这样的项目,代码审计了多少年了?二十多年。
9 g2 T% k: m4 w3 N* ^) l
8 ^% Y8 }; A8 j; h
然后,一个漏洞,在里面躺了27年。
/ |( b$ y9 l2 `
! C$ o# f3 b' T# {
这说明什么?
) B8 }2 q- @! B
8 z; s) y3 ?: u/ K
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
. y# w7 a3 b0 `
W x/ v$ h" Z( [# B
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
. Z5 f% n( ^$ k
, ^- s( G4 ?8 o& U3 P
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
/ r! }7 p5 X6 f( G; f$ z
2 ~6 `9 G7 k: y& ~! r
这种漏洞可怕在哪?
0 m4 p% y7 g/ Z# k
4 f$ W% R$ w: Y4 m
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
+ [/ Z8 Q* E6 V& \0 R
1 R8 Z) P. {0 h' J
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
' H3 U* X4 T' |
% |% `/ N, R* T. C1 _ t1 M
FFmpeg那个例子更让我震撼。
( t2 o3 F% k" m4 o" L7 \1 J
7 M! a$ E# ?7 W. |$ Z* b6 s0 k+ X
16年。
9 c" B, w+ _, K I" }
9 a" g" Q5 ~) x' [7 N$ ~7 J$ B
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
# O: z1 Q/ T$ g7 z/ M5 G+ y8 i7 c
4 {* p0 l; D- E$ Z. x+ f& S
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
E( \# F- Z" M c* _/ R
5 d+ m4 r" G U% y# i& l% B
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
7 h/ _7 V5 M* i
; f3 j# s3 p( P g4 f9 c/ ~) N
这是主动防御,不是被动响应。
3 n3 p- V, L% C4 h" J6 ~, @# g3 Q0 e" ]3 J
; V+ P7 w1 |4 }4 G/ [2 G/ d
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
( I* Q O5 z( G) a& ]% O3 R
% m1 y9 d+ M- O
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
2 M9 T% u- H( H; X
* T: w' T1 n; P2 e- Z0 K, S
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
# f5 A& w6 p& C1 F
5 x, h+ z' K. t, G+ X7 t
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
: d6 M- Z6 q% z
% @2 Z$ N2 W2 ^% D; w# c
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
5 Q2 D: V6 K: a: T7 B4 b
# H. _5 B; h0 e, V# o. J+ t' P5 e9 L
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
: Z9 e/ ]$ d0 U% |/ {0 x P
, [. d( U. b3 N+ f
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
* x8 u# s) j% W0 a
6 x" _$ c# h% ]. Y+ ]% @
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
! h# g) _4 ~# P P
: b y9 R9 L4 r' u
这个价格贵不贵?
$ Z- h8 R0 }" Y- V# b8 X* m
- @ z5 x) X3 N) L6 y/ j) z
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
* @- h U4 I1 y/ \5 M* I* c
1 s1 x- n+ _3 H' y2 W. l
Mythos Preview能发现那些工具发现不了的漏洞。
/ ~' n4 _0 @& ^ h8 p6 f
+ p& F+ w( p/ [, s: p/ y1 ], q
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
I0 K6 _) _. u6 x( t' i1 [
# Y: H+ X: O: [" p8 l, o
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
4 \- j) n/ u0 I$ s1 @/ S D
8 f& q6 P: Z" r R; g
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。
8 J% X4 _: a9 t2 r( O* ^# V4 l; J. R
3 d; z0 L% L* H% U( _$ u0 ?3 u
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
% `8 j& X# R' h2 p
& C& O( {2 _7 b! J7 B
还有一个细节,我觉得特别有意思。
% W! H3 q0 o% B9 H+ y
$ b7 a. w" V* H$ y/ |3 A
漏洞发现之后,公开披露的时间是90天。
: J _2 N4 N1 w1 U2 a: k6 ~1 _
$ J" z* W7 n5 J: j" I: ~, O7 A4 s
90天是什么概念?
+ r; l. ~, b; W7 x9 [8 P
" N9 R- K* c. h
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
( O) J- F- Q) E2 X0 o8 |# x8 I
1 ^" B" r" y) h1 h" `$ E
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
! i, i( a: w1 }0 n' T! W9 k) c
( z/ g" a% \* K+ w% X
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
' d# l' O3 [* u2 K
, A/ g$ l m- j
这意味着,漏洞披露的节奏,整个就变了。
5 A0 {3 F8 j* ^
; }8 i: F3 G. v9 e- w( ]
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
o! Y3 l7 h1 ~ n
, R9 ~, w( a$ y
厂商的补丁开发速度,能不能跟上AI的发现速度?
( Y' _6 G" l" E! V/ |
# ]9 H7 n# Z; n/ p
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
$ n' H, d: L' I
9 \0 U n6 B$ r1 D3 `3 n
写到这儿,我突然想到了一个更大的问题。
6 F! ]) E7 V! e% s, y
. w: `- d( |" q8 i8 C1 l. t- @
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
; Y& T$ Z' e3 z
% \0 J- P. q% S- {% M
透明,意味着隐藏的东西变可见了。
; v4 s! ~! ?' e- C* D7 b
8 |6 g2 m$ Z# F! s; Y1 e
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
) |% S$ V9 ~! A7 M
( W' ` M c- _8 ^9 @9 S: ]
这个意象,放在漏洞挖掘上,太精准了。
9 W3 C& I+ j: S2 P. ^
3 T3 L4 A: ~+ I, I) c, v
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
: W# x; e/ K8 _4 S
7 f' j( V6 t" x; F
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
- [' w% L( ~4 E6 y; n, ]
% c0 x- @( Z+ O0 \' h
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
; d2 M) s' N) i% _% ~
7 @# W3 |( t" I n0 ` \' B
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
- V7 g: P- D8 j2 N
8 x* x2 I7 v* a' \, h
这是一件好事吗?
4 V# j( @" L W0 D- d
2 h1 I' ` f# I( X
我觉得,短期内,这是一件非常非常好的事。
: Y$ B) h/ [5 j4 V; v: P( Q
: k- `/ W: f- R5 B* x
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
& I) b( l) U0 Z
" a; ?; B9 o* @# d6 H4 q' C
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
4 ^: l0 d u- H8 [; |- w a E
# ]% H( b) b6 m1 H0 {$ u; \1 u6 W
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
8 K, y' X* v/ U* q% s X1 g& o
# b8 e+ |) Z4 y9 }( j7 o
但长期呢?
' e2 v) B! F$ ?; K
0 w1 |$ [" E3 F( u
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
( n; ?+ y7 J, [# Z+ ~
# \' N6 ]3 i( a+ {
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
& Z! J& b0 ]- y0 K5 h
5 y+ E9 G; E2 w, [
我也不知道。
/ Y6 S) N) v5 E! u1 ^% P5 w6 {1 g$ o
8 b& E% c1 O* {7 S' B b# |
但有一件事我特别想强调。
0 k# h5 N" P( h& Q; c. V' c
# m0 R" J8 I, }4 S. N
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
/ k* `4 i0 c' _6 ]5 S2 `
0 h5 }- ~% d/ P8 J2 _. j( m
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
) g" D O7 q2 i$ A9 N i0 q; t
+ _3 Q. Q8 B9 B5 }
他们为什么还要加入这个联盟,用别人的AI?
$ ~0 R, c! } K: z: ^! O! ]- [
Z3 j% G# k8 w
我大胆猜测一下:因为挖漏洞这件事,规模太大了。
2 N7 Z, F* ^. O8 g# v4 ^1 i% @
8 K9 F3 P# _* u" d' y
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
# o. j9 C F, T* A, b/ N
& _7 m6 p: B# B9 Z) ~) O$ T
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
# t" ~4 r; v2 a8 @4 P
5 T( m' @8 q2 k2 w0 m" z0 u
这是规模效应。
' d& s8 q) B# f5 R, a
% B1 G2 }! p) u
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
3 m ^% ?/ r5 l! I: ?
( I- V+ p) Q. w( z
这个规模,是人类团队根本无法覆盖的。
! T3 I* I3 x- ?" v
/ L8 i8 Q6 n+ D' h. H3 H7 N9 f6 J4 V
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
; U) g1 ~; J9 h% f4 }' D
9 X: L% F% S9 M" v
什么意思?
$ i" [/ j( R6 B; x/ q
( O1 m) c' {5 p/ [' t8 a t0 ?
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
' e% z1 u5 ?1 k( O5 M& u- r
+ U+ _. Q- ? ?0 g
类似现在的ISO认证,但针对的是代码安全。
9 l. d% {5 ~$ h# g6 d; ^' }1 A5 ~
$ ]) T* M- d+ P3 \0 Q# r/ I
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
& X! ~; o7 u/ |* C8 o
) F' p* E v. x$ r# F: s! s, f
这不是不可能的。
2 D: R6 q8 \3 h1 h, z9 ^. z
) c7 e3 P7 c f6 M6 u* `
当然,路还很长。现在还只是第一步。但方向是对的。
e& o: f* O) ]4 z
6 |6 i \; O% m! t% S% n" ]7 I
好了,写了这么多,让我最后说几句掏心窝的话。
3 D3 h/ V% H# ^2 {' ?! C
4 l! G/ ^4 F; d: U. c- o9 T1 |$ E
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
8 B+ p7 B$ c, j! E" E' m1 \1 L
1 c( e+ c: \; C
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
" b- \) g0 m& u* e, D
R# M; G0 H& L& G9 G
这次不一样。这次是AI在帮我们发现自己的脆弱点。
" n3 ]2 Q* k: |+ G( c
% \: [! ^( t2 {9 U$ u
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
0 o0 G5 f( E4 v! I3 Z% c D3 t( I
- n! S9 I e' s: {& v/ Z
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
3 ]* |/ O5 p% m/ w+ r; n+ B8 M+ h
7 v+ M2 T0 B; ^- `* {
我怕的是什么呢?
5 ]$ G0 X2 H% x+ Q
. m- s, R' |+ c7 e, R9 K( {! H
我怕的是,这个工具,只有大公司用得起。
' r# t! y0 p7 }1 J& N1 Q
* ^3 {8 m" ?0 h8 g2 j' x" k9 r7 k
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
! _/ T; l5 B$ B& N, i& e) D* S
) B* V, V' s' g8 o
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
, N0 ^1 m m' U( |8 @, J' n
3 f( D/ h9 e5 G
这些问题,现在还没有答案。
- T4 V& L2 F* a" k3 v# }5 z" u+ P
4 Q8 R" y3 E7 ?+ r8 M
但有一点我特别想强调。
( t# k4 J8 x0 a% w
; L2 y/ I. x2 e1 D# L% ^0 T' M
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
6 `. K; O$ V* D9 C0 ?& w
9 {6 |# @# S/ J3 E: H/ J8 C9 i
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
& |9 d* `: l& `& J
/ O @/ k1 s9 ` _+ _, [
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
$ B: t5 T- ]* U
* E' D6 y7 O+ W5 _# H% R2 a, V: }' z
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
, L! m9 d+ Q! D9 {7 D, z
: d4 I2 r& E" `! J- w, x& ` n j
这一天什么时候来?我不知道。可能5年,可能10年。
" m$ w- l- U7 E* {
: M( K$ N: F' D. B
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
6 `) W7 C, m6 w% d7 w1 X
作者:
aniu
时间:
2026-4-9 09:53
联想到了Snowden曝光的棱镜PRISM
作者:
xiejin77
时间:
2026-4-9 09:56
aniu 发表于 2026-4-9 09:53
% j: J! g8 e3 ^4 K, }7 T
联想到了Snowden曝光的棱镜PRISM
! r& p" O$ A. E( F/ c7 V
大模型大大降低了此类工具的门槛,之前国内的安全夺旗竞赛,几个夺冠的团队好像都用了AI,最狠的一个用了五个codex自动渗透攻击;反复迭代。
欢迎光临 爱吱声 (http://www.aswetalk.net/bbs/)
Powered by Discuz! X3.2