TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
1 `, F, U' K! z- {. a8 E' r
: S B. B& M5 N; q6 p% ?& S) }4 E& E1 s5 s* f; H0 D* c
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……4 D- I! c$ k$ R8 i/ {
9 Y4 _$ j* O9 w; S+ T( j% G故事是这样的。
* K3 [1 J" F) Z- k9 C' ?: c5 G: L
6 ~" Z& y7 ?& C% ]) N' k. Z2 k我今天看到这个新闻,看完之后愣了好几秒。
4 l& t% c4 H! ?2 n" _ m
& ~* K0 ^. Z) C, f7 `& D一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。+ ?6 K* X: G, p. D" ~# m1 g, D
8 \' G! M& y9 L1 l) K结果被一个AI模型给挖出来了。
4 M9 K! U8 I4 s0 I1 r# b+ ^" \1 N% a/ N2 X1 b& p/ A
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。3 t+ b$ l/ c# V6 v( ?- I
( ~% b6 t0 P3 d* \2 i: p: m7 a然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。' }8 M5 j6 ?7 ?: R
# L& V+ c( R5 e% ^5 `" pFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。2 V) Q$ u! M+ N* v9 ~
2 ]) N. Y" G% m- b6 j" c; q$ Z5 b
然后呢?! e6 D$ r, a8 M) `
7 c/ S3 Y7 ] |& h- e7 t6 H
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
9 V. y; A4 F8 B! \
3 `. A* E7 |, M- P8 A S0 G, w这个项目,叫Glasswing。+ {6 b* S5 J2 |7 q1 V m
$ P8 Q8 ~* a; j
glasswing2 s8 @. |% f) m7 I
9 V/ K4 Z+ x$ y3 F5 C
0 q* Z+ t, [2 N! k( t3 u7 N" G先说清楚Glasswing是什么。
* E! O5 P6 E" k' c2 p2 C4 P
. y# H8 X, U: i! V8 O C简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。4 d& e3 [+ v+ N
- R8 S( x Y2 y2 m; R4 O( K
有多强呢?( I" D% h! ]7 ~$ ~
6 K+ k( A+ y5 z0 Y+ \; {
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。, u6 n* \3 {8 p
1 k+ }% C. m1 W) G7 T1 V5 J
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。+ y% s+ }$ t% W# t6 u# d4 c
9 |8 r& p: h4 t. \) I
差了13个百分点。
5 a* J8 a" ~9 L" O6 N
/ E9 j3 U0 t% k D/ _5 N% n0 A0 [你说这13个百分点意味着什么?) g$ J+ Z! @: V6 X2 C
& O1 h N% B; D$ `; r% [' w
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
! @$ |! A. Z% p
! Q, t2 w% K! V+ K1 A# j意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。4 m+ J, v: U( L. }/ `/ A$ h
4 q( L: ?% t. p' H! Q
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
* G9 X) s" h2 f! a9 K, ^3 J/ k" P: P7 x& q! m- i
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。* u4 K' L3 i: g6 b7 ?0 P% i8 T. s
8 X4 r2 m3 u) S zOpenBSD是个什么存在?
/ @+ M* {" O. U
9 b* M& A' R1 J3 ~4 @$ y! k q它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
/ H. e: _, {% ~( [# ?- [) u2 D! i6 z$ y+ h& R4 J: u4 @% S
这样的项目,代码审计了多少年了?二十多年。
* j; i% r4 I* c p$ l
+ I: J9 T* S) S4 O1 C: y然后,一个漏洞,在里面躺了27年。
* g0 I% r7 |4 c. J6 R6 X0 h6 a
( U: r i! e3 ~* R B这说明什么?
( t8 }0 M/ w3 t2 b- u
. ?" k# b& e+ R不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
& Y) C' t8 v, }% Q c% }8 d, `8 m/ ?$ K5 `( d+ c$ ]/ w- y
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。, I- U0 c* c( d" b; H! Y5 w
# c6 Y/ D: k- [# z. w/ MMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
2 n9 C0 q& E# U1 T5 T5 d4 W% P
$ R3 c) |% z- N2 w" ?% }这种漏洞可怕在哪?
7 t( M+ u& ~5 P+ @; ^8 D! W3 V3 K! [+ h7 a) V, x
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
/ P! W( |) j* z2 M- D
) p; Z6 o4 X1 P传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。+ Z& R0 u+ ?7 H% T- G+ Z
& J4 W+ J( m2 P1 P- U! r; UFFmpeg那个例子更让我震撼。
4 e. r; J: b: f" V5 O: m _, G3 U( a9 G- C! ~0 b. [# u
16年。
0 Q$ k/ I/ b+ W7 T6 Y% m# f6 | T+ [0 `- ~( J" f* @ S; X
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。& n/ b. e( E. y, F3 c
* e, P0 T5 O7 \- p. I/ M6 Q1 E8 v
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
4 `" ` F' m: g! @0 a
) t5 L2 R m, b. M, Z注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
1 O H& e) E1 Y/ V: o( h2 S' M4 k& x4 F: d( F$ M" v
这是主动防御,不是被动响应。
?; ?. r& m e! q
; j0 u$ I7 r* o9 x9 d {2 `3 a+ m* D传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
7 W6 a* R/ m' b; S4 Q# }7 ~3 S3 r8 R
" f2 N! o0 I+ V$ JAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。! [. n$ J; ]) T3 h0 K# G( P' b9 G3 E2 t
; N3 G0 {; u& d% m2 ^, A这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
7 t/ ^$ r6 ~0 D1 r
b7 L. Q* i9 `1 H# V现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
2 b' l3 k, q: `2 L! p8 P9 Z
; D" E! k: G9 D0 eGlasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。( S, L M7 F8 V% _3 N$ r( \4 O
^) V: H+ W5 _. C4 f这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
/ \; z! C4 l4 C- Z
; W- y& h8 K5 q, r6 q你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
5 F" O5 w! J2 P8 t, }
0 I: m2 ^+ q; d; ^7 w价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
2 R( k; H" Q0 `, C0 X9 v
3 K/ h5 Z" T9 g' e) c; c( I' P这个价格贵不贵?; p( x9 s' Q' N6 T% y6 x6 }2 n$ |, b
6 X' y# g6 }2 N' u7 w+ ^; b, I
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。$ ^' B% t; N. Y# l7 G
% }$ \' Z- ]( G2 ^% x# VMythos Preview能发现那些工具发现不了的漏洞。! r d9 x C; {- d/ {; J9 v- I
) o9 g4 e# Y( q7 D: N% R3 X" Z这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。! w4 ?/ ]6 F6 H1 B
" q0 t% C; s+ e( i: G) {; q
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
$ O8 F) @! b8 ?9 y9 X
& M8 ?; \3 H/ g( o0 A. `这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。) w- |/ L: H. S1 v0 P5 D5 Y" Q
+ I3 i4 g0 Y F' T: rFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
( z0 b6 }4 z4 I+ r& E5 H- J& g' D B- H" M
还有一个细节,我觉得特别有意思。1 J3 k5 ?9 G0 U8 d3 E3 p" ^5 B
* S( J# z- C5 m) |漏洞发现之后,公开披露的时间是90天。
1 ~) I# `+ S7 P! S/ }) H1 q3 \
% s c& V( e& `7 B3 Z: z- A90天是什么概念?% U+ ~6 C, A5 H* M
4 u. Z" y! G4 f& [8 s
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
. Y8 w2 `: v" m1 v' B7 `) p. T1 b9 Y% D9 r- P$ r# m
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
+ R! s6 ~1 a* _( ^. l2 \" O3 S: N* f" m$ l5 S
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。# w2 k* W8 R! d# C
9 p8 y O8 E3 ^8 h2 i( l2 q这意味着,漏洞披露的节奏,整个就变了。3 C# x) u4 Z E& l% U! ~" U$ W1 a
! v$ w$ A) q$ C以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
& Y+ c% Y% ]9 I0 n9 R6 Y3 C/ v8 }. d% P: |+ L3 {
厂商的补丁开发速度,能不能跟上AI的发现速度?8 p, X. Q+ R* R$ Z' i2 ?* k
, l4 _1 Z* ^& t, M" H1 N9 Z这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。% v+ b8 _ b( Y
/ u @' @' t- R+ ?0 A- Q. s
写到这儿,我突然想到了一个更大的问题。# ~2 m0 N" Y$ J: P$ | m+ {4 z- @7 D
& a+ v0 a3 D }$ @: O% D _
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。* W6 t- u* k) i, N# v' i
2 a( ^1 o; O( I0 n$ _) N1 {
透明,意味着隐藏的东西变可见了。
( J8 D2 W3 r4 ?6 }; V/ F6 Z- v* ?* R
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
/ g* t1 V, ?0 x0 v+ d, Q
' b" e# X6 m) R3 t这个意象,放在漏洞挖掘上,太精准了。& n, G2 A, ~6 f, d, E0 t
1 a4 \, A) y+ Z
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。) ?1 x2 ~ b3 v
! V' @' ]: @4 O以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
' T1 E( ^. x4 y5 p) l) b5 v$ B# n% F+ n2 ]3 Z4 x4 V
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
5 M$ P& I8 S- f9 T- Q$ t6 q
/ j) ~% ~) }8 k1 Q5 x G9 f8 _代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
0 `8 o' D" {$ A; O, I7 c [0 G. w( z9 r
这是一件好事吗?& W6 ~# ?1 u! x' j8 L) l
9 x- q5 L9 H( D1 b
我觉得,短期内,这是一件非常非常好的事。
% u. H6 p6 p6 d/ C |7 r' e; N) @4 D0 \% _) n
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
0 f0 Q1 z5 A7 w/ d$ W5 {1 I1 F
# {% M0 K* N, r& J: Z4 X这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
2 N: }; j0 x! f0 I S
3 V# q7 l1 O$ I" G( L0 p5 H9 e J' ~* MAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。 p S* A& ^( `7 i4 U7 w s
9 `" C& I* D5 Q, B {4 o" |& c6 c
但长期呢? I; ^1 [9 M5 {6 g. f+ o
3 E; ]% a( e2 R( h# d
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?% g" `7 y/ P9 U# s0 H
% |5 D, s+ }$ u5 y, [ ?8 {是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?% e" v& P P: k6 x$ v
; D0 H2 j2 _6 \- u. p我也不知道。
0 L [7 x9 Q* {% y6 b
+ ?! h# t7 n. y% N3 U但有一件事我特别想强调。
# d3 B. \$ c5 ~8 l) ?
4 i! e7 O# p8 Q# ~# S: S$ G这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。" a+ O- V4 Q" O" }$ }( j8 i. ]9 }, H
; w7 i; H9 `) }" U! w8 G他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。" U4 K! m7 G/ U
6 G: T5 J ?& i/ Q9 P2 D他们为什么还要加入这个联盟,用别人的AI?) Q8 s. \: O9 V- l# @: w
$ u1 @3 s7 n9 E4 f& X
我大胆猜测一下:因为挖漏洞这件事,规模太大了。 i, [9 l2 p/ F: ?" m( h% u
! r0 S8 Q% T! q! ^0 Y4 x0 I+ y全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
8 i7 F; Q; `+ J3 X4 I7 Q& ~. G, o1 K% E) d) A
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
! i# F6 G* F. @% j. R5 o9 {0 w
7 C! f) i; k$ i$ x1 c) j这是规模效应。) V1 J4 W* r6 o' P% {
5 t. o% b& X- I9 ~$ N Z# o就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。! L1 b4 y. [/ @2 a: r2 I
0 m9 ~! E A" H
这个规模,是人类团队根本无法覆盖的。
; i6 L& _ i; L( f" J+ A% t' C7 t2 s) X
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。% R) e+ O7 f$ ^7 D7 ~
' |. S! o$ i2 Z$ m& G什么意思?& P& Z7 ?* o" | s; ^1 W
8 |1 a7 P) c. A2 T* b6 q
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
) O, S# h Q9 V: _: X5 X7 k1 a# V' ]+ n' ^. |, T0 q! i, X6 a: E
类似现在的ISO认证,但针对的是代码安全。7 ^. R2 K8 j- ^8 A. d
8 ^4 v' J$ Q. T8 j/ T1 y6 g
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。* Q f# t) x: I: l
! m8 V7 S/ r! |7 u这不是不可能的。
' y3 S2 U! L# e; {2 H
6 v( h; e1 l; r当然,路还很长。现在还只是第一步。但方向是对的。
A: }5 U! G p4 J% z- o- I2 b* }# \4 N4 q
好了,写了这么多,让我最后说几句掏心窝的话。7 P# z5 h4 k& g9 t
# r+ }0 U3 J. A% [2 W
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。7 _) d2 F1 \3 F T4 {! Q4 F% U9 J
2 @* K4 I4 M8 u) q0 i9 z% c兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
; ^+ Y( l' e* j, r: k' r' V
3 T+ C9 c9 s% ~: `1 \, u这次不一样。这次是AI在帮我们发现自己的脆弱点。
! @9 r( z5 [8 z3 }: `7 [5 x" k2 b3 O# z# y
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
: S/ S) w1 @% d, ?1 U- w
; e2 [+ }& p) T$ P这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
' [9 v' V+ h R# Q K, r6 f1 W
" r5 N7 T/ q" ?0 s' {我怕的是什么呢?
- j' M x. S) R* f2 [* V- z+ H$ p' { l3 b+ ~; J
我怕的是,这个工具,只有大公司用得起。
o8 k5 c6 G* S9 ]
7 K6 u' ~( v; i! eAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?. w$ u6 l: ?+ x d8 y0 c. l
6 J. y X6 ]3 O& m, R c; w6 [8 U
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?( ?. U x: O& g% W: }% A
2 M7 h, u6 G% }* U7 I1 ]
这些问题,现在还没有答案。
* f& B) B, z0 C6 Y8 @3 _! b2 P' \7 M: D' O& m$ x. ~) ]& d
但有一点我特别想强调。
! G: T" k) P% f. S
8 x- B4 L: q1 uGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
4 S& ]0 t- R1 g8 Q
0 ^3 v; l' T$ Y! }以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
5 c% w; g( Q" N; e0 O" D) C) y
* o" ]0 Y* s6 sAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
5 W3 i4 w1 @, g) ] L3 ^7 ~4 H. T3 q
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。& P4 u( c9 R' @
& q* W" u! U& y4 P这一天什么时候来?我不知道。可能5年,可能10年。
8 k3 g4 @/ ?# K! }2 G: A' ~. G q: }8 L( m2 Y
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
; ?* o) ], Q( t! }8 Z+ d8 I. e! I |
评分
-
查看全部评分
|