TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
& ^* @! J' H' K" r( E/ u5 p; c) |/ G2 F6 L& I
8 l5 {- O% `# g" M: ^一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……3 E" L( \( E0 A$ l& ^+ X: h& V
1 o$ q2 s* C' m5 [2 j: l6 Q
故事是这样的。
3 o1 T0 t. N3 j
1 [0 Q: o1 f" q) p( g+ e我今天看到这个新闻,看完之后愣了好几秒。% u4 N p$ g1 l8 a f6 l% S- m3 ]
# u$ j& n0 N, Q3 s一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
8 H- M! F5 S! c) M3 Y& k. ^( F f- {( r
结果被一个AI模型给挖出来了。
" n: K% h H" X' J7 q2 Q
6 ?6 G) H$ G q* P" P8 s这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。4 ~# F/ D# r5 k% L6 Y; c% [
$ ]8 d- ~: c: D然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
' F( H$ |8 o' k' @1 J4 j) _! K3 P! u X
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
1 F/ K6 W* d9 x) u, B; K" G7 I A$ z' m: D
然后呢?+ o& E, G: k9 N/ o
% _* a; M4 I& L% Y# g/ C8 w
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。" ]/ f8 a/ ?$ N0 M$ y# W; c
0 g: U7 D( V& d6 w" m
这个项目,叫Glasswing。
) } z4 w( D" o0 Y8 V0 P
$ w$ t' y' J1 s5 r. g nglasswing
! D1 M7 y- Y% ~! g# m& H0 a$ z" }/ K+ H
. J; _% e, A/ I
先说清楚Glasswing是什么。/ n! A5 | R+ U# T
3 @9 V: a9 [: O! V
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。6 w( \1 E7 Y* k: i+ l
7 K, D, S" x- K+ j) R0 o有多强呢?7 E' f D; T: _6 s6 a- \
6 C9 E% _$ @* T& P; {0 a' x
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。4 _4 i8 I" {" [: q& X B
* G# d2 ^/ |* U$ L: [SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
6 d' o2 \# N1 E- `) `5 C0 X
# c H# P) A9 i6 v! _% C( |/ W差了13个百分点。2 O5 Y+ r. W2 ~$ E* w
& m j. L) C7 O( \% W% b你说这13个百分点意味着什么?& M' o2 R, V6 D9 E+ b% i p
7 j4 U' I; Q+ v/ _8 G! J3 F4 [6 ]6 N1 X意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。8 a! E% a/ F! U# Q& ]
6 y, I/ O6 P5 O6 D, f# [
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。9 O+ a' D$ C1 Q& S
: E4 \7 Y. \6 V. J
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。: l% H/ G) n9 k& y6 P* u
, Z8 Y. \: @; U7 Y说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
3 g7 a5 ^7 s- M2 w: k9 G* S" b; T3 _+ M! p4 R$ p7 j/ U
OpenBSD是个什么存在?7 m, c6 ^+ l" R Z! y
$ S. [! E" T% r' F* @它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
6 g# K8 l, \% C2 A ~" O
' f9 J H( J. P+ @8 z6 k这样的项目,代码审计了多少年了?二十多年。/ h/ d5 D/ w# r( e/ a' D- p
5 \" H d$ T4 C- w然后,一个漏洞,在里面躺了27年。, b1 X1 V% `# ^3 ]. H" J$ J1 d0 O
8 d- E& k1 M1 C# k. G这说明什么?% }2 R% \4 Z7 [" x5 V
3 G. s D" `1 U7 s+ ~0 U
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
0 {; L2 r4 B% w: B( @4 H% O& N
( A; [$ n4 f9 ]* r) \但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
( e2 V' D; J1 Q0 J2 u
$ @+ b. i8 V% y% l; J$ M8 sMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
3 b" B q/ j! M) r* x( \
) L0 \# q- I9 ?/ ^: D8 @( F* O& u' R这种漏洞可怕在哪?4 _6 v' M1 {4 S/ Q9 `$ d
3 v' s( n% q; x
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。5 F% M$ g9 x/ O+ ]
2 o8 ?' B7 z% q0 ?! W
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
. O* f5 B2 T% s! `
1 | U/ g ~. E, Z0 g& yFFmpeg那个例子更让我震撼。' J- ^# W) W ~& j; w7 ~
5 o+ R3 S$ @0 d/ R2 a
16年。! u4 i$ `" ?0 R
! ]/ C3 H3 J0 TFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
: f# @3 e( n( q) t( J% \4 m" t& H: \9 @, R4 C+ q; S
16年都没有人发现。然后Mythos Preview扫了一下,找到了。% }; N* N" r* t0 P9 ]/ R9 y8 A% M
0 G1 u P3 p0 h注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
, U& X3 J6 P0 e+ k0 D g9 u5 D; Z4 @" u4 G6 k4 ?5 ?6 t
这是主动防御,不是被动响应。
1 {5 \% a+ R# a. Y: k1 c7 Z$ V1 H8 _! L. F) c1 G
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。) M% o3 p+ q. A1 _* U# o* k
( \, X6 y5 \+ X% _( JAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。5 m# L* d! p, d* D* b0 z
. [3 T, r* `, W5 _
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。& {2 s0 U/ S6 [0 `( x) @6 h! ~0 S' h
+ f: Z3 O$ V5 v" K6 P- r现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。; H5 T0 T5 u& Q- `) B$ a
& }. c4 i; ~0 A
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
* a( ~! h2 K2 P/ @; b8 ?
, ^' k% V& m- B这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。* {: G3 J, B7 P. T9 B+ _2 K
- i' b2 ~! L! L. `你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
: `7 x8 v) F/ a6 Z+ a2 E" K0 M5 c3 S4 r H' P
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
6 ~5 N3 H1 r* q' {
" o7 Q, H( C$ O0 |# s/ W7 V& \这个价格贵不贵? U" L0 n" z* b5 W( U
* k+ `) I% j: E2 t3 ~对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
7 ~2 N5 }. k, m' X1 Y. v
4 H5 p% H4 e. i$ Y, h* |# L- l& Q! |Mythos Preview能发现那些工具发现不了的漏洞。$ E7 L) U; A! v# B% L
4 r& \9 v6 W; z1 `% q' ]+ m$ m这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。9 ?) n0 l4 [% X9 h# Z4 _
% f" d* k; W# m9 O% ]" @; `另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。+ d; D" ]# t3 w6 T- }+ @8 v
]! M. ]; F5 ]9 Y1 r$ L2 `/ N
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。, o8 s+ n% u4 m, H
: Y8 _" ?, k$ C6 l% g4 hFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
Q) j& @: { V- J& U
# B% H) R: Z" v; M4 k) y o7 m" r还有一个细节,我觉得特别有意思。8 {7 @+ A% D! r, w. V
! g0 Y$ u5 k) Y) \% c4 o" p6 I
漏洞发现之后,公开披露的时间是90天。3 n- ~' Z; I% R( |" q( P2 C
. f' @# M" ~4 G
90天是什么概念?5 G8 j9 A: g* o% k1 W
4 d( W$ [: w4 d- L% L5 O
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
2 T) O* J. Z. P2 w
$ j& u) n4 C# J0 l/ `- H但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。6 v$ V; ~( P6 K( H1 g. I$ `; u, p
3 n: g# \0 c7 p* v+ K" a
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
' a. P3 v% y8 M" @$ K' d
1 G x% V' o. Q+ w4 I4 i% C' c D这意味着,漏洞披露的节奏,整个就变了。
7 H$ B" U) J k# A1 T
" r& ^" G. F, i4 B5 u$ ^以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
: v* s) O7 ]/ t* p/ K9 ?" @9 l5 V: h
厂商的补丁开发速度,能不能跟上AI的发现速度?
1 ]/ A1 M6 w+ N) t: L; f
5 p; x5 H9 Y9 ]8 a这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
& T/ y2 n2 o) C* ^# z( y
$ y. t' W0 g/ ~# [+ b1 @* C写到这儿,我突然想到了一个更大的问题。$ M, z! ~0 u8 u6 a0 M; W" G
* x9 Z& ?1 B, }) v, \* K+ YGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
" l/ j" w! i' {- R
9 F; r4 |: Z% k3 i% v透明,意味着隐藏的东西变可见了。
7 V8 Y/ h. v4 E4 Y& U' `
8 M" O3 Z% x* m) j8 z8 V% i一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。; U5 f5 x$ T. y0 _, f/ P
- A1 r, W y+ G% c2 m0 ]
这个意象,放在漏洞挖掘上,太精准了。
9 ]. c6 J# @, U5 X
$ V: i3 V" I6 K5 ?代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。$ e( G1 r- V) h
0 G5 @9 ] O- i Q+ t" m% E( o以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。* h1 K: ]. T+ P9 G7 w$ r3 K/ C
9 d# e2 i- ~3 D
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。, I7 T Z3 O& ^, _- ]
' P+ L' H. L# b
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。5 }) v5 }1 G. |
! G) q2 w c. e7 O5 H这是一件好事吗?1 p6 P- n% e+ u+ q) J
2 {# t" g% a% R' K* A o7 b* i1 _我觉得,短期内,这是一件非常非常好的事。8 ?7 [6 G J" r7 w G( \ Z) j
) \ h- N6 i" V* \
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?1 f, K( F8 _5 @0 i
& C# k r6 y; W; _' e这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。9 C( `) l7 s- V, d3 |, F, j( Q8 n
I$ r5 `( K$ t& l8 P9 CAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
) z* E+ u4 B+ y. M/ I Z, w* s' [9 h3 Z4 X" [$ N
但长期呢?. X8 |" U4 F& L0 n" h
1 u3 f4 k) i5 Q当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
$ P8 Q" w( @- A% M9 G6 j
1 s3 ]9 P% m3 |1 ~是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?3 `7 O: U! m$ Y; S
: [! o Z* s! `% O我也不知道。
( I9 h- C& L( y" I2 ^; s/ u$ f9 w$ `1 K; @9 b1 z T
但有一件事我特别想强调。1 s' @! ]; Z' `( G2 y, r) W5 ~$ w
% S/ Y- g: G6 I: j. ?& u# ]这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。+ l% P" y, e/ w) p: q% M+ n
+ e# `. s0 ]* L5 M7 B
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
1 d( E4 O; I; U& J( y+ j# F. {. o. o6 l
他们为什么还要加入这个联盟,用别人的AI?% _5 D, g% N: @+ \! p7 e
+ F. I/ z8 I# Y
我大胆猜测一下:因为挖漏洞这件事,规模太大了。
0 Z, w; {1 @% z: L. p
% w7 Z U2 B& s& ~( S9 \) `全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。 U+ g! J; w5 H1 c+ M
8 M6 H" Y+ _ N! D/ t& IMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。 ?$ |7 j- W( q' v2 }1 e0 y/ f
2 n7 {; h+ n3 F这是规模效应。" Q0 R V* v# e# ?- s G
- s0 z) z8 d& a N) I, O
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。6 K1 H" r2 L( Y4 ]- u& [
$ ^/ I m' N: @1 E3 T这个规模,是人类团队根本无法覆盖的。
- C# B9 t- G& J( j
* F% J n2 I0 a0 v# u+ TGlasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
6 X9 a' A+ i8 A5 j1 v) b7 x
% Z7 M: z- ~" A什么意思?
( n, h7 T4 v- Z+ L
. s! ]- J* e( G( J3 e现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
. Y/ D! c8 P/ o# r" _- c6 z" w& J4 ~: [2 p
类似现在的ISO认证,但针对的是代码安全。3 s( \- i8 w! @5 m) B/ U" A
% }- z& a# j0 Y5 ^/ ]
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
+ e2 f: i- Z8 N3 q7 ?- ~5 n' v: I, J) k3 _2 J0 s: ]1 T; Z; M# k* G
这不是不可能的。
% M* R$ F1 h/ n& Z( J
' t" @8 \* Y" q ?当然,路还很长。现在还只是第一步。但方向是对的。8 y( ?& ?# U+ O1 d! a/ C: _2 U" ?
$ U' Q4 q7 [% [; `好了,写了这么多,让我最后说几句掏心窝的话。: g! _) ] b- ^1 A: x. @
8 v \ U7 g6 K) d0 p2 y7 o2 e我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。# X! P4 g4 l$ _/ ]. i, U
% u+ r2 I# U8 B# t' f: z) F1 P( l# g
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。' m3 G) N7 a; i! j' D3 T0 D. ]& Q
7 @+ u& A, h6 B+ X6 ~
这次不一样。这次是AI在帮我们发现自己的脆弱点。9 L- E- q: G9 u
# d+ n* M/ ~) H/ G1 P4 f" _: C这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。; B f& L* Q! R1 W' Z% a0 p
% A* V. \- f( c* Y- o% F
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。4 |6 B: Q- x1 T* j) u. C
4 n( H8 b# {& F; c- q我怕的是什么呢?7 |! Q+ p8 h: D
6 U ]: f5 v& D% f我怕的是,这个工具,只有大公司用得起。$ D6 Q3 D4 @/ I
) S' f5 X0 `7 g% a2 [: L/ O' XAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?4 p3 T5 Q. b& i$ f+ C5 w7 R1 E
' W" U, b6 a3 Y
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
7 b4 ^ u# T9 f/ ~# K1 f/ x2 F" s
. P6 J+ Y4 n5 f1 y+ j+ G& i% `5 V这些问题,现在还没有答案。" k8 J; O# d8 Y/ o1 K, d
, d6 A6 p& F" e {, B w8 L% _
但有一点我特别想强调。. _6 g* [+ g5 r' S
& L. d* q; ^+ n. _* F0 _3 \Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
2 E# K4 k! C, y& k! I8 o4 P0 h& q
' Z& m7 X4 w' |3 I$ ]3 W' e" _以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
# p0 W5 w2 L1 k/ v7 L- Y8 ]. x
$ P3 Q2 C \9 t& b% H; ]AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。# k( H" F' f9 U! g p8 f! d
- C& X- Q& J# I$ f$ h8 k! J当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。& Q) z, ^% T+ N) d
i" ]) ?) G$ F3 ~
这一天什么时候来?我不知道。可能5年,可能10年。
# l( V8 g9 [2 J5 e
8 ?4 `* H7 Y" k* u" u+ J但Glasswing,让我第一次觉得,这件事不是痴人说梦了。7 ? `, ~- H. U: m" B- j+ x$ o
|
评分
-
查看全部评分
|