TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview* p+ X) Z& k% z; x# `1 [: r# j
/ G% T3 b$ u! {. ~; b' o6 h2 e
/ F/ n& `0 |* i一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
* j& r% w. T) Y' }% Z1 P' `
; M% D+ C/ {9 T5 }故事是这样的。
* N1 S2 Q) a6 W0 v) B% `1 v
0 O {1 z$ s5 n' _我今天看到这个新闻,看完之后愣了好几秒。
) `( m+ }4 Z* R
6 O. b5 W8 _) P: V7 q一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
7 N# p7 [% O5 J3 V% m
V& P( d- P+ e% [3 p) ]* K结果被一个AI模型给挖出来了。: }/ t4 r2 n7 ~$ F
5 u4 Y0 j: Z; d3 E6 ^这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。0 t' [& g) z( l! @
; x. T' A1 F* m1 e3 {- j
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。: y. D$ w( V6 [; |7 i2 |
2 s6 L4 g) W3 o4 v) h
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。& V: T& f# a- I7 h3 K$ v( j
& e3 w2 _8 e6 n3 q6 N0 V) d- p; m然后呢?
, c3 R. T3 H# B" D( H1 L1 B& W, ?3 Y q7 P# c, p
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。* Z- _4 k3 m9 z
( e( X. ]+ T9 C; U这个项目,叫Glasswing。
, y1 ?# {+ b: d/ u+ e! N `* I; N! `4 u: H8 y9 H
glasswing
) {1 s% K7 u2 Q& R! l; [$ X) S: h g
1 k/ @/ ^. b* `+ u4 J先说清楚Glasswing是什么。$ G( x4 ]" E |7 J% L( m
$ T Z0 \! S& p4 W" }% y+ Z简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。$ G3 c2 Z& c% Y2 p R
5 W; O) s3 C! A8 A ]) M# B' C
有多强呢?. g# `- l$ q+ r( X- F' h
" O: A L/ B9 N% ~; [CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
$ \2 i! v9 E' @. k% C! b( U, Y' z/ W9 p& Y$ `* D
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
+ j2 c! r1 p4 T* X
% \5 w+ h- h4 ~$ F( C差了13个百分点。
! p$ z# L; l+ o! M" @6 i1 o) i! u; o2 A7 I2 r; w4 L
你说这13个百分点意味着什么?
7 M: f. ~* B" y4 d; G" u6 P) \5 Y6 D
4 t8 ^, X0 I2 E+ p3 i6 [意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
5 T4 R5 }* U: A& f" }3 x! P# ?# n; E6 U6 b1 A1 W, `
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。2 e% B5 w4 } a% r, H# j# q
9 N# l0 Y0 f7 J& ~或者说,这种级别的漏洞发现速度,会比以前快几个数量级。' d$ K8 x, t0 ~9 q, W( u
]- [/ c/ p! T% \8 G1 R说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。& J, J( h; Z7 J9 P3 Z" V3 `
; t% X* S# d* a: J+ n4 A K
OpenBSD是个什么存在?
4 T' G3 k6 \( Y1 ]0 v* ~7 @% E4 e/ f/ s
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
) E% B! _$ N0 Z3 U
5 A: r2 Y1 G1 _/ m; o8 |这样的项目,代码审计了多少年了?二十多年。
; P! l# X0 p2 u; J( W. I' J. c
4 v9 h% s' v2 x9 X然后,一个漏洞,在里面躺了27年。
$ K! Q! o2 h& v# T3 b. u. K1 D" L1 h/ z5 J- ]
这说明什么?! L9 g. ]) {# N o2 H
: J8 y/ f9 a+ Z5 ]3 T& J
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。' \, ^) Q( C$ ?$ Y$ ~# n
5 \- I8 ]3 ?4 a0 O; Z
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。( n6 e2 o) f- ~: t; u7 d3 O: Y$ t
, r2 w5 m$ ]+ _7 ?* k9 p2 aMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。* j& J0 \% H: I" S0 w& T
( N0 U2 P9 k; d5 S0 P& w这种漏洞可怕在哪?
, Q0 C' ], j! ~* k8 j& x+ ?8 \/ G% O
9 @6 F0 ]. {: O3 ~9 s3 J它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。7 L u0 e1 ?: T/ O5 U) N
, _1 e/ `6 J/ I5 j2 y传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。 e5 w/ l! J) I2 R& C e: N
: V: }5 H; b& t# |% P
FFmpeg那个例子更让我震撼。
: z: v O, W/ A x0 c# a% U
2 Y2 K* a) d5 P" e w# P16年。$ t! @" [) g2 x, r+ N. W
* F0 U: d0 J+ p+ `
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
/ B1 {5 X6 k: M: K$ S% d6 A$ f
! D4 k8 V3 {( N& i16年都没有人发现。然后Mythos Preview扫了一下,找到了。
) o1 z) j" j: w7 q% H% G7 B7 z
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。' N7 q6 X& o: _' m* I
) u# R7 c/ J4 R( c$ F+ l
这是主动防御,不是被动响应。4 g5 y+ i$ k/ q5 ?6 t
5 Z& l2 |! L2 h6 P- m; i传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
/ r7 a, ] m5 q( f. O! w3 x5 u+ [6 d
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
5 G: b) e7 \ R$ q5 a! G' h. X% U' T$ Q" Y7 G; |; v% s% ?
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
5 d7 f# P" C4 M
" Y- A0 T, P! H现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。% ~8 t+ }3 ]7 T) q' q
- [7 y. I v# [) u6 ZGlasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
/ p2 {' u, X5 {0 ^# N% c- b3 b
( |- W7 H% X- {+ a1 _这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
, j6 S/ l/ o9 h- d$ H, v1 ^0 g/ f4 o
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。2 S0 l" f$ F5 Y1 t/ {- |, ~
x3 ]- F; U4 M价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
) G5 b, Q3 o# G
7 j# o- R8 p" k这个价格贵不贵?5 L3 G8 y* a1 A: T0 i
7 {2 L4 t7 m; c5 |; _& T
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。& @- e0 w2 d, K4 [; f: d+ w
+ x' z+ i% b+ c/ K: J0 c6 I8 q. ~Mythos Preview能发现那些工具发现不了的漏洞。3 h/ B; Q: Q1 q Y4 y
& n2 _4 Z2 {+ j& U& H# c
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。+ j* l0 k0 y7 U/ C3 ]
, P2 u7 @# N2 h另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
' j1 o5 G; [ j m( s5 R, v3 v$ z: p6 n, j
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。
, S; v5 U/ e/ T+ E+ r; w
# E7 \) d* L4 V. z9 W: Z9 QFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。; d! `6 R% K, ?6 `
( ~/ z2 Y' b0 t4 l
还有一个细节,我觉得特别有意思。
5 `7 ?: h# V$ ~; `6 [# _6 z
Z5 [+ s) a0 W% m1 @漏洞发现之后,公开披露的时间是90天。( ]# W; \1 `6 d: e8 Z8 y- t
# i q3 h( z6 N$ h3 i6 `2 J
90天是什么概念?
) y+ q* V/ g/ v/ e1 c' G$ D( j! W3 J" a' \. j) ?
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
( n) W+ u5 ]: y+ k2 \! A) y) n& m p p9 v- ^! t, k6 G% V4 x
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。+ ]3 j) B/ u8 s1 ]
# N4 D6 v: E' b) t/ |2 Z" p6 Q9 m/ o! BMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
+ V( M2 s; o, m, |- d3 C+ @, C9 e5 e- ?1 P2 A! g8 x) b. C& @! {
这意味着,漏洞披露的节奏,整个就变了。. G, A. r7 b' M+ z# L t
9 T( o; q7 I" t5 Z A2 H
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。3 t8 W0 w% v- m4 g% e: T% I
( k$ r& R) y" Q3 C) E; v
厂商的补丁开发速度,能不能跟上AI的发现速度?) W; ]$ h6 c5 R- f( q5 D8 ^
% e' W* c% _9 J" y( V7 Q这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。3 f$ m# T: C q. ^) L. y4 B& A) P
% m& @+ k _ v+ u写到这儿,我突然想到了一个更大的问题。
1 Z" [' A( E/ z/ }2 [- S9 S
3 g% O, Y$ ]9 K/ [Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。7 x2 }- t v$ X4 N( X. w b5 v
z) i$ _- n2 a9 K透明,意味着隐藏的东西变可见了。) l4 N K" M" w# i/ {$ d6 {+ e, i
0 Q: f0 `9 d& X% a一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
, B/ ~8 L' c5 b9 e% R+ N9 F3 f% @6 E) M" _) G
这个意象,放在漏洞挖掘上,太精准了。' ^7 w8 M' u! ?3 Q- L' y
9 [* q& o# E; L( U0 L, H) K% p代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
7 w& P9 [! y# x# d+ j1 [. } p1 |( b" u
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
6 b7 V% ~2 [+ U3 V$ _/ J0 c/ {( N7 N* \0 \
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。- }/ A+ F: p) _- l+ X$ x1 v
. `4 G, |" U' W, Q
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
" F0 {) j6 C8 Q3 l* `7 O% d
% ^ w! X8 U5 [9 d. @0 y- n这是一件好事吗?
' C; X# K1 k: q8 Y3 ]6 B+ ~ e. F8 z$ F
我觉得,短期内,这是一件非常非常好的事。3 W2 u9 E ?$ l" X1 Q- B
/ o( g7 P! B% C( r9 e
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
$ {% `- {9 T& t# @1 {. T' m+ {; C; g3 J
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
5 w1 p& M X4 K: v, L2 a% l3 H0 {; y1 H
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
1 ^( l2 q. ]5 N' s a. h! e$ P9 H7 k6 A4 x: t3 M
但长期呢?% N% @" C( w( U" y
3 h; b) ^8 H, W, L! o8 G; o当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?& W4 ~7 x# m( n, \$ o; [7 h
. l5 o }: @; V: G' n6 A# j# M
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?9 `, C: M8 v7 V/ o3 |
% Q! x, Y/ l) `; U2 G我也不知道。
l( m* ]: o' d8 [, E5 P; O n/ u) M" F% i6 W
但有一件事我特别想强调。0 b0 t/ o {. U2 z
; W6 f; l2 _5 h w/ O- x
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
$ W$ Y1 y7 m, h% H1 _3 U7 ~1 w( ], ]6 L& }% e# ?. @* y
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。4 V7 K. L& e- h/ D
+ [, P7 W1 Y1 _& w
他们为什么还要加入这个联盟,用别人的AI?
. \( V' I4 B2 C+ g' `4 j
6 i! k. U' i" Q- o; d8 ]( F) k我大胆猜测一下:因为挖漏洞这件事,规模太大了。& X1 {0 {/ x& S* [) C' s
y7 u1 f; V: a1 F( }" [6 S全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。: {( L8 ]4 }) E0 ]2 g# r! ~
5 G/ s: h, q" [( A3 m, f+ XMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。; W5 E- Y% Z7 T1 j0 _
( V7 w% n9 M: T* X1 q/ q, ~# w; N
这是规模效应。
m# u1 A# M, d# R2 ]$ v
7 z4 u: M% S$ k* Q* s( i就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。/ k- D# @+ r; h$ w9 [# A% K; A8 q
7 |3 R& j) }( z; {这个规模,是人类团队根本无法覆盖的。
- r% e. g B% j+ b& [" p
& o; m. G# O3 ]* Q7 k% S) Z' ZGlasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
p* }& g. D( R$ z7 s4 c. J4 D% T
4 I3 S! q% m. p9 I+ v* ~+ u& h& i什么意思?" D* R( y: e* ^# b/ V* Z
) _) w% V, A3 T4 L3 F9 D- k2 A
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。4 T7 M% }8 D6 T) d' x. B) t
- P% |- g- t( a9 E类似现在的ISO认证,但针对的是代码安全。
* Z4 _* i4 ]; c, u
v$ n) b" m7 r( w想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。- W( ~# e# L5 i, [$ @9 X
* ]7 d1 K3 m7 V$ E这不是不可能的。
/ t: Z* P3 h# |6 c4 c; a5 p
( w: a* K6 h( ]当然,路还很长。现在还只是第一步。但方向是对的。; \+ v# y- D3 h! M4 A
& J" {2 v( R' A+ x
好了,写了这么多,让我最后说几句掏心窝的话。9 H2 B% E. N8 s" Z) ~6 O- \# j
) T' q) x. L: k$ z% ?) W
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
2 H' G" X- C! @* Y
; i9 S' f" f# m3 r兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
; p& ? l- q$ B; X( ]: ?
& O7 A8 y8 j& e/ W0 d! j. J5 O这次不一样。这次是AI在帮我们发现自己的脆弱点。) W3 e0 R/ [4 s7 }1 \' f
8 X1 @4 W- o7 L- a1 u6 `
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
* ~5 F9 f8 o. e( O4 l4 Z
2 {) L- n* Z3 Z: Z) Z* H这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
# A7 x7 u4 w5 o# B7 D7 X- S7 U6 h5 ^* E5 p& j
我怕的是什么呢?
2 e: P5 q7 d. [, }* V1 A1 [7 }; v" w4 x+ ?( L
我怕的是,这个工具,只有大公司用得起。
. A7 b% A. M- @1 T
% O6 r$ U( i* S# W3 N/ n1 p1 ]AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
: r! I' r" A, T) R- z
' [0 T% n7 O0 O( L/ |7 J7 y9 lAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
# y) q; f( I% A3 T5 ]( r
/ ]: [8 u! D+ `/ ]这些问题,现在还没有答案。
' } G% p7 j% J2 } _/ `: Y* Q3 H5 f3 r* u; I, X% h4 @% _
但有一点我特别想强调。& t4 [" n& n/ D0 w, Z: m+ g
4 M* Q7 W* n+ J `/ S" w+ I0 H
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
: U) X2 g8 A9 D+ D
2 Q1 \* ^3 E) q/ X% _- p& _2 h以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
; O$ J& h% M Y8 y/ n: h+ N; `
6 |) l+ I* A3 N! K1 M$ G5 VAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。6 u! s0 X/ `. W: L' n# X
. J4 ^# R' d" z4 ?- i f
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。7 O, @1 r% C0 \
/ s' ?7 I! }: @. @6 y这一天什么时候来?我不知道。可能5年,可能10年。' U0 C3 K- M% G+ _) p0 v5 ^
9 W# s' b/ B+ |2 Q* x* r/ z+ `. o
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
8 ~* X" O7 t! E. d) o, U2 l |
评分
-
查看全部评分
|