TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
7 B; N# ^3 H/ z! ~" L9 B3 w
: C$ C. r }! ?* N: V6 `
2 F/ s. H* x; K( F, d% d一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……" W6 l, ~/ F- G5 [3 h
2 p: X8 S* y4 I
故事是这样的。
% |8 u8 u$ s7 u9 I4 |, y. Q) C, u- T4 O" H% ]/ E
我今天看到这个新闻,看完之后愣了好几秒。* G4 ]. u# P4 K. o' A
^, ~$ q8 I5 u4 S7 d
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
; s% ?+ n. n- ^0 n5 f$ n6 a; b) l; s, t" A
结果被一个AI模型给挖出来了。
7 k+ y& r* S* [! t. o0 J
; b* x3 `% C1 T6 w. ?: F这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。7 b8 x6 U) e) W2 K; _) j
9 H: x1 X0 ^* q" c然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。) \. R( B# t1 i" D
F L( o! t5 |/ `5 m1 N) T$ }
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。) I- D5 K* y3 f" j
% D J3 o4 W0 x. H* H1 T0 I3 y
然后呢?1 i6 ]) V f" v' U- A3 z$ e
8 e k4 w5 k9 F* Q: h: b然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。' W# M( @# U1 ~1 S% I8 x N6 d2 [5 f
+ W$ S& u" ?6 @# G) V这个项目,叫Glasswing。
) }# I3 ?7 C4 R. Y* H+ s: J# ?4 S. y
, v( [ y' O; P* O" W zglasswing: F g9 h, ?: ^
( z2 I' X2 I* f9 Z# L* L
' P3 x' Q3 F4 B; _先说清楚Glasswing是什么。
k1 q, Y" d) u: f, x6 y. v
6 y V- } x% ]. Q7 y3 z5 X9 b, d: R简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。- H9 n$ @4 `& C! B3 S% n, W
m; f; x8 W) F/ }- a
有多强呢?& v7 W- Q+ @6 X& N* m: ^
3 M, R) s. P4 V* y! i$ o) V0 `3 K
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。$ u \- m6 G! G5 @
3 T0 R" R' K5 [. W/ _4 l9 G5 N
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。* I6 ? I) P; J! b" n0 g
& H. O( X: Y$ f: @! O
差了13个百分点。
l* ]6 y; D& y' _+ c( ]0 F7 \$ s& t3 V# M' l
你说这13个百分点意味着什么?/ K- C( H: a: u F
" _) `5 u. G! U& ?* K意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。* M' P5 _3 \3 n
& D* n. q% m9 x% l! b意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。* u: A" ]! E1 P; f5 P+ B
$ c; V4 j X) W% v+ Y# V或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
|9 V# q& q8 G$ m% x) A7 X% S8 R$ N/ `' m- e
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
X1 h6 J2 ^; L3 [9 ^ k+ `1 Q2 Q1 L5 s+ Z0 u) _7 {
OpenBSD是个什么存在?/ g* h# g L J8 Z% p# W
+ {) R) u$ C7 p2 l2 n( L: A! S
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。( D% t' W' p9 q$ c* l
# l0 S+ ~2 }" `, O2 D9 p这样的项目,代码审计了多少年了?二十多年。
1 J( k. t' g2 b/ B9 F6 g% V" d9 L& O6 T/ j! X0 S8 B' w
然后,一个漏洞,在里面躺了27年。
* o- w. P( x( R- X% E) c7 q8 f1 U8 _& u# M& ~8 ^9 e Q
这说明什么?
- H9 ]! b9 a1 W4 X' D
+ y) S6 ^3 D } C8 V* u不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
Y- \$ m3 _9 `, [! c" \1 x3 h6 Z' {$ y6 k1 w: q
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
* P0 X! l- x6 ?0 u5 ?# `0 U1 ~# b/ Z
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。# g' ]4 a% \7 G9 ?& a
) C% \, ]% G* ^0 d; i
这种漏洞可怕在哪?2 F+ K. F% W5 ~7 |$ l) k0 }; g
# j' y! p0 a$ l& F
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。1 n4 h9 H: I; L7 ]
: q, {, A- |0 r8 Q$ [9 N+ n u# V
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。3 I$ S- I1 z7 e) {- a
: [4 b! B- x* g0 o2 k% w7 z
FFmpeg那个例子更让我震撼。
5 h! v1 F; i! M; p) L; L: l
0 C' F. D! m5 H0 P4 ^16年。9 }) i" O) X; u. C$ q9 F4 i s, [
# J! D3 `* e v# {FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
; |+ O) S9 V F" }, D V. ?4 g/ V& R N
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
4 n4 X. H) K1 l8 x9 j; X' X; U W$ }; e1 f' `
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
9 c: `+ {' r4 J, m L) j/ I
5 b0 [% O$ y! g" D这是主动防御,不是被动响应。 y- ^8 s% v$ ~5 p2 F1 H9 C6 S
2 [) c# J1 l0 ?4 c8 j$ v4 k- Z9 f
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。/ k. |2 [9 E; }9 Q v
% P9 n, l d3 n) s1 b4 T
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。) Q* D; j# D' h6 c M
. j P7 b$ {; n3 r- M/ `
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
0 H8 ~ I# i$ i% L3 Y/ R5 ~1 M3 e2 V* _0 F6 l5 x& N1 o/ R
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
# ^- o2 G/ _9 l# @- r8 {9 X" l, k( I! e$ ~8 n4 _
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。" A# ~: Q# K0 _* W, B
9 P) p( q/ V% `1 Y- e |6 t( m7 k这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。6 S: T! x& z0 f# Y' t% S
* q+ [9 N$ e6 O, B$ i8 b
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
! g4 V; w. s' I) k4 U
% W% D& x4 F* C, ]: l. o" s价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
o2 H5 f# Z! l+ `0 J, `! y6 e% @. D4 J
这个价格贵不贵?: A9 P$ ]8 L5 M
8 _/ D7 {$ I5 E& @' n- ]
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
/ I( ^" L- R3 t2 g
$ [/ d: X9 P2 m1 OMythos Preview能发现那些工具发现不了的漏洞。, w2 I" Y8 z+ j, {) T) d8 ?
0 `8 f9 w" d% V6 Z# z& v
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
: R( O( [- j3 I) a T, I- @1 ?) @7 z2 a$ C7 v, S3 T; `
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。' F: {5 P4 D4 b2 S$ t2 L
: b1 r" o9 ~" f这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。. t1 V Z0 g$ I; J. _4 i
6 k6 d) w4 S3 ~/ R6 X, ? _
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。* X3 i4 t8 g1 U! F: {
& w& t2 T4 B) _$ B! V' w {5 d还有一个细节,我觉得特别有意思。4 j) O6 ]6 B+ K0 H* z% J
3 U- }/ ^7 T4 E' S4 v漏洞发现之后,公开披露的时间是90天。
# ^2 K; s& B9 g" A& Q: t- c+ o0 W" @9 h* }+ \# B
90天是什么概念?
) `3 y6 R# U) D7 b$ F. V
- G4 \5 w' z. k/ B4 H; {行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
5 V' a' a, n2 |) }, `/ r* H) e3 V7 m: U/ ~8 s) R
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。6 E4 W+ L- {$ b2 z2 |$ c
4 Q. a/ F) V! X# J# k$ W0 pMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
3 P0 h7 T$ R0 X
7 I/ y7 G1 h/ L7 q3 G- k这意味着,漏洞披露的节奏,整个就变了。
6 E' Y; r. X* X8 h8 Y
7 G/ Z& T+ X6 }& Y* L& ~2 g以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。- H2 R$ c1 C- z. }6 Q
1 C9 c. B9 }$ T6 _
厂商的补丁开发速度,能不能跟上AI的发现速度?
$ b9 ]: w* \5 s# X) @/ o% S5 U+ w b. C
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
, _5 G! V( ?7 `2 N' M' B% ]
& r4 w% O' ~* O1 Z8 `0 ]% N( I写到这儿,我突然想到了一个更大的问题。: o4 F7 G: f0 N6 w$ }9 ] |+ D
4 n# N; F1 ]$ b- L! o" i; uGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。1 h. X. x" o3 H5 f' j7 S
4 D" W( l& _) i9 m, I8 a/ N透明,意味着隐藏的东西变可见了。- O4 p% V J/ S) k7 P- [ Z
3 e P$ L$ F% V; o/ D8 f# E& n- q' F S一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。" O! G0 j6 }1 I9 _1 [
& L2 m+ E2 o, P0 W
这个意象,放在漏洞挖掘上,太精准了。. X* a# m$ u# D5 H$ v
! ^; P6 K% E! A, E5 ~2 @3 Y8 v( @代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。* E2 h& b& k% u3 x4 c) P
$ N1 x, N$ O- Q8 e7 }, ^
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。0 V1 h9 B3 H4 U; p7 h
, J) O% p" G. l6 m6 x但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。* R# X5 u; {( ]5 b: n, U' ]' f
: z( u2 |# q3 E! r( z! O代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。3 y4 n- {& ?+ _# Q+ e* w
+ j4 }1 L, e2 L! J# \8 s这是一件好事吗?) w9 m7 `5 m& D1 v$ C
- q+ m( U8 R J6 Z% d+ V
我觉得,短期内,这是一件非常非常好的事。
% j& A% D! Q! y+ U# K0 X) h; `! n+ v( P
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?, e! U% |$ [ Z* }
) W2 o! t% o/ v+ Z+ y这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。0 u; d; H$ u$ N
2 z, J* E, `" N8 JAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
# Z: C: W4 e- h7 u# K' u+ _: i. R8 c+ _3 J
但长期呢?: ~. ~. d4 ~3 g& h
6 w5 ]7 g6 I3 G' ?4 E$ R# u d当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?& y: }! d3 A7 K9 b
0 E$ O, W8 A$ D H4 r: H是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
7 [1 H; X& }" x
4 ~$ O2 g! i) _. I- C4 ^, D; u我也不知道。
7 Z* C6 i9 v# Z: Y; [9 W3 G' k7 d
# R& C6 A. R! W6 f2 d但有一件事我特别想强调。
' [; Z5 m- ^) W! l( O7 \# A% R/ `: H4 \6 U5 `& y
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。/ i' N6 d4 K" j) s
q# |9 `8 P# Z+ n/ f
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
' B2 C) r7 k. x
: k. C9 U& k& ? ?+ E他们为什么还要加入这个联盟,用别人的AI?+ w9 m' _* }" X, q! ~ C
% j2 s7 {! Z1 u' n+ D/ G我大胆猜测一下:因为挖漏洞这件事,规模太大了。# r) y) e" s) v2 x
& |8 T _! z* j" b$ g( C7 P$ g+ r全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。$ _* ?+ [; s! P9 \1 m& }
' U6 s% h4 r- ~
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。( L5 w i4 z9 R8 A/ ?; ?7 I) O
3 l& B5 l" N7 ?' D, E, X! @这是规模效应。
- p, P- k' o- q- Q8 A8 F0 A, f" a8 H2 a2 Q
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。5 B w# \4 l9 r" k& R: ^( o
( h% I# I, R: V( J% X8 Y这个规模,是人类团队根本无法覆盖的。( x, U3 V0 i7 n4 |% p
! S" k, u+ N) L2 G* D& ^: p
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。5 ~, x' F; s) B
8 I& q7 A7 l& j) W( n什么意思?, o9 p6 o3 N5 y6 o/ X4 ]
1 u2 Z5 e0 B6 q3 j+ [/ ]9 E: s+ r现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
* U6 h9 a% u: }/ U; Z' w: b4 q7 t: P8 {3 q& `" ^# j( I6 g" ~
类似现在的ISO认证,但针对的是代码安全。 ]# q) r0 X7 ~- i3 F
- o6 m% N, J i( ~) n1 V6 U! l想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。. W: N# T; N6 h
: a" S: d+ g; _: y这不是不可能的。$ l! g& S: P D& `! Z0 C3 y
0 s1 D& Q; L/ c5 e2 W
当然,路还很长。现在还只是第一步。但方向是对的。
4 U9 S) {& S! q, ]5 ^
8 U% W$ {4 A) R好了,写了这么多,让我最后说几句掏心窝的话。
! ?5 Z. y7 g1 a$ V
* o( s7 V) s0 ?7 A Q0 u9 m+ [我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。 B! \! P0 W3 K F
+ s# W6 E; T- j! [! _2 ^$ ~+ o% ~
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。6 ?& \3 Z b1 a& P+ F
' p0 {2 a* P- w* l这次不一样。这次是AI在帮我们发现自己的脆弱点。4 Z/ J! Y; X( x3 M
, X8 Z c2 @' D9 d) q8 a这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
% q8 o- g2 f8 ]4 X( }# k, N0 x% Z5 s3 V5 E
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
/ H: T! ^' v" _% I8 X9 T: @
/ K' ~8 H% y; v0 a7 ^# a& J我怕的是什么呢?' d. {; H. { u9 M8 u
, L7 m! j! k, i" o; i! X5 n- l( c: ^我怕的是,这个工具,只有大公司用得起。
, }; S$ W! m7 {! f3 m% r1 t8 J
3 u' D/ |& i% XAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
2 ^ t; s% H. [2 j
; c4 P7 H2 F4 v0 \Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?* Q1 e# y% C. ` [; g7 h/ _* F
6 z6 e! N$ l5 W& \, p这些问题,现在还没有答案。
* A$ D5 P, V! N- \' {" i! ?- N7 n$ r3 e# G/ B2 M
但有一点我特别想强调。" p) V+ p; b1 y
, Z7 ~ z- A/ {& x" m$ c# cGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
: r s5 d8 f9 O( a7 N
( a5 C% |9 w% R5 ]- T8 g以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。6 Q: j6 j2 }4 G
7 G* j V( m, s, u+ k8 Z' D
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。- _7 h6 {% `3 U/ ^( z! C
% N3 t# X- D! g% P: A6 c1 x; @当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
1 U/ x2 `2 Q) ~2 p# }# v! B
* f4 P1 V# z6 v8 P8 J/ y* M# Y这一天什么时候来?我不知道。可能5年,可能10年。& h B& C$ s$ X" X/ _% A% \
3 j: l% q" X. j但Glasswing,让我第一次觉得,这件事不是痴人说梦了。$ @& z/ Z2 J$ E5 I$ {
|
评分
-
查看全部评分
|