TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
. T6 }8 {$ h; W" f! I- i
/ h" L+ z5 t8 m9 x! q8 N; \0 i' h
$ \8 M" u, H' k" V% ]+ j5 r8 p5 p一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……8 {% p5 \" O3 o) a ]
7 _/ k6 D0 X! U; ~$ x故事是这样的。
! s- r$ k- E% M" J
. Y D* B9 H1 W: C5 N我今天看到这个新闻,看完之后愣了好几秒。! N- E6 {+ f1 z
% Q7 C7 V$ E) T2 V9 o7 w( S( g
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。4 G2 Z; y2 l) m) u, v
/ B/ S# {- {( m0 k结果被一个AI模型给挖出来了。0 a9 N+ A0 X3 M4 F, G+ Q/ ?, U( r* V
: ^7 E- t. Q6 H; V这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。1 t9 E# Q+ y7 ~2 |' m
& p& O$ y& B1 D) F: q+ \然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
, G* Z) t* Z# ?8 l7 q5 A6 v! C4 e% @- ^$ x# K9 z! _ x
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。' X- {5 H+ A' b
% }3 `8 x- h* E% J" i; g然后呢?: p: _% J- _4 v+ T% ^+ U
9 H9 I: ?" h) U- L& w4 ~然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
- s: L$ Z% u H# m) g
! b7 t0 ?1 |/ H7 |这个项目,叫Glasswing。
1 b2 g7 Z4 W! y3 d
$ f4 N5 P% x# U D9 x% Rglasswing
7 K( P6 g, P) _9 e1 U/ X/ ~; S s+ V" }! U4 ~9 V) N% A
; L# V7 | h# ]) A8 M
先说清楚Glasswing是什么。
& i, E+ a! t; P8 K+ J& c
9 s9 @5 Q# X% w: |5 b7 b3 P简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。5 {2 ]; j! H7 a f6 \
( ^0 D0 R! X9 M# K+ |
有多强呢?' E I- F+ {0 I+ ]3 b
, H4 Q8 `8 l. N+ u
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
; I' b; C" a9 b' F; ~' _6 h2 \
- I3 i% V1 z6 k7 E7 fSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
+ G3 @4 Z- V6 O: H* U0 x
/ h4 P8 V: S1 f, C# t差了13个百分点。2 a9 C. W; n+ R0 q
n v+ g4 Y3 x" F8 a$ l你说这13个百分点意味着什么?
* f- U! A: F# f5 W; A5 ]
7 X1 T: Q6 `( ^ T9 T" }意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。9 s. [7 z5 d, ? ~6 v. r
9 W; h# d4 Y9 s意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。) \0 ]0 e5 P' A4 x' h2 L" G
& `/ I! `; j- O7 s9 d) v
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。" Y5 i" L, R- H+ w4 k( C; d
. ?0 |" J+ j/ V8 U" ]说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
2 X" N) z1 S D c9 P7 X# }' s; X, V9 X' G
OpenBSD是个什么存在?
# p# v! }& V# t/ Z: ^( P$ {' \" C) \
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。, q( x! v9 J/ f/ g- `. M6 Y/ f4 ?6 g
! ~0 N8 k% o8 Z这样的项目,代码审计了多少年了?二十多年。 F- F" U* g- w; f
( x% [8 W# |' P5 K2 S
然后,一个漏洞,在里面躺了27年。
9 [: r3 O0 H; u$ {4 y; I( k
- O f Q) C$ n, q2 D0 Z/ C( M这说明什么?6 Q% @6 U- ~" E
5 T& {4 Y0 z6 @8 N- G
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。% ^3 S% u4 x) B8 @
5 [9 ?2 p4 }6 h0 C
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。& _' R: B. P3 {5 b$ K
2 D2 I( q* h ~Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
( c* m H! c) W: I& S
$ T, X3 E5 a1 T9 o; G! h) B+ o这种漏洞可怕在哪?
( ?$ W/ |' ` M' {. C9 c4 i4 A# ?
/ Y( T0 K% I2 D% E/ V) E' v4 U它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
; B* a* V. H5 _* \( }# [4 x& n" y) D
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。4 e( N4 M* i4 d: a
% @( {* i$ y/ Y+ s# @
FFmpeg那个例子更让我震撼。4 R% ?; L* c' G' b% @ A% F0 S
/ z7 p E' x4 S/ W/ L% }16年。2 m* g2 d% ]8 F* g- E
$ j$ k9 q- m6 ?1 T- ]* b) mFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。5 I6 m5 T3 N$ J: Z I% ^- Z7 y0 t
% e! k6 j. ~: v16年都没有人发现。然后Mythos Preview扫了一下,找到了。4 E, v" f v7 G' u0 `( d8 v
( V6 R) [& X9 T8 g注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。5 x1 ^3 A' X5 G/ D, g5 y1 w
- U" \" x' f7 y; A" {这是主动防御,不是被动响应。
& `; g' I" [+ T- A5 b
d. }, } b$ @; k# n/ R3 f传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
. ?' H8 u6 P+ J& s' B
: _6 h h8 w! z o/ Y$ h1 hAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
z6 |. e. i0 T- b( ]
6 |! W$ ^- b! `3 d$ r6 ^' Q1 D这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
3 ~: x, V4 d0 F* v6 X8 ^! P$ K" [# ?/ C! d. ~9 `3 V
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。2 r! S, W, W$ j) d1 D. p
1 { S8 y# e- \1 Z0 `1 ^: }9 p$ n
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
d" p. Z- \8 Q% u. G% [) C" N, C7 `" k( ^9 ~
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。; `4 c1 S* {+ X; Y% m' ~2 ?3 Q
) X7 E- [) r" q% ^
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。: k2 H% y; j2 T
. k) c& t [5 H$ R( D! S价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。8 k& ~- v: ?6 f" j7 w
# P3 S: ?8 R. w+ q3 I" ~% S0 {
这个价格贵不贵?
`% h& [' G* Y* A
, m( R5 m9 ^4 I' ~6 {$ m( b k对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
) Q1 ]* g, d ?" }/ z# n0 `7 |) T- |2 h3 K
Mythos Preview能发现那些工具发现不了的漏洞。
0 c0 Q/ t: i) S+ a; I3 V! G! x8 z1 |; G. O, p
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。( F8 E: K5 x @0 r6 H" p: ?
0 S2 s% D y+ \/ b! @
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
- y/ l5 H' l6 [( L1 m3 [, u
* x! e( ]/ d8 M3 h: {这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。, b& [; q; _+ V* b! D
: |7 d, F u. i' ]) M8 Y6 x
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。) q* B3 t2 ^/ @6 H( k2 \) e/ U
H& l; D5 |4 j6 M' x+ a/ P
还有一个细节,我觉得特别有意思。
8 K8 w; x: {7 a0 [3 K0 j- z1 i4 X0 k
漏洞发现之后,公开披露的时间是90天。1 y& n7 B/ z9 C; v1 c3 U
& g0 D$ m1 |1 B* [+ _1 f5 q
90天是什么概念?
8 w1 R7 C0 q$ i: W/ {) y# j+ d2 y( \+ A/ r# f D' k
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
Z4 Y; h: l& o! A$ V( w6 s& ]" z
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
* `7 K1 F" O) G* e+ e3 `" n1 _
4 F" l* w5 n5 r. f" Z8 A% n; M8 L- IMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。& i v0 w0 P8 R% [! _1 j2 `" W
( z# M" p2 x7 G# B; B. o" L8 O
这意味着,漏洞披露的节奏,整个就变了。
3 [2 I# I# E$ C; f. i2 G8 i% ]7 C* F! s
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。- y" ?6 R* O' ]- l
( e W) |6 K8 D( Y5 I0 _2 h. O g5 ?厂商的补丁开发速度,能不能跟上AI的发现速度?
. f2 \. \4 }7 d0 i" t
" B5 i& r) ~. {8 a- h. U3 Z( D/ t这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
; d w+ u" n# g- i% X4 W; @" \
4 @9 `& e6 |; {* C1 D写到这儿,我突然想到了一个更大的问题。1 R6 B7 \* p7 w
$ K+ |' F: B/ A
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。: T; S1 E9 D9 \7 R7 ~ W
( a/ K6 F* \ G0 x) {透明,意味着隐藏的东西变可见了。/ ^3 n7 V( V+ C& s% ^
0 \# z" O; b' i. i, j6 V* T
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。/ t7 S2 H3 v# l7 y) ?# ]1 ]
6 }. B1 ^4 s! ]' m这个意象,放在漏洞挖掘上,太精准了。
( P! ]2 V) f& d& H6 K# X) \
: W) L% c a# E5 C6 L3 H9 v+ z代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
$ K; B* q) }; z& v' @; L0 ^# L2 {% d P1 E% z N4 ?8 @
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。, f, l. j- R* A& A: f0 I, V
+ e g3 V# j& r- B" h$ K+ _
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。% f! E0 z: V4 z1 P' h" L
* M, W. e# |8 F8 W代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
% ?+ o5 H; u( Q2 d. u2 L8 B& s7 O; Q0 Q$ i2 e/ {
这是一件好事吗?
3 H# l& `0 m" e. D+ m" @# k9 e
2 e( w& f. R3 f我觉得,短期内,这是一件非常非常好的事。) j& ?/ g1 Y' C7 [0 M% O& k7 Q
) Y% e; O7 |) Y* ]* ], F2 m全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?; }0 {/ D) }$ E7 `
/ p) I+ k {9 ?$ P% L7 U/ o这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
3 N) W. l/ C0 v- h" S
, f7 H9 x4 ^* pAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
/ I5 n/ e: R) p0 x* ~/ }3 k
% h! c1 `: _$ z+ V, X' m3 r: H但长期呢?
' T2 D; E8 Q+ `4 Y8 f
3 Y9 Q$ [" B+ ~- K P6 V当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
, s& |0 z2 d/ G/ ]# |
& ^1 X+ v; i" K6 Q* X2 N* a是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?9 ^, A2 I) \# M! ~- V
& m. r, k, h, t9 n. H( m2 h6 F2 [% Y我也不知道。
: }8 L. K0 u0 Z1 _5 Q3 a* h5 m7 B' v+ ^! s$ U. `4 L% O& x
但有一件事我特别想强调。
3 N. E! d! @* \) q9 i2 v, s- U
# y- f- L) r! `1 e5 s这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。' a6 O$ j: P% B/ t" I6 e
" ?: m" |8 a( _2 b他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
8 `4 [3 ]# T9 p8 t6 Z. {) d6 O
: J8 Q3 H, c2 _' w5 {他们为什么还要加入这个联盟,用别人的AI?
0 `# Q2 r) A+ B" v- y% l1 _/ v
8 s/ z4 i7 n9 r. c, L, B5 n我大胆猜测一下:因为挖漏洞这件事,规模太大了。- i! F1 P3 J0 Z! H h7 Z% x! W
) L8 T! {2 V" X7 l9 h
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。5 A6 y+ j( v( h/ c0 H: R
; U& q+ L; |2 N7 M* a
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
# y4 t( |' F4 ^
, M7 h6 F G! c5 [/ z7 V这是规模效应。% ]$ u h7 n+ K1 U
$ W0 p" X. f' U* j: c/ I' f就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。% O; l8 F4 L+ E+ ^4 w" s/ B6 [" ~
) j) Y( j' w: ~. b! V% Y5 O这个规模,是人类团队根本无法覆盖的。 F, f6 s1 K% I0 z9 Z+ c
9 g- ?4 l% o3 A r$ o
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
) I" ] Y. V6 q2 i* A7 ^/ L! @; y& T7 Y' ~# I& H5 x7 @. K
什么意思?2 P3 ^" Q7 R# v' k/ V5 a( q
4 `( _4 G9 ]% g) {
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。6 z+ e! s( Q1 s8 H9 L
: I: Z; x: ]5 T
类似现在的ISO认证,但针对的是代码安全。
1 Q$ s. N8 L9 D! o& y4 q0 {) G/ t2 k/ ]6 @4 ]8 o2 H/ `$ C
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。* L" `, R; g3 N; x6 Y% N
: _$ t1 _5 k, r+ l$ }; X. ^
这不是不可能的。
+ A: q2 c. a$ d+ g2 p, A3 i) Q$ c. X( j! j
当然,路还很长。现在还只是第一步。但方向是对的。5 M/ g4 s) E5 R! G1 T4 E
+ N7 R M; ^5 m5 T/ H; x; J6 @好了,写了这么多,让我最后说几句掏心窝的话。: ~, f8 @) {# G! q
5 z/ X% @7 |' p% _* _. X, y
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。6 C1 a7 v5 L8 T. d! A' l
$ I4 Y% v# d3 X
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
& z$ q% [7 f- Z Z. `6 T9 y, ^+ ~4 M& l) k" p. A' Q
这次不一样。这次是AI在帮我们发现自己的脆弱点。
$ c3 r7 x/ Q& ^& Y' J+ ^. |, a) Q/ W9 h( B- T6 i
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
@3 \/ Z( ^! ], Y: j9 R i/ Y- L) P) e. W2 w6 g- a
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。2 c5 T& m% Q. }
+ m! Z1 g/ t: I) I' n( Y& A4 V# h
我怕的是什么呢?
5 J$ E7 G3 O0 q& I3 @# D8 @; K
. U' M$ c5 J7 L L) x( D. e6 j我怕的是,这个工具,只有大公司用得起。
, a v& \; s: b& X! O5 }
4 M& [+ e+ S, }4 GAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
6 L9 B2 j% ?( g" J2 ~! o! i. t5 |% `, A6 v- o
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?& y$ @/ d% p* | f- ~
& ?. ]6 p: |* {5 @$ s这些问题,现在还没有答案。5 c, `5 T3 \, e& ?& u
8 Y% n- a. z: ?6 ^3 O1 a
但有一点我特别想强调。% [8 n+ T& t& C9 Q0 z$ q
3 E+ O$ I P3 z7 ]9 E2 t+ CGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。4 o% ^- V, C7 {; P1 U* ^
* |+ J$ I/ S6 Y5 j& @7 Y$ `以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
# ]) A1 h5 p K) D7 ^, r2 D5 z7 D$ N4 Z
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
S7 [* X' `8 ^5 Z8 S9 D6 ~ P" k5 C2 x
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。4 _' K% ]& Z2 ?$ O! m0 N' _2 }7 [
8 |) V1 p" A( z7 t; L) S9 E这一天什么时候来?我不知道。可能5年,可能10年。2 E' ? Y: t0 a. J7 Y- W4 n1 f
2 E5 d4 |* m8 `. F z5 M但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
; h6 ^" J# |9 L$ ]; _, k6 l |
评分
-
查看全部评分
|