TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview$ w* x- N, h _# C I; A/ Y" W! C
& S* J1 l) E- o0 H7 x5 ]) ]$ Q, P7 c( F1 B. X$ }$ y9 L/ J
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……# y) V9 t2 G3 {' @* H4 X0 `) A
/ b2 Q# Q" d/ r故事是这样的。
8 u- x) A' R0 N4 n' m3 D7 G3 p& ]. d1 n3 u
我今天看到这个新闻,看完之后愣了好几秒。, E' j3 [) d- [% k
5 e j( u% t- u [5 t+ |一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。& L+ U- b" I" g* D7 l
5 q! _/ V% R6 \& Z% m& Q' R结果被一个AI模型给挖出来了。3 D, s+ B' V* Y1 k a* Y
7 p" F8 e5 D/ L+ V# ?这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。. F: m/ s/ \2 K1 t! s# B m+ j
) P6 n% f( z* A0 ?7 [' |然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。1 J( |+ o/ z( g& Z \5 S
0 C! g/ m+ T- N
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
- d* P. x8 h- E% r
; ]5 R' q4 u8 n- e M( s- O5 J然后呢?) v. k* n% d5 h
( l" {$ b; S# Y" g7 b
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。3 \! }% h) D3 U, E0 V' E7 ^/ g( ]9 a# [
( v/ N, N2 P6 W9 h) C这个项目,叫Glasswing。
0 I1 J( X2 @; |& { \8 o7 {, C, ?6 k0 P
glasswing
1 {7 o9 W: q+ n5 B, {9 G( u* a0 Y( p: P
/ a* I3 F3 H; r
先说清楚Glasswing是什么。; x5 ~# r0 n- I0 `
4 Q9 m# i* |( u3 n* x" M/ v# o
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
3 d1 c) X+ k* M' y' h- n+ O6 Z7 h) F a$ n- d/ q1 f: y
有多强呢?# p: V* H3 I9 ^" a
+ L; m9 A1 I5 k! |. `CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
; r; S) F7 p: R' i4 k: g0 ^, M2 m
" J u# W/ |/ ~$ hSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。" p( R# a3 |8 g0 S- |% p- Q6 [
1 S0 O3 R: _' s' t G- M
差了13个百分点。
. _* P+ f. R8 E2 R. E* L: Q( z1 B2 ^1 R/ o F5 x
你说这13个百分点意味着什么?: @# E, T8 _. G) w/ i5 |9 m7 |
9 P" \, K- ^! E) v意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
* U" x. O4 M+ f5 a5 {# C3 \0 N W: Y h0 S/ W1 j
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
1 J0 R' q# t Y G" S, _8 R. v) h: Y' d
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
/ \9 z" B0 |6 R4 V+ Z% H# F4 f( _
- v# g' j: L$ |. }( g' m说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
# j+ n" e' ]6 p( Z) D" K* v- }0 n6 c/ w# z2 A
OpenBSD是个什么存在?2 W% i8 M! i# X) R* n: k& B
! K- H. ]- E: X8 z它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。0 `2 N- X$ u+ D, d, w
. t4 b# ~7 n* ?, ?/ Z. Q# U这样的项目,代码审计了多少年了?二十多年。
' f' G n) m2 _( I/ I) C+ y9 B2 M7 Q
然后,一个漏洞,在里面躺了27年。# c! i+ ?' r7 t# k5 H/ Z- |7 U
0 f! T: N6 ~1 L! V
这说明什么?
- h2 w5 \/ i9 X, U# s' g2 b
' I& A! {- q# j! n7 W不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。7 q @4 y; r& n8 p3 M
% o4 K! [( T0 C% L但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
9 ^, N/ g/ m) [: M( b" ^; V* Q1 E( s& M" }+ w% C+ s3 [
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。$ h6 `0 ^' w: y) a. }: E
7 r- H) C3 {4 ~( h& Q" E
这种漏洞可怕在哪?
) a) F8 |) J7 \' U9 ~- X# b. W O: Z5 U. S- n# c$ t6 E
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。2 y% x( }8 L' J" J
) Q- f7 P; h/ J3 o& Y0 |0 H
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
4 D- |3 v/ z# a$ w/ i. Q' O) B& t( z* m* _
FFmpeg那个例子更让我震撼。
' d! x& s+ j. x4 f; T% l
4 b( s- E5 ^* u5 {! M: P8 W16年。
1 M( O9 U/ j; w5 V- b- P
" H. y2 J1 D9 {6 W4 q- NFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。5 X5 Y" @7 `- N' _. H, i
* z+ i) Y! N5 h/ U3 p5 @
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
' P. [' i5 F0 s& E& \+ |: t! E3 x( N3 f8 \, n
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
/ R! i6 |" P$ H9 T/ Y: E7 e1 K* I) k0 D
这是主动防御,不是被动响应。
- t* W6 \9 m& F0 P7 A. h7 h$ s7 X- d5 q3 D/ d9 n5 Z8 r. H2 {
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。; F# @* r4 K/ x- v$ D
7 i: S1 A, p% |: ?: C& R" D( MAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。3 |* M- M- y) ?$ g% B7 B( p
2 X0 }$ g# d5 ^8 n这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。, I: a! U! v. h
% h. j9 ^7 Y9 ~ Y/ G现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
n. u3 T) Z" Y, X. y7 W O7 g0 f7 Q. b7 W. p! A0 V' s0 M3 p
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
* T' ~% l3 R' W4 r6 Q$ ^* K% d
& U: Q$ `. w$ E; h这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
( A ~/ v; \9 s. l8 x
6 P8 d$ _$ P) H8 D6 W+ i# g你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。$ {) @" S: g$ p: S" A( {4 N
+ C' s* V. R7 B5 t+ F0 @1 ?6 ~
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。2 v# o" f3 E, b: V: Z p
. g/ D/ {" o5 `! Q& z! f这个价格贵不贵?0 l0 r( S9 u7 S# ^! e/ d
7 N4 X' M# M. c! {7 O
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
1 o0 o/ Z* X0 t; ^
0 z3 F: y2 t* qMythos Preview能发现那些工具发现不了的漏洞。! y' ^1 K* m/ e; q' @3 R7 f9 Z
0 n5 y; O5 q9 W' H6 x" C2 M. y这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。# }# v, |* m3 g5 Y
& w& L+ s) P8 g( t0 [1 V# M另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。" N2 p) U& z' ~" C/ ]! F5 D1 C
9 k4 ~! ^! A4 v' Z: i }8 f
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。
$ o+ b4 q2 D% v- ^% `8 F+ h, r. W! t% ]# J' v) n
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。) K0 c6 w4 ]: ]4 j. u9 q0 x
4 b: @: W; x; ?' r" Z( e: {7 t- y
还有一个细节,我觉得特别有意思。6 p3 `$ q: t2 w
4 E8 w8 q" l- `# R1 V, n, r, s漏洞发现之后,公开披露的时间是90天。
7 {/ g" O, J8 o T# @) J3 i5 B! [- `: G4 Y
90天是什么概念?$ s& j7 i( [' g# ?+ F
" g8 j9 P5 U0 `3 ~% e
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。1 Y) b$ s( d" |% {
* n8 a1 o7 Y' u b但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。; W: j9 s9 [- c4 \% l+ j# w- n9 o
- ]# c3 B$ [# p+ V/ B2 kMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
' k6 f; X, l; I/ \6 ~2 H& Y7 O
& i: b, }* b ^$ z- U/ D: v8 }这意味着,漏洞披露的节奏,整个就变了。
7 W( h: Z/ _0 b$ A
: h4 h! t* `- ]9 L以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。 A" M/ j! B4 q4 k$ ?6 G8 z% _
! E8 ?7 f" v3 {- W# H" Y3 B% ?
厂商的补丁开发速度,能不能跟上AI的发现速度?7 _6 K8 h: E+ S$ V. E8 M/ b
/ a9 t$ |+ O0 r' B' o0 x" z+ }
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
' A% e4 p0 } H
4 B4 N' K; `& q写到这儿,我突然想到了一个更大的问题。; V/ a0 c0 r6 E8 `
! l) B0 |! _9 G* P+ P p/ T6 D, \" G
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
- Z, k0 Y( `" L/ g; X" {5 X# x9 J' [- b( {
透明,意味着隐藏的东西变可见了。
' h, W, y$ Q0 a4 d, M$ n5 L7 x
/ l* {' Y7 o1 U8 c1 h一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
+ }9 c3 q J9 T2 x' n- Z R8 j' `( J' F- W) r
这个意象,放在漏洞挖掘上,太精准了。
5 {; y/ z# O2 W" @/ ^2 y9 ?2 [
/ v8 S2 e% Q9 G. y代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
9 U) ~: {+ y5 a7 R1 ^5 a4 ^6 N3 _4 N3 X" q) _7 E. F, _% e7 X* t
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。' G/ s; d9 @/ J- W* Z4 b
$ k" N( X- S/ Q: C
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
# a) i; M5 m/ r H7 m( h
8 _) z4 A: p6 O: B. j7 F* K$ Z代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
6 B$ `. S, M7 @1 s) P) ~) u
; G5 j' J8 @% O3 F, i这是一件好事吗?; ~: T6 p" O& Q
* d6 b- H$ h1 R/ t c9 C* Z( n我觉得,短期内,这是一件非常非常好的事。/ S! C% j. I1 J. d
. w- E" F" t3 W, A5 h1 B- ^' H6 R
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
* U. D* Y C' i! |
9 W% Q# J1 f$ r, R# i9 ?2 B这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
1 ^8 D, Z! J* j( o1 t' R" f( Q, D3 A$ K# O
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
- r6 m5 r9 W" c
2 E- s) F A' @$ H. `# n( X) x }% ^/ |但长期呢?
' W4 g* ~. P) z; Y5 h4 B' h
& C$ N! n0 o% x( |" H5 n2 ~当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?8 p$ d: L# ~ X0 w
! U& z' W" K% K6 ~是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
6 l4 k9 f4 z @- C; g. |1 u+ x4 _
$ }+ p& ?6 R, ?4 b# [$ |% R. R |我也不知道。, ?) N, O7 R' d: n
" f- q) e# S% k) J( m
但有一件事我特别想强调。' {& R# T. p) p+ m1 y- M% {& ?; j
* O0 Z- |) F @2 n这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。3 R' B3 i$ b/ {& N
9 \; {; s" z5 p8 e; Q! C, s( ~5 V他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。: F. S" T0 w: i! S7 j5 D$ L
/ |! l8 ?! \/ Z2 _! t
他们为什么还要加入这个联盟,用别人的AI?
8 [7 e% n- `9 J8 j) N& i9 R( m3 H: h* H- p a& S6 B; Z; |
我大胆猜测一下:因为挖漏洞这件事,规模太大了。
8 e; ]6 E. I2 e
4 L$ x# L9 n$ `, Q" i全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。$ J! [. I& F5 _# b4 d7 y) J
. E7 y3 ~# ^3 L: Z7 G& qMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。2 _( ^/ g, P, I) S
+ U D. u# w& Z- j2 ^0 L: s) s这是规模效应。
- r4 T! r" h( |% I
+ T5 J B7 W) m就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。7 d; x- _) p! i* l5 |. Y1 D
# [: M2 o' T) T# ]1 s* F. ^
这个规模,是人类团队根本无法覆盖的。# E& o9 L0 u0 b9 |7 l6 _/ H
0 s" O! f# G# q% T
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。7 Z8 [1 i. o8 i/ z& z* J
# a/ r& V0 |2 h$ A1 m# \9 R; u0 f4 K什么意思?+ V# `7 ~7 _! f% i1 D3 e
" V+ o" G6 [+ u B$ ?- i: e8 F
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
2 ~0 V5 \5 `3 i, r+ w3 C% f1 _7 R1 D8 \6 x1 E8 b' \
类似现在的ISO认证,但针对的是代码安全。/ i6 A6 U" v0 `
0 n! }# D* E5 Q7 h想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
4 K2 r- G: f: h5 J$ T8 B o. \, B. D" |3 _: ^( e- _/ u
这不是不可能的。" j6 ?$ M* t; U6 Z' n1 ]
+ A" Q t* X& F" w" D( [" ~5 {当然,路还很长。现在还只是第一步。但方向是对的。4 s- b9 }# p" u. Q" e; `
* {2 r& ?; J5 |$ f: K1 ~
好了,写了这么多,让我最后说几句掏心窝的话。
( W. Q5 | f) I
$ V! r1 R" Q+ t* m n& a8 B: J) I我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
: ? n1 f5 f) W6 \( l
6 V) ^* Q$ N j5 U6 l- n2 M兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。: T/ v! |$ s: E/ F
: {! D* F- i8 d/ p3 L2 \这次不一样。这次是AI在帮我们发现自己的脆弱点。
/ _# ~4 {& v- V1 G0 J8 I, {1 D& s/ o- A2 p1 E
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。/ q0 y( X2 P# h3 G' l; Y: m+ m
# N4 a2 {/ o( f9 H' M3 \; E
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。3 s! F" ]' N! ?7 S: r: M/ h1 O
8 q# L6 C9 U7 S7 H2 f2 d9 I
我怕的是什么呢?
& h& y# g& C# z- F+ ~, c1 D) R! V% Z) T4 n% i0 y) K
我怕的是,这个工具,只有大公司用得起。8 r% a7 e9 [# `- w# ^
9 R% Y; b! |+ g7 D3 z
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?8 ^$ G7 @7 e8 S4 C* r: }+ }7 p" P
/ J& X) ~5 W# H, AAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?8 O. d; O3 x) D" _5 n8 X
! c# |) O/ m2 Y! S, C) B w* S这些问题,现在还没有答案。
1 Q2 X/ e4 L7 }. q9 }
! o( `: w7 I) j( ?& ?6 ?2 @但有一点我特别想强调。4 E4 n0 m: \$ y7 w1 R0 h+ Z( S8 C# y
& b3 t+ s. b* _$ ^& o3 s' X
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
: c6 F. Y, [, u0 E' j. }& N. W J6 x( e
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。) u; |' z% W3 o2 I4 d( {
+ D: E0 ^& L# t# {; eAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。4 A$ a" E+ [- T& W& P. ?9 J4 y
4 Y$ F+ h8 q4 X3 C5 E- q! O; o当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。/ H6 u* |3 M" d: t8 `) O
" A1 U3 x% t% t7 O& ~4 Q
这一天什么时候来?我不知道。可能5年,可能10年。
- W1 `) @7 _7 b+ p* o7 t6 m$ R0 ?2 w- _9 ]
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
9 a. h( r5 ~2 K |
评分
-
查看全部评分
|