|
|
赫然 发表于 2026-9-22 04:194 K; T4 S( ~# m* F6 r, F
这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。
N- [) h' z3 a1 S
' j; x5 J( v& k. `( X: J这里关键不是要不要安全管制,而是谁来 ...
0 L9 y: | H6 J+ F% ]. I3 {% SAI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。& O# k; _% V0 B4 d1 D7 X, E3 \" `
. b- Q+ l: V5 V你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
* |6 i8 Y9 T" Z
/ s1 \$ z5 o$ V, B" s W/ z j8 B 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2$ R* V f2 U/ n N* n
; @6 D9 m3 Z- O8 i8 m7 z
但我会稍微修正你的结论:
- a6 a5 n/ k4 u; P# e3 i- c3 W: r% j0 T
> **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
' J2 R3 T0 u% B0 K3 n3 A% c4 ~+ B$ ~( m# F
这两个问题的解决方式其实完全不同。
x* d' H: ?) w+ M
- x! J9 P% |& ^% ~: c ## 一、真正需要解决的不是“谁监管”,而是“谁验证”0 z [! ^7 t7 _; A7 W
* ~5 q. o0 c. q4 W: o: w7 r. V3 H- M
假设:" J9 H* b$ r3 w( g+ k6 q
- h- d, g2 ^; M) _8 r
- 美国监管美国公司;# L9 ?9 g# d3 m# {
- 中国监管中国公司;
. h7 |6 ? O, _3 E f/ }- 欧盟监管欧洲公司。! p. Y: M" J, E- @0 ^
' G+ c: a( {; T' }9 | 这本身并没有问题。# c) j2 T' y0 H6 d" V0 N
' g c+ W- e' w/ X# m
核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。) i' z o+ F, I' C, c5 S8 P3 G
$ l2 F0 C e7 O 真正的问题是:: L* J( O/ [2 k8 Z
2 H, v) H8 f. Z/ e; U
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**) _1 A6 |5 [% R& j
> M) E9 `- R* k. w! y
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**( Y _9 s! E% _, j: t# H
- A1 z' Z9 d9 e& N2 R% Q 如果答案都是“不知道”,国际体系就会陷入你说的困境。
; E' C! `1 |# O ` _" Y# m* P! X+ `: N& k+ ?. n
因此,千万不要把目标设计成:
0 V5 v$ x0 w- T% g( k) d2 d0 E: v( Q) I/ z5 a) j
**“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
3 r" |: @9 u8 R1 `
2 ^9 q( Y: s: `* {) X 这几乎注定失败。
3 t4 o0 c) @' `' b# Z+ N5 @, b7 f; j# }6 `( r- e
应该设计成:7 I2 w. [# Y& X: s3 z
, L3 h% G& W+ c8 p: q, q **“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**# l" V$ X7 \2 E
8 r$ g4 m3 B% f- g9 m( C 这两个制度差别极大。( O+ u0 C" S; Q* ~2 w5 o
( `* ~! D1 w4 r3 R# P3 i
---
8 E1 R2 r- k& n( @" {2 g+ o$ B$ O& }* l2 R5 t* R) d
# 二、我认为真正可行的模型,是“核查而不是监管”
6 k4 _$ @4 Q( }1 U4 X% g/ Z4 u+ t k8 d4 G' H+ }7 n; c7 S" a
这里可以借鉴一个很重要的国际关系经验:
! ^1 Q+ @) _' t5 v9 h$ f
1 K. T5 q7 d% t! y1 @) m **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**
! ^+ K. w! i% y/ k6 P0 t
- K' \, h. p1 H; A: p 换句话说:
5 {& ]3 A2 ^: Y9 T0 J) Y, s2 o
. V& r( d! b( H8 X7 ~: r > 不需要美国相信中国政府。
; X& }0 y* N$ T& x" ?, ^8 E>$ K1 G* C. b! F/ i
> 不需要中国相信美国政府。
0 o6 ]8 s, O" ?>
3 S; O+ |8 B" P" r+ m> 只需要美国相信一套验证程序,中国也相信同一套验证程序。& y0 g* x) X. M% d0 J
- O5 w- f' a& T5 S0 K4 V. P 这就是制度设计的核心。; w6 [: H/ p" x4 L0 J& A/ g
1 ~6 ~: e4 p0 v+ i* g% Z6 ]* C 例如建立一个国际 AI Safety Verification System。; Q% I8 K1 n0 W& z" c7 E1 [& [/ Q' i
5 r& e$ a. h5 D. w* c 它不拥有:
' s$ m3 w2 A o/ {
( b) i7 P- W! r - 逮捕权;
- V, V4 k: S9 i- D' O- 执法权;- d+ ] ~. n+ j6 {, S/ ?1 O
- 关闭美国公司的权力;0 {/ a+ r d A& A* ]- j, K
- 关闭中国公司的权力;
# D+ ]" G( O. q6 I- 决定各国 AI 政策的权力。1 b$ n4 y8 Q' O. Y
* H/ B2 T; N" E7 ?
它只做一件事:5 n) l8 X$ g( ]+ x; n3 s
7 ^, m; h* ~/ O* Z > **验证一个 AI 系统是否满足共同定义的安全条件。**( s& |) q- {7 J" m r. y
2 h6 N3 M* u5 m. P3 H: ^3 J& _4 ? 这反而可能是中美都能够接受的。
1 C7 W- H0 |& G) J9 E& t0 O: M; j7 u# Q4 R! Q l2 K X4 r1 ^0 j1 [
---9 q" `2 x+ j r, t- A" g7 r
/ f2 Z7 p- F4 M$ I s
# 三、关键是把“监管”拆成三层8 Q9 H) `; i9 ^ C$ O* {
4 e6 f- O) ?* G3 Z9 ? 我觉得这是整个问题最重要的地方。# O" w' n2 [# A$ k) k, z
' t. S/ m8 Q ]9 V Z9 I. ~) u0 S ### 第一层:国家监管. q' A: P9 j/ m% S9 k8 }$ w
- O! q, j7 @1 o 完全保留。
+ c9 Q" d& h' l0 ^
5 w( `* j5 K5 C1 M. X 美国:' |) P3 V& r: V* A3 R; r0 r, i
P" W7 E' ^$ f. t$ A; l > 美国政府 → 美国 AI 公司
7 X0 N: i* Z6 f, b/ r, b% M% j$ X) v# x, Z* u% B$ r) h
中国:" v" O& F9 @ ` | m v$ X
6 l% G I% P% u: z+ x8 Z5 a > 中国政府 → 中国 AI 公司% A2 f5 b2 G9 b$ ?4 X
( }( m9 K) Q. E0 _. q$ ~& @
欧盟:
4 L' z1 A% K; M1 u: q- c; [: q( i/ ?" m
> 欧盟 → 欧洲 AI 公司
9 q! [: |# S4 G/ m+ C* S5 I
, r( o& q, n; C7 q7 X: | 谁都不需要允许外国政府进入自己的监管体系。0 j" {; f/ Z$ t1 u
. p2 p8 ]8 V8 ?; H$ K1 [# m
---
) t2 c: h& V! c% _$ ~5 Y
. F4 J6 H: s! p ### 第二层:国际标准
% P0 O, N3 G, J! r* [
, b* Y. N( T) x0 c8 M 大家共同定义一些非常狭窄的东西,例如:
- Q. d8 v9 t1 ^+ j; W G) n" I& @/ p. q9 I! u6 Z) m0 `
- 什么叫 frontier model;2 z7 O* h3 g" I e, D1 b; A
- 什么能力达到危险阈值;
; u+ G j! Q L5 q0 C9 g! [. v" k% N5 V6 L7 G- 哪些能力必须进行独立测试;
: n7 R* [! N4 |1 g& O- 哪些事故必须报告;
# ^& \2 ]6 n3 ?. W: f- 什么叫“重大 AI 安全事件”;& A; k& L! G3 z- P0 d* c# p
- 哪些模型必须进行 deployment review;) D# V: e8 W( Z% j5 h% }- E
- 哪些模型必须保留审计记录;
6 n5 N3 }& ^) N" Q9 z& Z% d: R0 S5 q- 什么测试结果达到什么风险等级。
% s$ O' g' u0 b' h' X: w% O+ U' l3 R5 f: |2 }3 R; a
注意:
' x I1 l ]3 O# o$ P5 ]
1 s9 o1 c) v" P **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
, w3 q, m# o' j6 l
" l- y- a3 i, V( U 这会大幅降低主权冲突。
7 m6 a' X6 m2 H7 [$ W' U/ ^8 G! |) X8 n6 R6 M3 q( s k
---4 T6 }6 o( R- U" @. w# C8 k
; \- E' C) A8 f" S/ S3 W2 y ### 第三层:国际验证5 P* E4 G& |; \& ?
' j; N% n( \! `' c3 G( q 这是最关键的一层。
* J1 V$ G z6 U! o5 h8 r! g0 m$ I7 c# s8 l
不是让中国监管美国。# z; |& Q' x0 V# `5 l' J; b
1 d7 ` Z8 e" _
也不是让美国监管中国。
: [- l" V& H/ X5 ?# R
' B# n% w- P8 e$ {4 Q 而是:
9 ~5 E) G4 |; ], Z4 `3 `8 ^3 Q* T- z7 p N/ Y5 W( r; u
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。** O7 i( C% g7 ?3 F6 t# F8 G5 E, Z
2 \/ S5 R8 ]1 N
例如: u8 @% T3 B6 b, Y/ U: ~
; Q4 h; z9 [" o K# U
美国说:, A& H- j `) D
1 v9 _: k4 l8 _+ i6 {
> “我们已经测试过 Model X,安全。”* ]3 D M4 N/ o* e# y3 A7 X" s$ c- a
. Y6 i) G/ T6 \9 u9 ]
国际验证机构不需要接管美国监管。5 M. Q! i) }" ^- |2 j% h' j% F
j- [9 {+ B$ E( X
它只需要检查:: W$ j/ K; k2 H# ~$ k/ J$ C
a; h$ I7 _7 i! n
> 你测试了吗?$ e, F- G/ a U) ^0 u
>$ i' R# v: q* M; I
> 测试方法符合标准吗?5 ~# l& h+ q8 ], k: ?9 R& R
>' ^) z. @' q, }; w% v1 c
> 测试数据有没有造假?! G, ]3 v% ~ ^' k; R' u9 l
>3 x F/ t6 t" ]+ q
> 有没有遗漏规定的测试?
5 F' b* @' q/ V; D+ Y2 ^! M>" q3 e. m. J. e* r% Z0 R O
> 测试结果有没有达到规定阈值?/ v* h. [3 X$ R$ | h4 t* K! | f' q
& _# m/ h! H9 u. R# L- ~8 K 中国同理。
, a. w6 z( D/ a; J- g* N
' ~$ o9 ?$ e5 M/ y% |8 d( B$ x: w 于是就出现了一个非常漂亮的制度:
' B# _ P* s* g3 j% t) q
9 _4 t: Q" q) t' n) X1 d **国家拥有监管权,国际机构拥有验证权。**
8 u, x$ ?$ h! `" A! Z0 }: F9 \% s. Q
---
: M0 q5 V* w- Y# O h3 a* |5 S/ U' i) K0 s& e7 ^% @" F
# 四、甚至不需要相信“第三方”
4 Q% z4 ]' J& A) L6 d% d: `+ i5 g. J3 P) _
这里还有一个更深的设计。0 n) k0 r% w _
T. v9 i* R" O6 [9 K' u4 Q 假设中美连第三方都不相信。
- W$ h8 k( i z- N/ v/ m5 h6 @. P* G, m. M' B
怎么办?
( W" }7 ]0 }+ x( m$ g# t, R( y" [: E6 J: s- C/ \8 u( B
**让验证过程尽可能机器化。**
: r0 L/ l: ~$ R( s) M
7 h" v8 v9 }, f* s) Q1 Y 例如建立标准化的 AI Safety Evaluation Protocol。
+ v& G; ^. O0 T. I9 K. O2 P& ^( B4 f! s J
一家中国公司提交模型以后,不需要把模型权重交给美国。' F& u3 f; W. R; h& }8 [
$ B- i# g9 B, R2 ?2 r' f
一家美国公司也不需要把权重交给中国。
$ H7 d; U4 a8 A* y3 v# W& O S) O: @7 Z+ s6 X* Q4 j' m
双方只需要运行一组国际认可的测试:% ]$ N& Q, o; f
; U5 Q/ ^% S. m4 T" H
```
' C4 J# m% i/ {& U# G1 Q. b) h& ECybersecurity
- a t1 r' P& R2 CBiosecurity2 R6 h' t1 W( U6 ^
Autonomous replication( j1 m6 o+ p# `; W( y- q
Deception
, _7 O9 S5 U1 \5 ]Persuasion& |( Z9 i) x; E* `; ?0 {3 O$ t4 f
Model autonomy7 P J% K2 i g
Critical infrastructure attacks- X, G* i' a0 ]0 A) w' ?
Human-control loss8 f' ^5 A" W' {# B; n; k
```9 ]. D- v! T& N: y2 ~' c! i, W5 k
- m, G" I, @; I9 s$ T7 o8 }
然后产生:
K5 f q4 p+ h4 m- h1 s. i
# ]/ K0 M- X# L- |```
: D2 e; y9 G8 I! rTest ID/ d5 `2 Y+ o7 ]; T
Version
; B: j1 ?3 g6 F6 {Result6 O4 z: _+ k. g
Timestamp1 m3 |1 K3 A" K
Evaluator
7 ^6 \; \5 C2 s7 ACryptographic signature
% O+ J2 A9 o/ h5 @5 l A& L```, D: A- o1 z5 @5 ]8 B: h
( H' i" }4 c6 C" i
类似航空领域的适航证书、软件供应链签名、金融审计记录。( ^1 E- X4 z' q. o2 i
* F5 Y. B) s% B1 ]$ m 这样国际机制监督的不是:: V4 g+ f- j. L6 Y( s b
- G. Y& e2 P. E7 C; S: g7 | > “你的模型内部到底是什么?”
8 G' _4 f o* W2 G6 J
$ ~4 N* p1 S& O$ x) n 而是:! N/ z+ o% \5 X9 u" P
8 ]8 d% Q s: R3 C! l/ g
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**
/ J, U. c8 k! q
6 Z, L& J3 U+ K+ ? 这会比“外国监管机构进驻你的 AI 实验室”现实得多。' I, Z& A2 C: z' f
. o& Z! g% f) X! P3 q% D2 r1 E4 V
---1 ?2 {( r; _9 ~! w$ X5 f
3 @7 D. ]1 Q7 ?* T/ y # 五、进一步可以采用“相互承认”制度
6 `, A: P5 I& q3 h/ n a8 S' o+ q
6 ?1 m7 o- S* C* F- k 这可能是最现实的突破口。
3 m2 \6 A) ^4 W& k" E( S
: g6 W# Y4 u& [- | 例如:* o0 K8 T, P- E. I% y( J* e; q
4 a( g5 w8 D( c4 W2 a% w. L 美国说:
8 P$ y, v8 j; \7 S
n5 d; x8 Y6 s0 j" w* ~ > 我不接受中国监管机构直接监管美国 AI。
- Z; x8 W- x: k9 K9 H5 k+ L B. x* f: m) J: A
中国说: m' V+ ^- a) y r
" z# m, s5 s1 d- m! n9 Z# Q > 我也不接受美国监管机构直接监管中国 AI。
7 Q! ^9 G- p, ^: T4 u$ R- ~' X
+ s9 b3 s- @: @' u4 R1 ^4 Y 完全没关系。
+ u1 D* Q) J$ c# N. Q& m! \6 ^9 z- v1 n P0 _. P9 n; S! h
那么双方签:
) T9 }+ \% B* P7 d) {$ O
( R( l3 j' x" k > **Mutual Recognition Agreement**& l9 d7 w3 C" w" o2 d6 z8 j
, i+ R. | g6 E$ w
也就是:
& k# L7 C3 n u# h
$ t/ N4 a8 M; x$ p9 b4 D1 C# w **我承认你的监管体系满足某些共同最低标准。**5 f% Z6 v& D( a
' t M6 g, @7 i" {) A% ^
这在国际贸易、航空、药品、金融等领域其实并不陌生。
' A- c4 R2 B6 N$ M) b9 W$ }0 S( j/ _! Y4 h; S/ Q$ U/ S" {
于是:
7 `' b$ S S# Q5 e, x/ ]* k" J: {9 J" ]' [, d& P% c0 q8 }
|
|