|
|
赫然 发表于 2026-9-22 04:19
6 Z% _* C( ~/ x/ c0 t这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。2 V4 Z: Y `5 ~/ d
9 p1 c9 n! i$ q; W4 k# S. p
这里关键不是要不要安全管制,而是谁来 ...
5 j9 r2 [ j( I4 A6 @AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。8 @ `, W2 T1 D) w/ @
7 R( G. w3 X* B: j3 o你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
* f. r( b7 N" N; e; {& k6 s4 R P% |' {8 m, I" I
而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2+ x* O* R2 U0 n1 Z, d& L/ A. n( }
- w* r3 {1 w: p- R) q 但我会稍微修正你的结论:# H5 o X" y; o9 S, ~- \
% }* y6 g! P' Z" R > **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
) b. G# ?. O7 t) Q# z! Y5 i+ p. ~) D0 J7 P
4 ^1 c+ [( \, ~9 i/ c: H 这两个问题的解决方式其实完全不同。3 e6 e& f+ P- f! A; P5 \3 V' x
* y5 j1 T/ p/ K: Q- E
## 一、真正需要解决的不是“谁监管”,而是“谁验证”
5 h4 m2 o- z: r2 e2 w2 B- ~ b( \5 e1 t: M! t
假设:+ S; X6 t& G3 C" j) [9 }
5 F2 z) {6 p7 ]" H/ s
- 美国监管美国公司;
, \: a @) ?/ V( Q0 }" F- 中国监管中国公司;7 t1 \1 [/ O4 o; @& T$ ?
- 欧盟监管欧洲公司。; O3 u6 Z) c/ ~
/ K& w1 s" m: j 这本身并没有问题。1 S' Z" V! q+ U2 B9 T6 T4 H
% T* O( M, P8 p% a& Q
核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。/ X) g) A( R* n- c
: z7 h. l9 k! v4 D& n; Q+ b
真正的问题是:
4 O% d* t2 D: n" V6 F% `, [9 V. \9 L; S/ K
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**9 n( p4 i* A1 _$ f$ l) D, e
>
+ }5 G$ ?/ E/ V, F; J$ L5 X> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**8 p( H" c; ~: \# d7 D
" y5 K0 K3 `/ u& c% h- c 如果答案都是“不知道”,国际体系就会陷入你说的困境。
; F) R/ z; f- o5 i* l O3 D: k/ h/ u
因此,千万不要把目标设计成:' S( {8 ?5 T" U8 z- b
2 s; U- F* ?6 S9 t **“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**' m) F6 ? O3 S! D) S1 l
) U; c8 y2 x% f/ m+ J( u l/ r6 o+ P2 m( { 这几乎注定失败。
$ b V u. s% Z( T& ?/ c3 u0 i
" I3 ^) L) S/ d' i 应该设计成:
9 L# R( e) Z7 g& m* E
7 ~' k& J' M8 U/ C0 f% m **“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**/ C! h$ T# C, z, k6 s @( G
1 K9 B$ n: F @ 这两个制度差别极大。$ D N# I+ L; f5 ~8 h& N1 i
0 h# S; f# n, r9 k---0 ?% ^7 i. ]# l9 Y/ x
: \6 X" L9 S: }& {" n( A2 b
# 二、我认为真正可行的模型,是“核查而不是监管”
8 J# t) f4 e; V: e, d( Z) h; E# T5 x
这里可以借鉴一个很重要的国际关系经验:
- t5 j$ T! B* T8 P/ `% t
9 L0 t: M7 `2 p9 a **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**! z1 c& L# o; x
$ L* g9 Q: ^/ z( Q+ P 换句话说:! |4 i( j l7 `( L6 G4 `; r
. x* O9 _: ]3 n: A: w8 {! [
> 不需要美国相信中国政府。9 w0 \" O0 m9 V& `9 l9 B2 W
>! h* w: ]- A. P$ S; T2 W
> 不需要中国相信美国政府。. t" G2 z# c" k
>
6 W7 Y7 s! O% r2 L> 只需要美国相信一套验证程序,中国也相信同一套验证程序。
; q8 w( o* N5 v" l' V( x. T5 R# ~. I c1 X0 S: N
这就是制度设计的核心。6 v, `) V2 O( a% C# A/ I
& S8 W* F. l5 k8 f# |! g
例如建立一个国际 AI Safety Verification System。4 k1 [+ N+ Y! n& m: z+ S
0 S5 K3 L1 r% F& J S& x$ N2 r9 E 它不拥有:" v7 a" k N( O f
v" Y. _5 c9 h5 i
- 逮捕权;2 ^; ~# @- v- R& c0 B1 H
- 执法权;$ [3 ?' F2 R6 m. O$ ?3 b5 B' A
- 关闭美国公司的权力;& ^' g, ^# H$ n! Y0 e
- 关闭中国公司的权力;
6 e9 Y& M P+ x, Z. M1 J8 I; R- 决定各国 AI 政策的权力。
9 o% [8 d5 ^5 D8 \5 z- u2 y4 [0 ^9 [+ M W" |6 }2 z
它只做一件事:3 L3 l! g2 Z" t. K4 q, e" }/ G
/ x4 v5 a/ L3 C, E$ [0 g+ }/ P > **验证一个 AI 系统是否满足共同定义的安全条件。**
: _8 L. q. U0 u0 B _$ r. J+ k! \; K
这反而可能是中美都能够接受的。% O3 L |" z' Y, H2 e2 q! P8 I7 q
2 r) \) s% n- I! `- c
---; J2 d+ u* P9 t' E i3 I
! v! X, h8 f2 P0 D% K( s # 三、关键是把“监管”拆成三层4 L( U4 s8 t( v
) w& j; }; l8 | Z 我觉得这是整个问题最重要的地方。5 `8 H: }3 f1 H) ~
$ F7 |: {$ _0 a, J8 Y' J
### 第一层:国家监管6 M% g0 Q6 q# I% P
, E6 `1 M. M+ N; e, o7 n 完全保留。7 U6 g1 a1 @- W6 p3 l
" n4 h" E; N6 ?: y9 V 美国:3 w5 B. C, O4 e0 x5 s; e7 l. j
: A+ A8 Z/ g: L > 美国政府 → 美国 AI 公司
' w, G0 i5 a7 L: ]0 T
0 B9 M0 S2 x) X3 G) {9 p# X 中国:& U; Q4 C! j2 [
1 [0 o$ X" H2 c7 t( h6 y1 z( x
> 中国政府 → 中国 AI 公司
3 }+ {7 {2 K9 a! k5 F8 ]' w
( e; L: p- I% P% n+ T+ b 欧盟:
% |/ a' X6 ?5 E" y6 p
2 l2 M/ @; A1 J, z9 x; R2 l% f > 欧盟 → 欧洲 AI 公司
; z3 n0 X2 m/ f6 Z
6 B s6 f2 b* p' b; U3 X' h5 t 谁都不需要允许外国政府进入自己的监管体系。
3 H3 Z, x2 K, e N( @' `
) }, L$ d, U5 G2 J9 H7 v2 H---
0 N$ k* T3 t3 v6 C$ p8 ~/ ]* |" D" X2 p
- P% E& z9 L6 b! F4 Y N ### 第二层:国际标准
* U2 |7 W( \/ i: X7 t3 ~
s3 ]& j% @( ~6 y5 m Q 大家共同定义一些非常狭窄的东西,例如:! `5 {# q6 v I* J- g2 |
& Z" j" G$ o6 g( G$ p - 什么叫 frontier model;& O8 V% o; \! _: M+ t
- 什么能力达到危险阈值;
3 Z- Z( V( w3 W7 A% Q9 S' b; \0 a4 Z! Q- 哪些能力必须进行独立测试;
% i2 f+ M, u m; ]! ?4 P- 哪些事故必须报告;( t& b- J5 j! ? j1 R' {7 B
- 什么叫“重大 AI 安全事件”;
0 w. [0 O. W0 ^% j1 R6 x* n- 哪些模型必须进行 deployment review;
# @- z0 p I6 h- 哪些模型必须保留审计记录;
9 c& Z' Q) R: I' J) k }( x8 \/ R- 什么测试结果达到什么风险等级。
4 @4 [1 C3 k# D: }2 w
G# b9 s" G2 n% `. A1 M 注意: m4 W8 Y8 m8 T3 D. q8 a( d
* ^) t% G3 C- f
**这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**1 Y, J* A" F- Y" Q
- k9 _! {. T; Q; U! N 这会大幅降低主权冲突。
& x- j( Q, J# z8 a2 X
$ i8 T" \$ ~; X" u---
( k1 w/ m4 h3 t$ Q* m9 ]2 q; T) b6 A( j2 z
### 第三层:国际验证1 e; G7 Y4 o9 z
) v: Y) p& J' G! z
这是最关键的一层。
" I6 J1 |5 P( M2 X. R, K+ J1 b: w$ U: J6 O9 M& `
不是让中国监管美国。
: {1 S" e! x/ i2 H% i% l' V, `8 o( y4 I- T- t
也不是让美国监管中国。: e1 V9 t' {) I; L
- @' J0 U: }8 e2 @# I 而是:. L e# U. z8 x/ q% q. K3 l5 R4 K
+ k% W5 ?* _! }9 T" C- _$ h
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**0 \2 V6 @7 z$ e \- @/ ^' K
/ j6 T) t" k8 q7 ?8 n 例如:
9 H' D7 O" i+ D9 z4 H2 Z$ t* k, [$ p0 l& H" @- y0 U# v% ]8 r: Z r
美国说:
$ v( ]' T( ?0 L- `+ V" h9 A9 P; t" R. n! q) W5 v
> “我们已经测试过 Model X,安全。”
5 M6 |4 n- K8 w! ] c; u) T: ~
9 R% E# J3 v6 C5 C$ c 国际验证机构不需要接管美国监管。7 v& h. n3 q3 q
y, e4 j2 k! h* @$ X* j- }6 j, { 它只需要检查:
6 Z x5 [! {0 p1 q1 `& z, `! @4 s0 u( l
> 你测试了吗?
+ q0 B! q+ z! a% D# C- v/ j# v! x( N>! y1 \9 H' i# @
> 测试方法符合标准吗?
! k$ J3 k+ ]/ J) B, H>) @) J- ^6 J7 J! B) \. W# w( l! q2 |
> 测试数据有没有造假?
) B$ Y' c8 H8 ? V! U>
5 v+ u4 \6 D/ B, P. r: b0 y# S L) p. o> 有没有遗漏规定的测试?
0 }7 {6 d, q, t, m9 W>
5 c& f7 ~% a$ G! R) F> 测试结果有没有达到规定阈值?2 S4 _* d+ |$ h; L0 S8 x0 @% @ y
# [, `$ a% Q v& a) { 中国同理。
6 ]9 X$ H5 { `6 R( |$ R# m9 H- R! x7 Y3 G( |* X0 Q) d z
于是就出现了一个非常漂亮的制度:4 g" q# G) n4 N9 W1 m' [
! q' R# ^7 L* \; Y, b/ [6 D- n2 U
**国家拥有监管权,国际机构拥有验证权。**
. X# b( b. f1 ?
. A; T4 Y0 n ~" m$ j; G$ ]( ~7 i---
4 N1 c4 a) S" m* m8 |
* X+ |1 D. O( C, o4 f # 四、甚至不需要相信“第三方”/ e; C- v4 {- z% v5 q* a t
7 Y+ O* p+ W& s
这里还有一个更深的设计。" u9 k/ G5 c1 b
6 D& n3 O1 c5 Y0 C; Z4 Y' p 假设中美连第三方都不相信。
5 K) V0 V2 L; B8 F6 M; f6 h t
; n, {- Y# M% e5 n7 l: N6 W 怎么办?4 o0 o; K8 y) n; o' C3 F n
u2 v Y1 G/ C/ ^( m **让验证过程尽可能机器化。**- `/ N1 X/ z- t( }) o
6 g7 A% ?( o1 [* O; J+ }. V1 e- M 例如建立标准化的 AI Safety Evaluation Protocol。. b0 r- E& u* [
0 x8 ]. Z4 z2 B2 ^3 e. l9 ? 一家中国公司提交模型以后,不需要把模型权重交给美国。
2 G/ [; T! K$ v# a) F. ^* k8 H6 l$ m0 H; [9 f
一家美国公司也不需要把权重交给中国。
9 D, ? m5 n f) u5 E# q# K# ~, \. _4 o8 j$ o' U
双方只需要运行一组国际认可的测试:; b, r2 ?, U! N' w
7 U* Z4 a4 N# V2 m, ^/ b1 e8 j
```; k4 Q1 V& ?5 v* L
Cybersecurity( i/ C+ }/ Y* P: `" `3 Q2 G
Biosecurity' l- S% O) j7 I
Autonomous replication5 a9 \! U1 O7 d3 ]- ~
Deception
$ m" `* e ^# K9 c0 s( P' a" ^Persuasion
! S2 H1 \. C' Q- R. IModel autonomy7 w7 q4 B o$ w* s9 e3 n
Critical infrastructure attacks; T. |0 e v, E# }: X
Human-control loss
( W& i& ~. @ i3 | U! u4 X``` ]: P P! F$ V) @. [
: ^3 h8 h e$ o: y
然后产生:: Q2 p9 L* W; a' A* X. q
5 e6 i2 W! t; n' {- Y/ Q
```8 d% }& P1 H6 s6 y5 i: E
Test ID% K( z% X/ _" j# ?, I* g
Version9 }' p5 }! {! j$ c2 v) l
Result: t( D% ?$ w6 `% o( D1 R
Timestamp
1 x9 @+ @# W7 F: d" @% pEvaluator
# a7 Y, D+ Q4 ~0 z6 D2 kCryptographic signature
1 L- n+ R* ^ I9 D V```" v# x' B5 D) g; Q) h
0 l; X1 J8 \ T; b/ l1 O, v
类似航空领域的适航证书、软件供应链签名、金融审计记录。
& e8 R- J- g$ |' Y. U$ n/ O- [4 I3 C+ D" _
这样国际机制监督的不是:
! W( [ Q# i" B, n# ], A
* M5 y6 Z# M# c- `/ T1 e > “你的模型内部到底是什么?”
6 C# \* T, s6 N, x$ y7 k! K) s/ G; j& j' l7 c+ q$ ` L
而是:/ S# j [! N+ b( U* v9 M$ R
7 c) H$ L* X* I5 c& n$ h$ k
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**
4 p. V* J, e! h" i$ @0 d8 V7 A. D' e$ q, S# ^- v
这会比“外国监管机构进驻你的 AI 实验室”现实得多。0 l9 G s# Y @2 h3 Y1 r
$ ~# R; w) p8 H" m' c. E, f) A---! A# }* o! z) g. V
8 k0 m6 v4 I9 K+ M: @6 Y6 i( C
# 五、进一步可以采用“相互承认”制度
* ^, {) h' l& } B+ ~$ M I2 ]9 w6 |. b8 b
这可能是最现实的突破口。8 w! ^! A9 h# F
M" Y2 s1 R! ~$ F& M4 |0 T 例如:
. C" ]8 E% c0 x( O0 h5 ^/ ?7 p! B, e) s
美国说:% `$ T5 f T% }8 ?5 ~# o
; z1 t0 E' S9 R1 y6 K; X5 g
> 我不接受中国监管机构直接监管美国 AI。
$ b% b1 S7 A4 y: R
# g! e2 @8 O& b( U 中国说:
5 @- U1 _! Y* S5 t, ^6 P9 C. d
' u+ S; |( J' h6 x: | > 我也不接受美国监管机构直接监管中国 AI。
( t1 U5 L; B9 a2 n
' P0 s9 J* N; w$ r 完全没关系。
; i$ f8 P2 D1 o4 [+ V* W3 g% n( O; l% S, a/ D8 D' j
那么双方签:% v( A5 S P) D m+ h
4 k* j& e& \5 L- i' Y6 V > **Mutual Recognition Agreement**
0 ~' r! @- q# ?0 `1 a6 f; e' w# v) m, ]9 z) V. h5 @
也就是:0 @: P2 M+ U; X# d% J
& F/ {' m' r/ ? d- \ **我承认你的监管体系满足某些共同最低标准。**0 e9 g- T% h/ B0 A
' H) b" A0 k2 f1 W$ s7 l. {, V
这在国际贸易、航空、药品、金融等领域其实并不陌生。- l- _ G6 J4 V9 c/ u
. n* N( h& z: v5 \
于是:
6 T. _1 ^+ e1 U+ J1 ]! V; G" i+ }* }/ C; ]$ l: g9 G* v
|
|