|
|
赫然 发表于 2026-9-22 04:19$ c) P! Y% R5 v! y3 O, k! h
这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。
n; ~( R5 _1 x p
Z7 X, ?6 d! D D }& I2 z这里关键不是要不要安全管制,而是谁来 ... 9 o4 g5 \: ~* t: y [6 A0 r5 b
AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
. ~' p3 D \4 ]! x; L( b1 @. F% B: i ]! i. v
你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
$ G6 n9 }0 v5 `8 }6 l
( a0 T1 l( b I$ n& |* ] 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2" x# w% R( i d
; z, R5 I* u4 b' B1 h0 m: e3 F2 B4 c+ b
但我会稍微修正你的结论:* v* w2 ?! z! q1 @
. H( U, G% [. z! ^# j+ y
> **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
% w7 [3 K8 k( r' ?$ m! a" D$ @- I+ j3 O! u" @+ a
这两个问题的解决方式其实完全不同。) O. s4 `" E, y8 \# G& r. i7 c
. F) {/ Q2 F8 S$ n1 v
## 一、真正需要解决的不是“谁监管”,而是“谁验证”, P4 I; @% K* L j' J- C' }
5 I9 Q6 A4 R. [1 j1 j 假设:) S6 d8 K4 y! o; D2 k8 ?% W
( \+ @: C3 }( Z5 c - 美国监管美国公司;
& x$ p! V$ s, c& Q& j3 Y9 H- 中国监管中国公司;; u6 h; A' E" Z
- 欧盟监管欧洲公司。3 H( s7 ^5 v- \. M1 `7 w4 w) x* i* y% Z
$ l Y% F& @( {0 W( | 这本身并没有问题。
" w# e+ b2 m1 Z7 f9 q- A2 J- ~- @* C7 W! }9 z
核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。. `5 N- @. h7 n7 y0 j [5 i- J
4 ?9 g6 r5 o0 c7 b4 W+ p 真正的问题是:
- ^, n% N, a4 Y7 q1 }! k% c' h' x# X6 b# Q' y, }: T! P
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**
6 n% J( o" g1 X% ^# u5 d& X- ]/ ]>+ ~1 B# I/ O$ H3 n3 n
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**
5 {/ u( |$ H" U# m+ C8 ?
/ K- }% s2 m$ m/ B) h8 z 如果答案都是“不知道”,国际体系就会陷入你说的困境。: Z; M K6 X" q I. e- Y6 F
9 n/ e+ j# w3 ~% l7 u% k. Z u 因此,千万不要把目标设计成:
4 I4 f3 g) E$ \# j9 k, w& ?8 I7 P$ q: Z+ J( d1 }5 T& {2 Z' {+ l
**“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
2 [- K5 q1 V. a, b- ^7 A
6 a2 \7 V$ [* g2 H7 C 这几乎注定失败。# x# ?7 K/ a; [7 y* w5 w1 \: i3 B) E
( i2 l! c: b& ?1 @3 F f 应该设计成:+ R; Z" G- I3 H7 i3 A& h! m4 D
' l5 i3 {1 \( ~& b* ]! p6 S6 R) E
**“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**
: h9 n! a( B* r6 m
- K3 l9 p2 A! R6 F& E' L2 J2 M 这两个制度差别极大。' T7 h% }0 r/ a9 f& Q E
7 A; y; u1 s6 D& M Y& w. `( p# R' ]---; {( w2 Z# g3 O
9 P/ z( ]' P5 C
# 二、我认为真正可行的模型,是“核查而不是监管”- H/ j& C8 Y4 W m6 F/ }2 I
l6 [3 ?. o0 Q8 ~
这里可以借鉴一个很重要的国际关系经验:
; H n/ Z5 ^5 @7 s) j" {) [7 g2 X
7 f! W/ Y6 [( N6 |& H0 h. t **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**% K" X+ J7 Y1 A: ~- X& y
9 F. ^$ Z$ q# b3 L( I
换句话说:8 t- E3 ]; \( _3 d7 D4 [
5 f+ C& Z S% w% G: \
> 不需要美国相信中国政府。9 ?( `5 h9 l) J" j2 e
>
+ o( f" B4 I0 m- Z> 不需要中国相信美国政府。2 {2 C% P l# d( m6 j6 k6 ^
>6 Z4 D2 V; S4 j2 e9 N
> 只需要美国相信一套验证程序,中国也相信同一套验证程序。; ?3 e& e, A# a* Y( Q, _
) r1 u1 u! X/ E* h& j3 g# e
这就是制度设计的核心。7 a7 e9 F1 X/ n( q& i
4 L3 D7 p4 i' W5 a( i+ x 例如建立一个国际 AI Safety Verification System。+ G+ l5 D' K; y) A: |
) U8 u9 {: @+ d$ ?% n. v
它不拥有:
3 T/ H4 L+ `* t* f% F3 L1 s$ _
4 A% W z1 r4 |; R4 I2 t, O( j - 逮捕权;6 G. T2 a7 G+ O! P4 G
- 执法权;; \1 M3 ^4 w+ l' r
- 关闭美国公司的权力;+ u3 P: P! B- v ^7 [
- 关闭中国公司的权力;
" f. K% E0 m3 C4 C- 决定各国 AI 政策的权力。
8 P- Z# l7 R1 C7 z+ m$ k: F) k6 [+ Q* @3 k, F) v
它只做一件事:
- y, b0 Q/ b: U6 Y
9 @. U1 \+ f+ f& x$ ]5 y > **验证一个 AI 系统是否满足共同定义的安全条件。**8 m' O& N! X3 I" _2 l0 V1 m5 `
8 X3 _. k& r5 A 这反而可能是中美都能够接受的。7 ]% t4 m2 ~- B8 P
; a4 N7 g' t" b8 W( c, m; r1 p
---
3 H! U' i, |2 y8 G$ ^9 ]' J% M3 y
# 三、关键是把“监管”拆成三层
* B" G3 ~! r7 j% O. H0 w
# V8 ~$ |1 |9 R7 p3 W" I 我觉得这是整个问题最重要的地方。
. _7 b7 p. E! z8 l3 a
0 l9 w9 y2 ~+ a3 H! \! c ### 第一层:国家监管
( Z9 H, D1 n+ ]9 V7 O5 {3 T* |' @* }7 ~
完全保留。
7 i h& |! k: u" L
0 |0 q+ R' Z# J/ B 美国:
7 x- R B: ^# V& C
5 ]5 P- ^ [0 T" ] > 美国政府 → 美国 AI 公司% @" g2 @7 S0 g, e+ U! M
5 {$ k7 R: T b' m1 U
中国:, o( k4 y( R5 ^4 F
+ @! Y& ^0 `- J% F( ]- K G > 中国政府 → 中国 AI 公司
- ]% ~3 D3 s# a/ E; V/ y. G3 a9 Z, R$ |1 D I5 |. r
欧盟:
2 b5 O+ ?" Z' @4 b3 j' ]+ t
2 L4 X1 f# [/ m3 J& r > 欧盟 → 欧洲 AI 公司
8 w% E( F$ r+ l- ]0 [
% p t- p* k2 V* _ a* p 谁都不需要允许外国政府进入自己的监管体系。
1 J( _) N0 J5 \/ Q
b0 k) N; w' k* X* _---
# |) J9 R6 Y; }- W+ o, c8 E1 _! a4 M' h( n. t ~
### 第二层:国际标准5 Z7 K" t6 d6 C+ N" o1 ?$ H2 @, i
7 n6 k! P0 N( h. @. H
大家共同定义一些非常狭窄的东西,例如:
! l, d7 i1 L! d; b: b. M; N) Q& W( v2 m, _- X
- 什么叫 frontier model;- a) B9 r; G$ b; w. _' b6 v) F2 ~
- 什么能力达到危险阈值;# C/ L0 r6 n4 n! Z! M) s
- 哪些能力必须进行独立测试;
( R$ H3 P+ j; N6 U" P- 哪些事故必须报告;
5 b" v5 ?' d0 v9 P8 c/ p' p" e- 什么叫“重大 AI 安全事件”;
# r6 _7 X- L( b) n" @! j, {- 哪些模型必须进行 deployment review;5 M# K) _" c" i5 _
- 哪些模型必须保留审计记录;
! d6 o7 \# }, t8 S& p! }- 什么测试结果达到什么风险等级。
! v, P8 v: E/ H: @2 C1 J# T* N' j, E: _) z; t! y% V
注意:! x+ |5 l0 A+ _+ J; |+ T
& H4 ^) q& {$ j/ M+ i$ {+ I
**这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**: J9 R1 K- V- ~: L; I% L! f; g T+ v
# A% B! U5 Y, |/ D2 D+ M 这会大幅降低主权冲突。
6 D/ i4 m- L' F2 W3 X5 y5 S1 f6 i1 ^, M" L, y
---$ ]' O; L; ]) d
0 t! K" C% L8 U
### 第三层:国际验证
: M. w( C' b% Q4 i! L, z7 t9 k! `. Y; b; C; v% U+ m
这是最关键的一层。
( X/ B1 ]9 d; t+ p9 s8 R# L6 v1 E |. t- K* n; m& o* a
不是让中国监管美国。
9 y# n( d! [* R6 ]6 m6 w+ E5 ^* }7 ^: m
也不是让美国监管中国。% |& R+ ~7 U* j* C
% ?# y, t$ ~" J5 ^- D0 T
而是:2 Z7 L! E" u. y& r
1 p* ^" C' I! N M0 j > **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**& ]: ~* S" e, M" t+ u( `
D* o7 @2 q! s# t 例如:
, N) h! V6 i x, y( {1 r2 A w5 B' y
美国说:5 i [# x* S" c/ ~
1 |2 I% F" M3 d
> “我们已经测试过 Model X,安全。”
5 h3 t0 B& g1 l' H' H: K/ n5 z/ Q s
国际验证机构不需要接管美国监管。/ Z" T7 j, E' f# `+ \
8 w' a" t7 Y K/ X3 D) X1 z5 F
它只需要检查:
7 F& P, {8 b( U! r) ?4 F2 ~0 Z5 Y5 m' G& Z0 h5 f9 }+ M/ v! k, j
> 你测试了吗?
. ~8 o9 h- g+ F2 u>) T# D; `5 |4 Y' @
> 测试方法符合标准吗?* Z# L0 f+ D# j* K: ?- m! g/ v' z
>
6 y- c e& t5 V5 n4 r> 测试数据有没有造假?
% B T h( p1 _>. @* Y: b L H6 C2 U! t" B
> 有没有遗漏规定的测试?# `/ @% j/ O) ]% d( @7 m! x, g
>
( y% O& d, M9 S> 测试结果有没有达到规定阈值?
4 z( D& y9 x ?* G6 W
: n" ]* X$ t* n# H! d 中国同理。' e% I0 W) f% q" K$ ^4 I! M( c
* X! d# K, e* {8 S* w7 m# [; L$ k% q
于是就出现了一个非常漂亮的制度:9 u; x$ X+ j) }1 N; A7 @, T3 s
. t1 n1 z1 K# {8 a
**国家拥有监管权,国际机构拥有验证权。**, [% S& }, Y3 M! H
' l" T+ ^" P4 I" R' `9 I1 S5 b; F/ \
---
' Q. o* W+ m3 n' {2 ]- G: ^( O. Z$ S. k$ N& S: n; x
# 四、甚至不需要相信“第三方”' @) y& P+ n3 ^+ |' ~+ t7 U
2 T( b4 r: e; o" H# Z
这里还有一个更深的设计。3 u. e! i4 C* d# l
5 Y0 c0 R- K. U: f 假设中美连第三方都不相信。
2 H9 w+ K% x+ E& x3 R% P
' i. @2 L- [- {# a `6 F 怎么办?
! `* ]: n7 f0 U% f# @6 \8 s; W! @8 c. G# }4 r D! E8 c
**让验证过程尽可能机器化。**
( ` i" h4 q5 r6 N" c% Z7 d: L* d, `8 f
例如建立标准化的 AI Safety Evaluation Protocol。
8 l6 B0 G0 Y% `! ]' ~6 C
4 Y- U m: P) z6 `4 m- }& [) X 一家中国公司提交模型以后,不需要把模型权重交给美国。1 q7 R9 n* n# _8 O% N2 e
Z( r" D4 v3 {$ B* d 一家美国公司也不需要把权重交给中国。- a. A/ |6 y, V9 x
0 `; j' ]7 w2 Z 双方只需要运行一组国际认可的测试:
# W5 _& y( M" E' p4 y: d h
; _. |; J, N7 ]3 F. ?2 ~```
. F% w9 L# |6 c4 f- |5 b0 \8 UCybersecurity
/ l- y! x+ L5 RBiosecurity' f3 h, y) ~5 Y4 i0 Q
Autonomous replication) Q d" Z0 S% e! \& x& J v
Deception
" j2 | ?+ x2 r: X1 VPersuasion& |) ^: |" y3 A) { ~& W2 q& h
Model autonomy
7 [7 Z. ]4 t! o1 f2 R' V3 mCritical infrastructure attacks" r1 L- {: O9 a9 }2 X: n
Human-control loss ] a7 K7 F! j9 Q3 H
```2 _# e7 t7 q* N3 `/ d% U: _
* V& T8 n' G: O' t 然后产生:& k% K0 v/ a% g* {2 j% K
/ ]7 Q: [' w/ @```
7 P% s' U9 m- n, KTest ID6 }; r: }, {8 _( J. E0 x. c
Version% a! G* c, a1 X+ q2 ^
Result
s& o: R0 F5 A3 v6 n0 W+ ?% P7 QTimestamp z$ E0 j! O. R
Evaluator
. l/ o' z/ t d8 x# u& PCryptographic signature
8 |" o( C0 I6 X1 f```3 C+ _2 j% r' M4 R
& H! a1 y# P; o$ p. l6 L
类似航空领域的适航证书、软件供应链签名、金融审计记录。
, A+ K/ [- G5 V5 Y) ~
) }" V2 Z7 y p% ~5 p8 g 这样国际机制监督的不是:& C Q7 X4 {/ @
* a' L- a( z3 J9 K$ [* y# u1 q
> “你的模型内部到底是什么?”6 L3 h. U$ A6 Z4 t+ c) Z
# r1 |% S+ H" ^( J
而是:; G6 Z- h2 t& R
+ P1 y& \& o2 U3 \5 | x3 i
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**
4 ^3 t7 z# T4 x0 Q1 a
' n6 M4 H4 }! r: }. B8 H 这会比“外国监管机构进驻你的 AI 实验室”现实得多。
( E) k m& i9 p8 l# y* b: z5 g& ?5 f4 C* e& F. q
---
' Z# j. C' K* z/ n1 E, Q3 j& i' c h/ a9 h
# 五、进一步可以采用“相互承认”制度
! O3 x1 P! V- S4 u% G3 e% Q2 G! H, c
' b1 I+ j& i" o$ W5 r 这可能是最现实的突破口。5 I$ @( y9 Z6 r* q
' g2 K, U! B4 }+ F- O 例如:# Y; p5 J7 ~% s5 ^% s. j8 t
! G1 w3 A- b1 T) q
美国说:
3 {2 L" W' X$ h( B, o' a1 Y
4 Y" T8 @/ f6 W > 我不接受中国监管机构直接监管美国 AI。
3 X3 P, G0 l3 p5 E0 @' |. L! B2 T& G. Z* U+ l/ l7 ~
中国说:
2 F+ Q: K5 C) O6 w/ g
c+ s) h; E% ]' V2 | > 我也不接受美国监管机构直接监管中国 AI。
, m8 d. u3 M8 ~/ g; G# x' {2 }9 H- M: m x8 v y% }
完全没关系。
( K( G% J1 ?/ I2 ~/ R8 N6 ?% g" \% o5 C/ d; F4 u1 q. H7 D
那么双方签:) F, `/ ? z7 L9 v. o- w3 N- ~/ O2 I
. T4 o2 j' i9 ^. U* g3 B
> **Mutual Recognition Agreement**- Z7 f& Z2 B: j! k K: X
* }8 b) ?) l; T* a" y, {6 y 也就是:
0 R* p9 H8 j7 z- e0 C
1 ?" q5 \5 c" G8 a$ u/ O- O. k **我承认你的监管体系满足某些共同最低标准。**9 [8 {8 p: d* q! n# a& N
8 z3 f2 v/ v3 } 这在国际贸易、航空、药品、金融等领域其实并不陌生。
% W- T! y) M8 f- z$ }6 T6 q3 [& i$ T- X4 J
于是:! W0 N; P5 {/ y
! }9 ^2 W' q& N/ G4 }
|
|