|
|
赫然 发表于 2026-9-22 04:19
* h9 V9 z) C4 [6 e+ E0 Q1 \这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。
& c1 T: m' z2 ^% `! q6 n6 Z7 L- M1 K* n( h2 H; t1 S
这里关键不是要不要安全管制,而是谁来 ... 6 D/ z! t) H7 J5 n* B" _5 q
AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
8 P9 [1 P1 [( J' h: i9 N+ d3 \4 W( r' J" ]
你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。3 L9 [2 \" M4 r4 a; w- f9 Z( D3 O
4 b$ i$ _, r) \- W& Q 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2. l; I+ E6 Z( ^. ~
% k3 j5 L7 F3 N* Y0 y5 J- G 但我会稍微修正你的结论:
# M3 o2 x8 m$ q/ S; _6 |3 v1 }8 ~- L6 K, q N; {! D0 E
> **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**& T; b* v4 h) ]0 p, J" g
. l2 [7 ?. K% p
这两个问题的解决方式其实完全不同。
2 N" O4 p6 v$ n- U0 [7 O3 @
. _* ?. F* N1 z ## 一、真正需要解决的不是“谁监管”,而是“谁验证”8 J& x7 ~$ \* k
* c- y! d5 C/ W6 U- j( ~$ ]# t 假设:$ g& W% c' P6 Z% C+ y% w9 \
6 P# x4 H3 t/ O8 H& C; r - 美国监管美国公司;! z1 f' i9 h- y, F, [( [
- 中国监管中国公司;
) A: k- n2 ?$ x- 欧盟监管欧洲公司。
1 l a+ J& w, R3 S) u& p$ F
0 p2 \ ]( U8 M4 ]8 M 这本身并没有问题。
3 F( t0 b1 }% W& l; d+ n) v4 l7 D9 U R# l. R( @$ T; S1 P7 Q
核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。
2 n6 Q3 f' y( b' y
% g: _: m( Z" j) s, P8 N 真正的问题是:
# M* ]0 O4 M2 K# {
' c( E q3 p, ^, M/ D0 I5 R > **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**
9 ?" I, ? P6 o>6 b4 h. ^4 Q) n( R. |( o6 Y+ Q# e
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**
3 H. r6 @: e8 r& q' c. a5 \ Q' e! X5 T+ R
如果答案都是“不知道”,国际体系就会陷入你说的困境。/ V- b/ b F, ?& K
* f& p+ Q! k/ J# y, ?* a; r$ t* y
因此,千万不要把目标设计成:
* k8 A8 R1 Z2 r9 }0 ?. v3 W! m# z3 u$ a5 q2 s* r* j: I
**“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
: ~# I4 o6 @ [) J/ h- `
( @8 K# a p2 t2 h- Z 这几乎注定失败。
5 ^2 B# W5 A" t9 ~' h2 N7 H
- t" u5 B* W s' y 应该设计成:
* w1 m& y3 I2 ?$ D2 \6 i' K( H6 B8 S1 G$ G, z6 u$ h. _1 \
**“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**
9 e. V0 c& j4 F" e* ~' p( P8 X: h1 {- L. f0 e. j# i' ]
这两个制度差别极大。
* ~8 H' a( `- C$ W2 }# \
3 z( d- k5 o: w3 y% a5 }---
( Z% O0 C3 V7 b/ D. b+ y) c% Q. F9 N- d4 V( W+ O) h
# 二、我认为真正可行的模型,是“核查而不是监管”# Z, Q2 P) n+ m
, n0 D7 G% H3 B- G* }
这里可以借鉴一个很重要的国际关系经验:& X% X5 @) L; l
! M' m- Z' u7 `' F' j: L **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**
" p# m* e A& ~4 D
' z% F2 ^- d% m 换句话说:
& G2 r, |$ w; z9 s$ i" q; I7 ~' S0 P. D% _1 U2 [2 J
> 不需要美国相信中国政府。
2 C$ d7 R. n9 Y, r. E- G>
$ v* m4 P9 _$ f) y> 不需要中国相信美国政府。8 F4 v+ T0 E: d
>; c! v/ Y7 N, s* Z0 o5 }
> 只需要美国相信一套验证程序,中国也相信同一套验证程序。4 L" c' Z4 n( O: [! `6 E* ?
% A: f" v" ^. u 这就是制度设计的核心。
7 N6 ~2 }) w; Z7 Q
# Y; B2 D& u0 c+ j: }5 ~ 例如建立一个国际 AI Safety Verification System。: y X2 C: C$ q* P4 N$ j
& u; a. a9 l) W 它不拥有:
9 I* b. h0 P3 ~0 o: n- N0 U6 }- F4 ?% E E
- 逮捕权;
( t; V4 n f0 N& x" {- 执法权;8 v$ G4 ~1 Z( D/ Q
- 关闭美国公司的权力;2 K3 ~8 T/ \- Q5 Z# ^. h; ]
- 关闭中国公司的权力;
& [+ U3 P7 i8 V9 T0 d: v5 l- 决定各国 AI 政策的权力。
6 p/ E5 E9 i& w* }6 l& L |9 v7 U2 |6 Y$ G2 S) ^/ b" C
它只做一件事: \) t( T& `! N B$ F6 N# N! }
4 N. A, d5 E8 ^# V
> **验证一个 AI 系统是否满足共同定义的安全条件。**5 x o3 R" H$ y2 d
# H, a, o: _! k9 {" E+ R
这反而可能是中美都能够接受的。
: `& H4 N! E$ [$ A" s+ g; C& m1 l7 t: V1 w2 _
---3 h: ~+ @4 n1 m1 U; D
3 r# i, Q7 d% V1 R # 三、关键是把“监管”拆成三层
9 T' O: l7 Y! H- U% G, h0 v7 l. l
& S g, M2 o, K) y- u; z+ z 我觉得这是整个问题最重要的地方。, @: M8 W0 X) d; U1 [3 B$ r
' D/ n% Q* T/ o8 F* h2 R J4 ?3 [ ### 第一层:国家监管/ m, Q; a+ |1 v1 S: h
! Y k" [' g! W! E4 i
完全保留。
" Y# @- F0 G$ g
4 F( U: d% C0 v1 G 美国:) ^% M5 f' S- M, o
% c1 J6 `. Y2 {) @/ R4 @% F. F2 ]
> 美国政府 → 美国 AI 公司$ \+ a1 p9 T( R5 K; _
h+ ^, f# o8 D5 W. m/ T# x2 w" l
中国:
* @9 f' r4 Y6 @" a$ a/ i0 T. u! r2 h8 O! I+ e8 w) V: Q- G
> 中国政府 → 中国 AI 公司
! X* T$ s3 a7 r& U0 _3 f6 r
5 w4 {8 C* D# y0 H) O# o 欧盟:
% A1 v0 c7 D5 i1 y3 C6 g' P7 u) K9 x# s, D
> 欧盟 → 欧洲 AI 公司
4 P) L3 m1 y8 F) Q- U# v$ x: e6 ?# v* q& x8 _
谁都不需要允许外国政府进入自己的监管体系。3 [1 u4 D( ?7 j9 Z& N
7 l) g$ G* k# N( F1 [& c& A* |---
8 ~8 u% j( P. M9 k$ k1 C' ~# |. S1 M! R$ [* o7 V; R3 p
### 第二层:国际标准& j- H# L/ E8 [2 l0 l m
* V w- S/ } e
大家共同定义一些非常狭窄的东西,例如:
4 F( G. K" ]6 u. T
6 e) r4 {. {/ E7 j- c - 什么叫 frontier model;3 L7 y [, J! t C+ ]) [8 m {
- 什么能力达到危险阈值; Q! f, P+ w5 X8 G* t9 r
- 哪些能力必须进行独立测试;# j$ e& S7 D0 E
- 哪些事故必须报告;" z, r8 G1 B0 e
- 什么叫“重大 AI 安全事件”;6 P$ } I$ g9 u U4 C
- 哪些模型必须进行 deployment review;- M3 F; A2 Q8 K$ n
- 哪些模型必须保留审计记录;
$ X9 k( B8 [4 o4 `/ o" L, t) H7 t- 什么测试结果达到什么风险等级。
- e; M, R" w, H _. M- f; d. @4 }; [( F9 `$ p
注意:
. Q9 J( Y! t- x8 l ~+ C
+ o+ y& W9 W' r% M+ \ **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**2 A) X/ ~. w" ]
7 Y& k! i6 B3 w 这会大幅降低主权冲突。
. l. X$ N/ D/ ~1 ]# ^# J
1 h7 I% `! X, i( k---5 x m, i5 D( @
+ Z( J& [ r7 R ### 第三层:国际验证
$ ?2 z4 l- e/ h3 i/ g: F3 G; g
' G4 T3 o. k2 d1 T, A( J" y 这是最关键的一层。( ^, q3 a: j) |
* t2 H! [ ]$ H9 I 不是让中国监管美国。" d/ C. p3 \) B
/ m4 \$ k1 s# j3 ~ 也不是让美国监管中国。
3 s) J& u }3 K- O. r; [* [ A2 h& {/ j0 W( A
而是:4 p5 Q( A( V' T. w4 o
& K% c" Z: _- G' O
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**
3 ?' K+ |/ a, M0 X, s& u8 S& P! E7 a' X. n; h
例如:
- G. y) K, V0 o! m' w2 n2 h
% o8 i; z: C$ g" H 美国说:
: E3 B! x0 t" i$ W4 s2 N0 N: v* e0 B o+ H" `2 H
> “我们已经测试过 Model X,安全。”
% D+ }( R# t+ i! R5 B0 F* y' X
( a3 Q% t- _2 @" F" M2 [/ g 国际验证机构不需要接管美国监管。
+ M: |/ M+ n6 z) X* E- l& }$ Q
它只需要检查:6 d% x9 F/ }- F' C9 {- W5 E
& [- \$ v! t6 t6 I
> 你测试了吗?
* @+ u& B8 M9 r. l6 S. Z>' I9 o) E6 [3 Z4 I- w7 f
> 测试方法符合标准吗?- L+ G: W7 B, }% G) T: A) p' X$ B( b# p
>
~5 ~; n, U4 Z% }+ C: F> 测试数据有没有造假?; H* U3 @, z; z' d7 l H0 I) }
>6 ]5 r& q# Q8 i+ `* t5 D o
> 有没有遗漏规定的测试?
9 x% @: [) m+ A2 i G>
3 ]( x2 Y/ k% ^( w$ g3 ?6 C> 测试结果有没有达到规定阈值?
8 h, M1 w# F w
/ n* p8 Y# [2 Q/ m1 F5 E 中国同理。5 W3 t4 v1 B7 T4 m; j9 i
' D5 S e- `9 p& r 于是就出现了一个非常漂亮的制度:
) `# W2 I# y- e- J' `
9 @4 ~ [" y2 \$ \# M **国家拥有监管权,国际机构拥有验证权。**
" j: _3 v- z: ~* K0 w/ k( m) {" F$ F- r) T" S0 E
---$ U3 |' k( i0 z% n* J7 j
% N" z- q( {* S9 Q. X6 {7 A # 四、甚至不需要相信“第三方”
7 L8 e' z- h! H$ [' K: i. |1 b9 n" o9 |6 q* w+ i/ D: @( x
这里还有一个更深的设计。: ?- H3 f/ q+ U: b# [' N# X# q
7 [% z0 w: ?5 s- y7 g
假设中美连第三方都不相信。
" P: X8 t% Q6 Z; W! J) c) c8 R2 e. [" w0 X1 C1 {6 P
怎么办?( a o4 [4 e5 g) f0 h9 I5 O
~# ?7 `" p/ s ~2 e7 v3 }% s' ^ **让验证过程尽可能机器化。*** d. z! K0 G) w7 n' t! j1 u
* X0 }; e8 }- R% a7 o" y& r, h; U 例如建立标准化的 AI Safety Evaluation Protocol。$ S0 J& y) `# b7 e
/ U$ _$ o7 H; r' ^0 Y1 z
一家中国公司提交模型以后,不需要把模型权重交给美国。
" t* U! i `5 U% Y; @
5 f7 `* e$ d4 \/ ^ l9 C# } 一家美国公司也不需要把权重交给中国。% w7 \' F: a. K% f6 {
- W. c& u' U9 M! w. D
双方只需要运行一组国际认可的测试:( M! n/ W P- M$ t- h; z: V8 ?
( Y9 d1 u) ~ J: d; Z
```
# }' q, x6 [3 k1 i+ z [, JCybersecurity
_3 ^5 I$ |) J/ j. w6 I% b. w4 z, SBiosecurity
0 p, t" O) P$ s3 q2 [; V3 MAutonomous replication) A' o+ V) H7 M" F; J% H. s5 J
Deception
: l4 k7 W) [" `+ h! i qPersuasion
$ n& o& s3 z* P% i" n: eModel autonomy q% `1 M2 \$ v+ v, P, C- m
Critical infrastructure attacks! j7 A% k1 m& |& Z6 ?1 ?
Human-control loss
/ a' U& p8 ]) p- ^- [- d```
; H8 ]/ r# a, Z4 c, x' C! \9 A8 X3 V9 A
然后产生:
- a& T4 `5 r7 B k+ \! a4 O4 r6 }4 |% r% m
```
/ l# y1 b, K; t/ QTest ID
6 m8 A; Q6 C) t7 Z, x% XVersion
* N0 D6 a. k/ [2 j: WResult/ p6 D0 V% ]2 R @
Timestamp J6 M( r9 H! c. F. V9 w0 j5 f
Evaluator2 R2 w5 h9 g8 w
Cryptographic signature2 \7 G# Z) l$ M" B7 O- T6 n
```
& M% K# X( f p" I0 t1 M- q; Q; Z$ J& H
类似航空领域的适航证书、软件供应链签名、金融审计记录。: U- k" ]8 q) J; s# Z9 e
+ E8 s- b9 v) \7 a9 e5 X 这样国际机制监督的不是:' z |" j' c9 R% U5 j4 }' e
G1 U! N; T5 K- D
> “你的模型内部到底是什么?”
: {+ W n s: I. L$ Q% ?4 F3 ]" F) o h( K& F' R: y" S
而是:
; T/ C0 P3 S$ U6 P; P
3 g9 i5 U% A3 x/ y# f7 } > **“你是否完成了规定的测试,以及结果是否真实可验证?”**, M1 o: H9 [& u6 a
4 p) P3 {; H. ?4 N$ y- n- d 这会比“外国监管机构进驻你的 AI 实验室”现实得多。) Q# a) \0 m1 [' e
/ M. W) X8 h5 I8 }: Q% a7 a---
! u: ^* }" R5 }4 W3 o5 H1 i
# ^$ W0 l( \3 W$ L7 ~ # 五、进一步可以采用“相互承认”制度
. Z9 s! u0 I6 I9 @9 F
. y2 s. q; A. {# @3 N) s8 k( S 这可能是最现实的突破口。
3 k M+ q% ^. |) {2 d5 t9 O- g- B6 T1 Z4 S' j
例如:
: \2 w, g H5 k, E" s" v4 _0 D" m w! M5 |$ d
美国说: |( m$ f8 b: j7 e
' t9 ]. T0 A3 `1 M
> 我不接受中国监管机构直接监管美国 AI。
l/ o' Z- Z; |2 U6 K) O
4 T( r r& h- V; M6 A 中国说:. b! Z% H) Y/ v4 j; b! r( s; @
% R5 W6 @0 G+ _) P; H' R
> 我也不接受美国监管机构直接监管中国 AI。
/ Q; Q4 `- M* o; w/ R* I& f* n
6 }4 s1 F# ?. t6 V 完全没关系。
% r. {) C4 S! U1 x( l2 a0 P+ h0 t8 A. [9 [4 w, D2 m2 F4 m# J1 x
那么双方签:
' S" W( @- d2 \( @# q; m8 P( ?3 P e4 p! d" B/ g
> **Mutual Recognition Agreement**9 o7 z; v3 @9 _; c" i9 ?3 y) d8 e
! S N; F; j: K( J" H4 n
也就是:# M3 I2 H. a L: R
( B6 x4 n3 m& ~3 ]/ { **我承认你的监管体系满足某些共同最低标准。**
2 ?' i6 r h+ g+ M' {2 T1 ~; E2 @" s4 ]3 K: \! x
这在国际贸易、航空、药品、金融等领域其实并不陌生。5 m- T( T0 u7 w7 P- V
/ d M! x, |4 g- n+ B+ E0 M. v# Q
于是:+ o b4 U; x5 d2 [, k9 i# [0 @+ G
% n" m; E; [' l3 h6 e K* x0 A, E- J
|
|