|
|
赫然 发表于 2026-9-22 04:19
, f/ z. C s2 ]( G9 `这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。$ G- o) B( h0 k" {4 m- ?/ v
6 j7 |/ ~. R! h! T9 m3 F
这里关键不是要不要安全管制,而是谁来 ... - @2 J1 m3 u4 Z5 s
AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
# `3 P. A- a e0 j; p( L1 W$ W. v
" D; X) i" X, a3 [+ ~2 @你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
0 c z" S( @5 d% }8 r1 b! p
- q0 ~' L+ |6 C* ?; L; q 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2% z2 N6 _; R+ d$ i# t' w
& r9 y j; C0 @ 但我会稍微修正你的结论:1 K& S3 j; D3 l
A: I5 M9 | q > **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**7 f# B. v6 u5 _" H1 o
' n' \# t: S( n' S( a x
这两个问题的解决方式其实完全不同。
$ ]- o( a7 P, E' H3 o
8 @- m' h0 @- b1 p( z9 r ## 一、真正需要解决的不是“谁监管”,而是“谁验证”
) c! f f8 |3 G2 `7 D
; p1 V7 p4 y- i# i. }; w7 i5 c 假设:8 z5 ], [! C0 g3 K
9 H; v5 ~; s! v% B. _ - 美国监管美国公司;
; @6 l2 p3 Z: z }8 c5 r o- 中国监管中国公司;$ ]2 y8 R! N$ M
- 欧盟监管欧洲公司。$ r6 ?) z, p$ a9 S2 m
2 n" M0 j+ q: w& F% @4 I0 r" { 这本身并没有问题。
' y/ u8 L0 i, w+ f- m; Q2 ?# v9 j
' y, C2 [6 Z" J w" c0 ]2 X, M$ | \ 核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。
7 E% E1 ]$ t: m8 s) M7 _% |7 U0 \9 Q/ R9 [3 L" M
真正的问题是:
r# ?2 P* ~/ G7 y; Z4 Q! S+ W/ {& S4 K$ a6 F3 ~! r
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**6 H8 o7 n; U7 s2 c/ P4 J
>9 ^0 ^# @' F) R
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**. d6 S! n) q( v5 z
: \- p4 M7 s0 M
如果答案都是“不知道”,国际体系就会陷入你说的困境。& z- n7 ?. ]- G: x/ t2 x) G' e
0 a5 f; m6 k% _; z. F( ^
因此,千万不要把目标设计成:
2 W H7 m a9 q8 k# N" x9 @0 ]) @! V% p: W( j ]: k; A. ]
**“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**$ @% v! V& h7 v7 i
9 J& N" @1 |8 u$ d- Y7 |! d# v5 r8 b
这几乎注定失败。4 z( x6 Y/ h) R
7 Q: q0 ?5 V r
应该设计成:: z7 K* `" ]6 o8 u
" u; P9 i+ S# z# }) n# v: n$ |+ E **“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**' k. ?0 g. I' g. |" T) N2 D @& x
- a/ N; x% b/ v) j* v 这两个制度差别极大。
+ a- }7 H) y* g+ K
1 a$ y$ T# s! M* {---
* [" ?3 B6 }4 D& J& u
- c' B" E# ~! ^7 m# j # 二、我认为真正可行的模型,是“核查而不是监管”) l# L* P& O6 ` c3 Q
5 \' Q# I6 j0 r* d, [2 w 这里可以借鉴一个很重要的国际关系经验:
6 D) `, _' A) o; F3 h& B
" V) O v/ K# O9 T5 i **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**
) A6 } ^1 Y2 @, @9 U( F
( E% {3 q6 [0 p( Q9 k* h 换句话说:( R, F4 |9 q7 w- [1 c' [
2 e6 p; Q' t# G
> 不需要美国相信中国政府。8 g: L8 d$ E4 g' @: T; o ?0 @
>* K2 B, A) {$ x6 r! J
> 不需要中国相信美国政府。
! r$ o: R5 i2 ?9 b>
. L+ O2 l0 e- X" P5 K. S, v> 只需要美国相信一套验证程序,中国也相信同一套验证程序。* r" V# j; K8 N. E+ ]9 e- {
/ p t- [$ W& V1 e7 l! n2 u: J 这就是制度设计的核心。
4 D& n" A& B, ]" R" L0 r& @! f& A* `( X) H$ r' e# h% i- k
例如建立一个国际 AI Safety Verification System。
! y) `# a ~5 f# g+ m; I: u% x, o
5 d& @" _0 b1 q! u; u, P 它不拥有:
: |; l0 M' B$ v7 \+ {, Q+ I
+ e. s) n# l1 K2 [ - 逮捕权;
& V/ M+ I( g& z5 z( q" E5 c- 执法权;% `7 \4 G8 C/ L3 P9 c6 l8 O
- 关闭美国公司的权力;
$ a9 Z% ^$ f# k- Y) Q) m' @- 关闭中国公司的权力;
/ W1 a1 p: V3 t: Z4 B; ~- 决定各国 AI 政策的权力。5 n7 V3 k4 e b$ }) _
9 E( h- v l# Y1 n
它只做一件事:9 j9 E8 \7 ^/ {
/ p5 ?0 M6 X* N9 G& v > **验证一个 AI 系统是否满足共同定义的安全条件。**
. M* E1 N1 x; {+ H# X! f( T# D. S; f
这反而可能是中美都能够接受的。( a) A/ K- Q7 q. ?; ]
& A& C3 |7 M; q: K9 P# ~9 z% l0 j
---& h, {' c# `- n ?* [- F
( Y1 U2 a0 n! X. f6 g! G1 m( [
# 三、关键是把“监管”拆成三层
( p. C9 q, H" [: j$ E( Y% X# M# ~. P2 G% M" _% K
我觉得这是整个问题最重要的地方。3 F9 [4 ?7 e5 _9 G' y6 _ x
) v; |5 B, m8 k% q7 T2 \% P2 @( R
### 第一层:国家监管. P( S6 k: I, j* S& b
, h& D1 G; F t: t6 y
完全保留。$ g5 X& j) _+ o3 W+ V/ |4 e: |7 v3 q
- `2 u. S0 R8 R; s5 p1 x" Y) |5 ^
美国:& o" \, }3 E( D$ D% e: b" S
0 y# X* I) z' g. n% x > 美国政府 → 美国 AI 公司
$ S+ m% E6 C5 [; P+ w/ U+ _0 [, n$ r! U- ?5 h: v
中国:
, A, B8 h' A$ l" i5 `) U
+ z- C# k7 F$ j > 中国政府 → 中国 AI 公司5 h5 j( j% D. L" ^/ w, o; B
6 m/ h# q/ t1 i2 R# l
欧盟:! h/ r* U9 y1 Q K( B; z) q) `+ M
M, l6 _$ D5 a9 u; l8 @! }
> 欧盟 → 欧洲 AI 公司
2 w# X4 n* N; `. T t/ B( T
* h2 O7 w- x. ^0 D3 S- N7 v+ r: N& _ 谁都不需要允许外国政府进入自己的监管体系。; |0 |/ W& o ~. d( B, Y. l
: U$ t; {6 Q3 c---
: s0 J& s9 q* u9 \" v+ w& U# p% m6 T y# w
; ^; l8 i' o9 y( \! [2 V, J2 z ### 第二层:国际标准: Y) ]7 d1 ]1 p0 a2 ^" M' ^3 G
5 n+ v( w4 u1 E 大家共同定义一些非常狭窄的东西,例如:
# s# m/ z/ {! D5 n8 n
H; G) \- Z; x9 D8 m - 什么叫 frontier model;% C0 ?7 r: u7 m% h8 T/ ~
- 什么能力达到危险阈值;
' ^/ I& ~; C0 U' E2 Q0 a Y- \! `- 哪些能力必须进行独立测试;% p0 V* _1 T, T$ D
- 哪些事故必须报告;
! u7 x( P3 Q! n3 o0 h- 什么叫“重大 AI 安全事件”;0 C; Z' `8 k) W9 V. Q0 W/ \
- 哪些模型必须进行 deployment review;
* E: K1 j' p" M" t' Q9 y9 z- 哪些模型必须保留审计记录;1 t d" s1 E5 g# X$ d0 b
- 什么测试结果达到什么风险等级。
( E. A. p: l! b- `1 x0 \) J6 O" Y2 Z$ b) X/ H7 c
注意:
3 R: G% v( d- Z4 H( s* {% S- t6 }: U4 G# S* H
**这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
3 Y$ i |5 C; e8 b% s2 x9 ?" ]
这会大幅降低主权冲突。 k3 n3 F7 E2 S# d, U
+ ?5 J4 d$ e, @0 A
---
" t6 F" }8 y( J' u
; g* W0 E9 g2 F9 r ### 第三层:国际验证# z) i8 v! q+ n; w$ |* Z$ a
]( |" O6 W' E6 ]4 ~- i2 m 这是最关键的一层。
2 M$ D6 N1 k' r8 B8 Z+ T- ?' F- \4 A' F! M
不是让中国监管美国。
; A# V. R" z$ D) W5 b H. w, q2 ^0 i8 o8 ]" S7 K
也不是让美国监管中国。6 }8 u* W1 j0 }2 w" U" u& q2 P
3 j& X8 E4 d4 D+ d- |0 e 而是:5 S, O% B. O9 N2 M2 O0 f7 U1 A* N
/ ^8 ~# d8 b1 D- n$ R: T > **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**' c* b8 M& L+ i8 E7 g
( i4 S& c: M! H* P 例如:
% A# n* q; g7 }2 `$ e
0 J# G6 l& s0 _, p( l1 x 美国说:
4 W- {6 C+ P+ [9 q6 q
3 w8 m1 j6 }- o$ F+ E# ~7 ^& R > “我们已经测试过 Model X,安全。”" x4 L9 x7 }( U+ S
+ Q6 g. a6 v6 T# u, F2 u1 o# U 国际验证机构不需要接管美国监管。+ b0 \3 z$ W& `/ ^4 A" x. h! V
' N1 I* R$ ^1 ?
它只需要检查:6 G4 k) b* I% F& x
" l9 z' |; O6 a5 ]' ]/ a9 } > 你测试了吗?
- Z+ u3 g) |; t* P4 D9 d7 S2 m5 a$ C>
) k# _- {& k- t$ N! w# |> 测试方法符合标准吗?7 w+ H$ i- |8 D
>
( }0 Q. U, Z- O! a> 测试数据有没有造假?5 A( p4 B' C- c$ F( ]
>& G* E% ~5 ?& Y
> 有没有遗漏规定的测试?
9 c8 u6 G1 h) w7 o>
1 i( d2 p! ~8 D7 m, P& `. }* W* J> 测试结果有没有达到规定阈值?& \3 {, D$ r" O; W2 m0 T/ u
& ^( X$ K. |! o. K8 @; p, P 中国同理。! b6 @+ H7 R& V; e3 d& H, A
- g' ?+ W7 u# v/ Q( ? 于是就出现了一个非常漂亮的制度:
/ ?; I1 s6 i# i$ y* f8 B" }: B8 q
**国家拥有监管权,国际机构拥有验证权。**+ e7 k T z: k( L7 L( p" H
* H9 r, j. \5 P0 Y: m d---7 ^9 K" D7 r0 H, ^" Z( s" `
7 O. D( {/ k7 ^) U& v
# 四、甚至不需要相信“第三方”
" R, P$ D, y. a0 i$ R$ ~
6 c7 X& ?- F1 @8 f3 D0 V% m; b 这里还有一个更深的设计。6 L- Y, Z4 \& X) [) h2 {
$ o; V) i+ o5 O/ o6 B' ~ D" |- b 假设中美连第三方都不相信。1 T. l) K s& [1 g! I
) c6 h6 X+ T2 G/ j; [) t
怎么办?' W, H5 U# Z7 w) `7 z
* ~4 U5 c0 @* L5 ~4 y
**让验证过程尽可能机器化。**' y% e4 w0 b& ]2 G! u- w8 g& v
! ?. [" Y' m& l- _( \ 例如建立标准化的 AI Safety Evaluation Protocol。9 S; H: U# |$ O2 B5 Z# X: X% L& ~/ L
1 N, v; b% ^8 i( Z+ A( K; T0 _ 一家中国公司提交模型以后,不需要把模型权重交给美国。
% w, h) H1 Q2 |* w& J- _- L( O6 `: h. w& x: t2 Q' J
一家美国公司也不需要把权重交给中国。
* a& S& s+ E( d/ b( n1 r) U
6 V+ a5 L8 b: v# z 双方只需要运行一组国际认可的测试:
, Y( {5 b- t" o4 M9 q0 z# x1 l x& S l1 j% F! K
```
0 X: ~6 P% b4 s wCybersecurity& O# k% `. R+ d7 C" H" ]
Biosecurity
; ^7 L4 a. Q6 VAutonomous replication
5 V n$ u* |# m* uDeception' N. x) Z* T$ a! j. i9 e4 \
Persuasion3 {& {; c2 F" n1 d' Z
Model autonomy7 @: n' m8 e" A! Z
Critical infrastructure attacks
) w' E0 } K |8 P LHuman-control loss
% z3 V1 z# c' I1 D: m```
% P9 I' ?6 k$ K; v# E! ^# f+ H. }% O$ @
然后产生:
* ?" V7 D6 }9 v$ G( d* w6 m4 e+ D4 x& u
```
9 U5 f& G, M# y; r) u5 u. ^' h9 x7 YTest ID
% @+ ]# X; M2 r: }8 mVersion
' C1 A+ _- h( I! w" qResult/ n! Q% W2 B' I1 F
Timestamp6 W2 U# J, F8 M4 i( K% @
Evaluator
8 @, V: _+ K5 C8 E* z" P/ wCryptographic signature. ^, ?' V5 d W! E% T4 B
```
% V5 M+ o# r9 I- `% x' w2 W$ v8 q9 t3 e4 t# D i1 _* O
类似航空领域的适航证书、软件供应链签名、金融审计记录。
, J) I9 _6 e- s1 ?1 I
+ U, G6 R) M- N& V7 X3 i 这样国际机制监督的不是:7 O0 t7 Y' B% r3 c' k8 f
, @0 f3 ^* L6 D > “你的模型内部到底是什么?”
) D! p/ e( y( j* a6 ]& k! ?5 z; W( Z. P" g$ M
而是:$ Q4 I# d# q3 O/ ^4 |7 x) R
. f% s5 V, O+ z1 |
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**
- \: g' _( P+ h6 X l
/ M9 V! U# ]) D, K, U; c 这会比“外国监管机构进驻你的 AI 实验室”现实得多。* g' H* R& g7 g5 U/ W7 m7 s$ M% |. W) H
0 `: K' u9 O# r j) u; a, v---) ~% }% D7 b% H" Q' e
" [, L9 `( X7 j' N3 n* g # 五、进一步可以采用“相互承认”制度
7 _* p; U+ k$ t$ m9 Y! h5 `1 L* @, r" O0 [" x# h
这可能是最现实的突破口。 n$ U1 h. U# F5 [8 u: S) `
) X6 t% y) e0 `2 h8 H5 c 例如:
- D5 E# b- u9 C; {, _3 n. r
9 U7 P3 Z# o& `* H# C+ ?+ R 美国说:
: m& A4 ~6 [& _* w' e3 w' y0 i& _0 T4 l7 ` a# x. y, h
> 我不接受中国监管机构直接监管美国 AI。
5 m( X+ m$ X2 c0 t+ a5 N
' Y; p+ Z q: U' w6 j9 R8 A! c 中国说:; N6 U! H d k% U
; \; \+ }$ c; O, o9 S0 G > 我也不接受美国监管机构直接监管中国 AI。
, J8 M' W2 m- {- }- b" Y& o* k% Z, `% X
完全没关系。* K" p& ~9 L' F& T( i+ x4 Q
& I9 X- v4 t, |0 M2 s. O. N& n
那么双方签:
* r! c0 @# U K1 d' N! V7 `% Q) |) E: ~: x9 y& |9 j* T) ^
> **Mutual Recognition Agreement**
4 Q9 i$ K+ G' s0 k4 a# o- I2 j$ e% Y2 D4 P$ ?" F0 \6 d' ^, x
也就是:
- q. G1 L4 U: I- f, V! E
$ c+ Y0 k" b( c8 K7 N2 W( \3 F **我承认你的监管体系满足某些共同最低标准。**
' y* p& ~: ?) l2 G( Q; }9 T( i4 H5 }+ I/ e/ K
这在国际贸易、航空、药品、金融等领域其实并不陌生。
1 Z: o( I, `- f* a6 d) C A2 o. g1 c0 Z9 l( {
于是:
; Q9 X' S) Y( g8 N7 Q3 Y$ l7 n0 l, {- B) b. ?
|
|