|
|
赫然 发表于 2026-9-22 04:19; E2 O$ ?) a6 i" P4 a. w
这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。, F# Y6 |4 F+ R
' C2 v @# M7 T: Y) Z$ g+ F
这里关键不是要不要安全管制,而是谁来 ...
: h1 t" U2 D$ P) kAI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
7 J7 _+ {1 P3 `. o/ B. r/ [ ~
3 g6 m; o- d3 U+ C- V b' ^你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
( ?( V* i# }2 c8 \! G4 U6 [
. C4 u: C9 K8 Z 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2
) N. f" y0 O" y4 f' F9 Y# l3 w8 A4 w! H3 g/ u* H6 t" P
但我会稍微修正你的结论:2 O" r2 ^2 Q0 w; H% F- b
! O" j+ T% B# R
> **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
$ h) |- o9 r/ p% p3 n8 o6 _4 j7 h% N, a+ I9 T+ @
这两个问题的解决方式其实完全不同。
2 J3 O0 R2 ?3 U5 a3 p- f% Y# d2 M" {7 D; o2 j; V( s
## 一、真正需要解决的不是“谁监管”,而是“谁验证”
) A: a i1 Y' G8 B, k9 M5 s
2 n6 T, \" m) g 假设:. q0 N5 d7 P" \6 Z( R5 w
+ C. V3 }6 e! v* ` - 美国监管美国公司;/ g% R6 ~) z( e1 F
- 中国监管中国公司;5 m' h2 @( T5 k h
- 欧盟监管欧洲公司。# {5 J% C; _. ]7 c+ C# \
+ \' l% B1 s) e: m2 G
这本身并没有问题。! [9 j: l: f. p3 P9 a
" G( j6 @8 W/ |: @' h 核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。. ]& T+ w" t4 B
8 o. O: L1 r! H
真正的问题是:
. ^. i; ^1 q q3 ^! M# i
+ ?# ]7 s% P, B- e2 s6 n > **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?** [# [# a5 a4 v4 u5 t2 Y! W, P* K& @
>
* N2 k3 ~ M3 { Z* \- B. s> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**
4 m9 E2 Y- y9 p* k9 _4 |5 t; c3 V. Y; {
, R6 \2 E2 x. L* _6 _( X3 G2 y 如果答案都是“不知道”,国际体系就会陷入你说的困境。
! p6 j1 c) `4 q+ N+ e: q4 L& \6 D+ U0 z/ ?5 G$ B
因此,千万不要把目标设计成:4 u/ z4 R( Q$ X
% |4 T9 m7 U: u: F/ i5 a **“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”** { F! ~, C8 u3 D3 h; ^
% ^1 d) z+ ^4 ^2 q
这几乎注定失败。
0 f, \) i4 l* ?/ Q+ f4 n( i/ I
, W0 r- l% I; z 应该设计成:- E1 h6 A& a2 N
e k: J6 y* ~# K3 n$ g **“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**3 I! E* w5 Z7 P2 ^; W1 N0 C
& I1 k4 g# A- B; a& H( S' W3 ~$ k
这两个制度差别极大。
( [# S7 }5 ^- s' _; i
* e% Y! A" v6 i% h$ J3 f7 u0 ]) I, ~---
' s* i$ j7 y2 j# Q
" O9 C& X9 ]& e8 e. J; P # 二、我认为真正可行的模型,是“核查而不是监管”+ Z* }; L7 e3 p2 x8 D5 o
9 ]& C4 [0 n4 |; n9 K 这里可以借鉴一个很重要的国际关系经验:5 ?* k! d' ^) q/ @) i3 g& z
, }* F2 }% I- G/ G5 j# o# O
**国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**3 [# n8 W* r$ |3 C3 A
) V/ P/ |; C+ q' ~+ q. J( c2 [ 换句话说:
* K4 j9 f% @( b/ G; @6 f! A$ D6 |8 j; L* n" s
> 不需要美国相信中国政府。8 `0 y, f# G( P: S# v: r- d
>
, u$ ? X, @4 E0 k3 e3 t> 不需要中国相信美国政府。" K4 f* ?, O6 [9 ~
>0 c2 @# M4 K4 w u* y; i4 J
> 只需要美国相信一套验证程序,中国也相信同一套验证程序。
1 X$ k5 w- U: `, T; J( N- X& h* B- Q# \6 z5 {) P i" v
这就是制度设计的核心。
" T6 ^, D* a, W% i& n% |0 f2 A4 ?1 _' v' J- Q
例如建立一个国际 AI Safety Verification System。# C* e& D; \6 d/ X2 |; J
9 U5 R M8 z+ q9 v
它不拥有:
2 ^3 B1 ~9 T2 ]8 l, c) ?& U0 ?9 G0 w1 w% K3 ?- S
- 逮捕权;( y0 g3 e5 v& j* [
- 执法权;
: B- ~3 T- V1 c. P L" A3 R2 x- 关闭美国公司的权力;
7 I1 J z3 k$ L- 关闭中国公司的权力;% M, w& p) x" m* k2 o
- 决定各国 AI 政策的权力。
7 ^) T* u( \) i& J' K! a, I2 Q. Q; M
7 I+ n& [ e( l$ r4 | 它只做一件事:( n, F" Y& u' T
~3 l+ }% R1 W( U- z& P' Y9 A > **验证一个 AI 系统是否满足共同定义的安全条件。**
* q z ^$ l4 m7 o5 _- |! {- d2 ]1 _& R
这反而可能是中美都能够接受的。% n3 V! w, U; ?# K
# a C% Q9 H" m---
6 V3 }( W) l& e1 B1 `0 q3 C1 t# ]- `) \7 _6 V7 i
# 三、关键是把“监管”拆成三层
+ W f2 z5 G! }$ ]3 I$ S. a2 o6 V0 Y! B; p8 K0 T
我觉得这是整个问题最重要的地方。
' H: J* p/ Y0 ?3 o! K% M% Y
% j* R, [1 I8 E2 l ### 第一层:国家监管) Y2 I3 ^5 R4 J# c+ F! v+ s: y. f
+ K; ?. S5 z$ [+ J
完全保留。
+ l6 s0 g( |% E5 f8 e- Q
8 T" `& }: J% {3 z 美国:
, f4 X# a/ u4 O% T; x4 R4 Y
# N4 C+ B, q- c% q H > 美国政府 → 美国 AI 公司; Z: f% R% P; t: d( E
+ a$ M" x8 q1 G* ?% Z) @ 中国:$ f0 j" [! L6 x6 v8 j8 t/ S% D
& n) r" i1 a4 v5 Q+ u$ u > 中国政府 → 中国 AI 公司
9 C9 B( U8 d$ v/ }7 b& Y& Z8 I% I5 V" }- e; @ ?
欧盟:+ l' l b+ |+ d* Q3 V. }( }( T! Z8 K
: s& m) |- w; ?: r# x
> 欧盟 → 欧洲 AI 公司) }& S W& V4 i! k9 c
( l* w2 N# T8 T2 g 谁都不需要允许外国政府进入自己的监管体系。
5 I+ [9 L) S0 b& W% C& n3 R& }6 R/ u6 k- D8 i
---
: f' W8 C, N6 m' R4 j3 t6 s* b5 d) Y$ G
### 第二层:国际标准. c. l9 s9 E* J# I# g
1 C9 U! `, E: N* M7 r" c
大家共同定义一些非常狭窄的东西,例如:* \2 U( s9 F" j
$ \2 i4 S! O, u' j9 R* z0 V7 s) l
- 什么叫 frontier model;
9 L% Z W* Q1 d9 j- 什么能力达到危险阈值;
# K3 p$ f6 O6 } L7 h- 哪些能力必须进行独立测试; J& c8 K4 m+ k$ q# v f t- k/ B
- 哪些事故必须报告;
8 F) Y; H9 V, s4 ^' ^- 什么叫“重大 AI 安全事件”;
% O* H5 f$ e: V- l5 \$ a5 r- 哪些模型必须进行 deployment review;
+ j- o! t7 ]$ t- c$ N+ q" ~: F. K2 @- 哪些模型必须保留审计记录;4 u4 p8 x9 x" s
- 什么测试结果达到什么风险等级。, i) {8 l, V/ \9 w& ?
# `9 h$ U8 e5 V* P, G
注意:
0 X# F8 i+ _ W; g; E& @# s/ ]
" n! |$ M( n" k) H7 y **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
/ V' }9 D) x6 ~3 S1 @8 b# _3 Y H! H6 C
这会大幅降低主权冲突。3 w" B( r. R2 D3 g/ |
, Z: q# n5 L* o4 E- ?
---% ?- F+ q0 j$ l. v- H1 T
: o2 Y4 H5 W2 V! [6 |2 k: ? ### 第三层:国际验证' t! q$ N! z: \2 L5 H' A, {
9 Z! |2 T3 r2 S9 p" f! Q" O1 _ _
这是最关键的一层。1 U: E8 \& ^7 I4 Q8 j* T# e
- Y0 t0 Y3 Y" q% J
不是让中国监管美国。' \9 W+ y, U. u- t% X. x% g6 D
7 R( I$ E2 `' x# ?/ Q( B# B 也不是让美国监管中国。6 E% L5 x- Z) h7 e5 l
7 V/ J/ {# v8 B" G* d 而是:4 b* Y$ E( t2 q+ }) Z. |3 |- d
3 N$ a. T% `6 ?" o2 a: {9 K
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**0 q, o! d; u0 {2 a; o& m0 R/ _
* z" P8 r5 i) q: ~ {& c
例如:: R9 }* _" r- v' \& n
: _6 L1 q' I9 n |
美国说:
e o' ]3 x( X# A, Y, y U! D$ E* J) y, n w& _
> “我们已经测试过 Model X,安全。”
) Z W) C4 @* R* A! \( Z; F) C6 W
* T9 M/ s* E* [/ N9 {$ p 国际验证机构不需要接管美国监管。
2 A2 v* a, z& T8 R5 ]( {* ?0 x) w
! t- J* A' q# K# _( ^ 它只需要检查:
Y+ P5 V/ S. a% V ~' f" C; x* [* @3 S% \
> 你测试了吗?0 n( r8 I$ j/ D6 v6 \! F
>" n$ v# p6 p9 \( n
> 测试方法符合标准吗?
9 i, r. q# F. h) O o>
7 B5 x$ t4 Z4 L> 测试数据有没有造假?
" {- T8 V# `) ]5 m, Q>
' b5 m3 H) x2 S0 ?/ t6 i2 E> 有没有遗漏规定的测试?$ \& M8 J5 o8 v% H# b2 @5 r
>
2 s5 U& H" C& z; B' m> 测试结果有没有达到规定阈值?/ Y' r( ]# \; P J. j/ |9 o
9 R0 w, J9 r' G: l; D 中国同理。
, Y @& ~: V0 L% f
* y0 K) C( q; X7 T9 \/ i 于是就出现了一个非常漂亮的制度:
. |8 c, t S0 z. ]; Y# I m. u0 W/ y5 Y
**国家拥有监管权,国际机构拥有验证权。**, C5 t- v7 L: z) o8 Q
5 N7 F2 C3 i' B7 {9 ?* H
---5 q! |% w9 t2 g; g: N
/ \0 l' k, Z6 E) p0 j7 _- X # 四、甚至不需要相信“第三方”3 ]6 Z' k/ j" H" r+ W3 P8 y u
4 R/ j! n% }: L; o9 m 这里还有一个更深的设计。# J9 B7 P4 Z/ s2 z- e$ G$ g9 k
/ R* Q7 k k# P: f8 v8 a. ?! F- N" l
假设中美连第三方都不相信。6 m9 ~& d1 Z, b/ A4 `4 I/ j
& M, ^. o' Y3 I0 x* t. B4 G 怎么办?
; {4 ~' j) ?; [# e2 J. M( u
$ `* @) K/ P; x! M, r1 w **让验证过程尽可能机器化。** k; g7 ?( n1 `; p7 C
e$ N8 ?# ?. g1 H: A, r
例如建立标准化的 AI Safety Evaluation Protocol。/ U2 r' \: x. G3 j: E- e! l4 q
( x$ x+ ~3 z! w
一家中国公司提交模型以后,不需要把模型权重交给美国。5 t4 d7 {' ]+ z! S% m2 ]6 Q H
) | s: _/ O8 i/ } 一家美国公司也不需要把权重交给中国。
0 B. p7 Z: @' q) B! h6 a! c/ k" H8 H* z* T% T0 F) U8 m5 W
双方只需要运行一组国际认可的测试:
* K: {! }/ F, G% i8 w8 h0 G3 P. B' R
) [9 a, H" c- R2 R7 F```
% V; ^8 s/ U4 U& jCybersecurity4 L+ U& s. s$ K5 t$ i- k+ |- O) A
Biosecurity
6 d' L( i1 ?1 r& H0 ]' HAutonomous replication
+ g2 `4 ^- L1 M: u# jDeception2 ^9 e/ x) }! E& K U1 e2 l
Persuasion
" S: j7 h+ w3 gModel autonomy% e2 F& s9 T0 \. D6 @# u7 E
Critical infrastructure attacks8 f- p% a4 ~, M" K
Human-control loss( b1 X, ?! U7 Y
```
! @4 t* J, f' u, t) O- F, x' f& r3 T. m& V, [$ B
然后产生:$ g% Y; O1 w- {% x4 C7 B! ^
4 M) {5 f4 V' J) _( Y. E g4 L```' T3 W6 |4 S4 f$ o c
Test ID) J! z2 O& p# e1 d4 k/ t0 a( P. o
Version/ y/ w" b# Z! K0 j/ G7 M5 S, l
Result. {# L a" @' \2 H/ }) y C8 M% X
Timestamp
/ ?% l! m0 K1 W; U, l( q9 dEvaluator4 z( R: u; J: V+ J5 N
Cryptographic signature
; e+ }5 O* x1 Q/ C' C2 p; \```
, K' Y4 k2 {2 }, V( O4 O$ X# x$ O- f2 h& b4 E6 [
类似航空领域的适航证书、软件供应链签名、金融审计记录。
& h0 d6 q9 T. u! Q4 F4 }% ~; u) R: L
这样国际机制监督的不是:
9 ~" m. n+ ^5 o/ s* B' U
& {6 J7 m' A r1 n- k- u/ t, V > “你的模型内部到底是什么?”4 @3 \) H( o- X: t; @
5 Y( n, n; ?( i0 i 而是:, ^. J5 p- Q( c) w* K
7 Q# g) x: O. \6 F' l0 s1 C
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**$ N7 k' i# E1 a) C Q' z0 N
6 Y; r5 T2 K' R) g" _7 ? 这会比“外国监管机构进驻你的 AI 实验室”现实得多。2 p5 q3 R( ]% V8 y! J
1 z7 A( t: D4 z. t% t. U---, g0 g2 X; Q" {. w
3 P% V5 Q; [7 l- X' Q& B # 五、进一步可以采用“相互承认”制度
& `3 m' ~" U" s( N( G9 p/ ]0 H9 L0 i$ R1 _
这可能是最现实的突破口。! I5 b. h. v2 a8 `& C; r
9 b4 Q$ f/ R4 {) C9 h
例如:
/ O3 ~- G7 ?! n7 E8 W
8 ]2 P0 B$ U. p 美国说:% r8 o' e5 Q+ ~7 e7 A) U5 S" b, @# H
& u& W* E% X7 g! c > 我不接受中国监管机构直接监管美国 AI。
! j B1 H! y" Y3 x6 G( q: e
# j) I/ M$ V0 C. A8 b3 Z9 Y: S 中国说:9 n% x) W4 g( {+ D5 `: ]
' \* o7 F' K( b, Y, c% F' y > 我也不接受美国监管机构直接监管中国 AI。
: o$ Q r; _% j8 _9 V# `7 K4 X) v# o! M" v& p
完全没关系。
- A3 x& M! p$ U& [- c1 E% {
: E4 F* {# h* n) A$ Z% E Y& P 那么双方签:
5 k; o/ J/ f; L, V0 N( I5 v! \; G: B3 h
> **Mutual Recognition Agreement**
2 p- ^" r9 y% A4 _! U4 N( p; f6 G& a9 B! \
也就是:
9 V' {+ x% ^. {& W1 {1 ?; ]- r/ F. w ]
**我承认你的监管体系满足某些共同最低标准。**
+ _/ k/ x9 v) L) I4 X: P7 F4 d) S" S; p' V3 S8 P" b" `
这在国际贸易、航空、药品、金融等领域其实并不陌生。
: \# K1 J) E( ~! c5 C, S
- n7 m! Y7 s: K* v 于是:
& U3 L1 M. I+ l3 V/ P* O2 k& c( ?1 m8 B' y
|
|