|
|
赫然 发表于 2026-9-22 04:197 c" `& ~- w6 A, c
这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。
* Q9 F0 i" E# J; P0 x4 r- }0 V2 @/ C \0 z/ |7 V
这里关键不是要不要安全管制,而是谁来 ... + O4 n+ v' `0 r" _" N( ^
AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。0 d9 h! g! c- N
8 {4 {; e( V& E) Q你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。, K, x& m& W. M1 `6 @! K
/ F9 @% U! q& U* |! o& L* }, Z. } 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2( O! P1 n, ?( I7 |; m7 |& [
( z O0 O9 [4 |% b+ k5 a X+ N
但我会稍微修正你的结论:3 A+ R; |0 t+ }9 T) `
( L6 y2 a m+ V > **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**( x* k/ m1 l d6 U
4 d9 W0 ]9 `/ v
这两个问题的解决方式其实完全不同。
# p- ~. `3 x* a% V. c, I2 `8 I( u4 S$ o, S( I) I
## 一、真正需要解决的不是“谁监管”,而是“谁验证”
' q% J2 k$ {" g5 W
! H' J0 E( t r W( _ 假设:
/ g* M" o9 O1 ^6 a4 K0 e
) d% ]" F' p6 K; K' e - 美国监管美国公司;7 U& X7 L! O8 C: @/ W4 n
- 中国监管中国公司;
- g2 T& f9 T& {# D$ p0 ]" A6 ~- 欧盟监管欧洲公司。& Q9 [; I& m3 a: p9 w/ Z3 F$ S K' s
U/ j4 B( U+ N' M0 A 这本身并没有问题。
4 Q2 J9 X$ N; A! W5 w- ^/ _) v
; Z6 B4 O G k: @ C- T0 i' m' A 核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。; C, m8 ]" m* @+ w2 ^/ W& e3 N
7 S& G5 U5 a8 |: ~$ O. ]' P$ b
真正的问题是:' Z" P3 T6 a; A
# l) D/ v8 ?- ]7 ^
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**
# N; \* L7 x( u9 z5 P0 O>
! q9 s9 J; t7 _+ v6 Y* ^# ?0 g D> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**
" e; M9 G3 R5 ? Z# \6 G) X" w0 [1 X4 M; B' W" U
如果答案都是“不知道”,国际体系就会陷入你说的困境。
: z3 H9 }7 Q( I% b6 ~% x( c0 e7 h& G5 |4 H5 R
因此,千万不要把目标设计成:
, {; e. p1 x" K! t$ w1 [3 g
9 L+ u: C2 E" u T H+ \' N, o& k **“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
* U8 F- r1 ~4 @6 t& _2 P; r# f& C' H) I0 ?/ K) u
这几乎注定失败。9 p4 T* E+ [1 L5 O7 L6 z
1 ~' A# N: K9 g' p. U& i+ T
应该设计成:9 D D2 \+ \" Q7 F4 M7 i; ]
( {" [9 l$ V1 A8 o7 O
**“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**
1 R- q) q" H* p C
4 D) a8 r6 s5 H9 a 这两个制度差别极大。
3 l( j6 p9 J+ N
9 }6 M# z: R9 @ t! D. d/ E) ?7 M---# K( R0 e' X4 t& k4 Z5 i, p# e! p
/ [' S9 [& R {3 V! R- o4 w # 二、我认为真正可行的模型,是“核查而不是监管”' [; r. M$ B h3 N& Q0 n
* z4 o9 U+ H1 T8 Z6 {$ N
这里可以借鉴一个很重要的国际关系经验:* w( b: ^7 |, h5 E: g+ X* B4 `6 P6 M
0 v0 X" f! k D! u **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**' f! V( R' |( w1 I* u+ _
- L* O+ N/ {( C6 Q% q* D6 `1 N" {7 \
换句话说:" P. l6 P. z; C( S% F
: C( h/ _ P# Q > 不需要美国相信中国政府。" o) @9 ` v+ g9 e% w9 P/ L# j* h$ M0 d5 S
>
- E3 a4 D. @4 f8 }* V> 不需要中国相信美国政府。- W9 F2 ~* i' S0 t7 W
>
9 o2 {) {8 t9 F' e! M" \& b> 只需要美国相信一套验证程序,中国也相信同一套验证程序。
- j" O! D% U2 f* b: ^& r" [8 o
; D$ D, \+ D) H1 o+ p: N 这就是制度设计的核心。1 q" q1 U6 Z d( j+ b9 C* S" _8 ]
) g/ s6 g3 \/ L
例如建立一个国际 AI Safety Verification System。+ _& W5 E! s, I% H2 J* f
0 n" g! {% { A) Y" |. j
它不拥有:
" ^- j) T/ d- o. P, e o6 |2 e. r8 H2 o; k$ P9 J% l' u
- 逮捕权;
$ n) h3 k; L; {- 执法权;1 [: ?8 ~0 v; f( n. S/ C2 H. F$ h
- 关闭美国公司的权力;
4 K# V. L$ _8 H4 q# P; m- 关闭中国公司的权力;
- I( G* ]. d! e, s# W5 h- 决定各国 AI 政策的权力。; ?; Q5 p+ w2 l9 \
9 W- b) h2 J% U1 P- O; |
它只做一件事:' j; D8 v+ {. e- b. s7 O. Z
" Q: R- \* a/ k/ l* I3 X1 D3 c
> **验证一个 AI 系统是否满足共同定义的安全条件。**0 o' ]: {6 K2 \% M0 o) j/ `
; A- `; @& d- B7 ]4 ]& J 这反而可能是中美都能够接受的。2 i9 J9 g- P9 r& a/ T( m0 Y
; E" @# r# X( O, Y) ]) ?) h
---
% j0 q* P( X: m% c1 I2 @' X4 | ^3 i+ _" `
# 三、关键是把“监管”拆成三层$ E5 l! K9 K" t, x) T9 O+ b
1 N3 _ N' g0 Q1 t' b
我觉得这是整个问题最重要的地方。
' i$ [' w7 L! U* f7 }8 `! k( P" E
, d. z n$ K# Z0 t# Q' P ### 第一层:国家监管7 Y* a9 V, u, U; Q2 J& P
/ C# u4 a8 R v, d! `
完全保留。
) X* q: K" }9 [: b: y2 J3 a5 o# `/ Q" S/ M, b3 S3 c. r
美国:
8 x# h! f. U2 A: e; ~" U/ s! q& k3 f3 ]( a) C
> 美国政府 → 美国 AI 公司$ e4 Q2 P1 [" O
3 f; E K$ R) A7 ]' d 中国:! p. {$ I3 ]* l! q8 s
9 |+ F* m& Y% p B3 U. t/ R
> 中国政府 → 中国 AI 公司
: b8 R1 @: O4 }7 A/ ^
S( B5 v- }) ~4 W: y3 p6 B 欧盟:
# Y/ N& z7 K2 T
6 u% M- ~& ]8 V! e > 欧盟 → 欧洲 AI 公司; b# m+ P& g) |' V. J) g1 G
3 _8 r. a1 P2 h9 H$ W2 `. ]
谁都不需要允许外国政府进入自己的监管体系。6 B: B! v7 N& L3 D9 j
. S7 P0 f1 m1 A4 r---/ A9 D2 @6 o* Q/ y: Z, D2 u+ c2 p
9 s3 ~+ c" J- K( s3 a- w8 {
### 第二层:国际标准
Y. h! C0 l! i' F. ]1 B9 m: R0 c, K6 d Z# k2 o5 F2 ]
大家共同定义一些非常狭窄的东西,例如:
7 r& J: |/ } E$ T2 e2 i: A9 s1 z% w( K/ _1 \0 d
- 什么叫 frontier model;' A8 u1 J9 y6 m1 R6 @" b
- 什么能力达到危险阈值;+ T4 G: ~# ]( m. N
- 哪些能力必须进行独立测试;
; o# ~, w* @6 @9 X0 I% C6 ~7 d- 哪些事故必须报告;) ]. n6 j; q7 G _) \: N) Z
- 什么叫“重大 AI 安全事件”;
, a8 r+ n- S, ^' d1 T( J; C; ~# v- 哪些模型必须进行 deployment review;
% S2 t' \9 S; ?9 x5 y: \9 K) L. n- 哪些模型必须保留审计记录;
* Y% Z& y. I* ?; Y, M2 j- S- 什么测试结果达到什么风险等级。
% }) F! @, D# U; S" g P) E# E$ M
- P; @" C. z" S, r$ z$ j 注意:+ @* s% i% S& H& _$ k% v8 s* L
8 j1 L) R* S) {& t7 c7 { **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
; m# t* c/ s' w7 V* m
9 d4 f1 Z% q# B) m! O 这会大幅降低主权冲突。
) q$ q$ q/ x: E7 F
& L9 z; e+ v! a3 ?3 _$ @- h5 z* R---" I0 Y' S. V$ p% I- |; n' j% y5 H* X
- ^; b4 S" \8 j5 } ### 第三层:国际验证
# ?# I( B) ^0 N( j2 F
% A' ^: a& ^) ~$ | 这是最关键的一层。
4 n; G y# N! X. E4 b0 e/ y- Z
. ]7 K) ]. D. @8 U+ O8 D* r 不是让中国监管美国。
, s8 S4 h- }/ [7 J( G7 d# y
/ X! i3 [# m$ k' d$ }1 d4 P& l 也不是让美国监管中国。
" j& F, P) c c8 P" |) W( k2 Q
" H5 e: v }! H) I3 o6 m 而是:
* }' S' h% h/ `- d. n
2 w# P* A' x' v; }9 ?+ ^5 u7 n0 r > **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**% ~# ^+ M$ p" [4 D5 X
) @/ @( W! f" S3 ^& P 例如:
6 d. K8 N( s. x- H9 F4 u
6 k/ g4 T& X, L) } 美国说:1 r p/ k5 U) L
; ^; ~6 G8 k4 L: w: p > “我们已经测试过 Model X,安全。”
4 L$ a! f( y% w$ Q9 F8 X2 n8 m$ i" Q3 Z4 X" g
国际验证机构不需要接管美国监管。
" D; I1 U1 r; W$ d* c- W$ p4 X, u
/ Y% t' N7 v! R- K 它只需要检查:8 \ W/ L, i+ k( g; E
0 j) y, j J" T
> 你测试了吗?; @- n8 \8 L4 U* ]$ }8 d% M: B
>& W/ ~' j( h) O7 K/ M `
> 测试方法符合标准吗?. I# ~$ t* H$ _" p- v% j* n
>2 m1 t/ a% U0 ~8 G9 u; G0 w
> 测试数据有没有造假?, s* q5 v+ R0 Q1 E* ~5 `
>
- P! M2 j3 }/ i. P> 有没有遗漏规定的测试?. U. X, x8 f, R- \
>
[" B5 e+ a' E0 l8 }> 测试结果有没有达到规定阈值?# T. d, N/ Z$ d6 { a; w. K
2 {2 o1 I" t" N' X) v 中国同理。
6 m/ ?" l3 a& K: w, o. {9 [' x7 v/ K6 U6 u2 f' z; ]3 X+ w+ `5 Z j
于是就出现了一个非常漂亮的制度:
x' N1 r7 a/ p$ V0 g; q- J3 h4 ?" {: V1 E) P
**国家拥有监管权,国际机构拥有验证权。**2 J$ Y8 D8 ?( Q5 o4 d
; M5 g/ d- f4 E& M3 E$ f; t
---* y* n( M1 _ e. w y' Y
+ o2 T' E) c: K% J* S% h # 四、甚至不需要相信“第三方”2 D! y* r) i2 ]& Q! s' p1 G
, g. r, n* {. Q% z$ X
这里还有一个更深的设计。; Q- x6 ] C& n; D8 }1 a2 B
7 f } X: b1 {6 I/ E% X
假设中美连第三方都不相信。/ S: F( e% S4 F( r4 [. `
- w3 e- j2 [! E' M5 d3 d, ~
怎么办?
+ Q- Z0 F* R0 _0 R: `
8 E' A4 w* M9 N6 \$ B, B& E8 r **让验证过程尽可能机器化。**
1 Q5 K( F0 g5 D" k K6 _6 C' z2 F* D' e. S* {' p
例如建立标准化的 AI Safety Evaluation Protocol。: G* R: a8 D% t7 `
+ Z) q2 f) _0 V% v8 `
一家中国公司提交模型以后,不需要把模型权重交给美国。
& P+ j0 t/ P0 O/ N7 G" G4 u3 W+ I8 z5 A: s( E
一家美国公司也不需要把权重交给中国。
6 _& C. u2 `8 j* i) c; m+ B% Z q
双方只需要运行一组国际认可的测试:
I* k+ \% b5 N7 Q6 r
. e0 S! E& a& n```% d! \' C1 G. u! T( b
Cybersecurity+ p' S! U& a2 T
Biosecurity
* G9 G: O$ `3 g/ t! bAutonomous replication
; D0 Y$ O% p+ _Deception0 [8 m4 Y5 Z5 P* d7 @' D$ a
Persuasion' t6 `# D) x n, O$ }! w( h
Model autonomy! T. ^/ Q1 E: R* e l. N
Critical infrastructure attacks
; C/ a# b2 g. A: e1 G; }+ d4 lHuman-control loss$ E7 h: i% |9 S% }
```
) `* \8 h( k) y
5 t q. h) o1 J% n7 T4 ?1 M 然后产生:
0 v) M& ~5 ^3 ?2 o# M# S
$ I. _: @$ r- P( V```
1 t3 n0 Q, K! C& d3 wTest ID
) f0 x4 m K5 b$ J4 \! MVersion
& V2 j( [& i2 Z9 z3 D0 R- g! NResult4 G* S/ \+ x+ i
Timestamp+ Q A3 `7 k, _1 P, z) q; x6 K; v
Evaluator
; @4 h# q! w3 |Cryptographic signature4 x% [0 x& d% h' \
```- e2 {$ L# j$ L- y; J, E: b
" p" g6 D( m( E4 Q
类似航空领域的适航证书、软件供应链签名、金融审计记录。
/ R: }; t- D. L1 @0 z( O1 I) w9 v4 I! S" b( r# ?
这样国际机制监督的不是:) u- t3 D l- g+ E0 O9 q/ j
/ E% ]& ]; x& Z" n# T9 r
> “你的模型内部到底是什么?” d- t( M% _9 [
" y0 K0 p' Y! d. P% ]9 S 而是:
1 l2 A& L; z0 z2 @$ [* T( |$ ?4 f q% }' }6 e4 g+ Z
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**
4 i9 }* y0 |0 V4 ~7 t& i! E* x9 ?+ S. _: f2 ]
这会比“外国监管机构进驻你的 AI 实验室”现实得多。$ Q( [% ], p$ c8 H& r) C
6 g5 B H3 v6 ]9 E6 @
---# X' l7 W, _, S5 R
% `7 M4 k! [0 ?& ~, N$ ? # 五、进一步可以采用“相互承认”制度( K( h5 ]* r6 `3 l* }* U+ A
9 o) g3 K; I& ^9 ]* w/ J% k: |
这可能是最现实的突破口。$ k& g' T8 U2 j0 B7 d. q
|3 p: K P8 A# S. L; I1 } 例如:( m% N5 o4 V- O& p$ p$ N9 B
" F5 [$ g8 J1 I' r
美国说:
* a B* P, A: ?( u8 q% |9 R V6 ?% u- b$ j1 F c
> 我不接受中国监管机构直接监管美国 AI。) Z4 h; @ H. H- d, {& U
+ i9 q( u9 ]2 Q( Q 中国说:
" J8 F( c/ h4 k
" A3 |6 T+ Z: K8 e. E > 我也不接受美国监管机构直接监管中国 AI。( @# P; C) e" x/ P6 a% d
, v8 w* X0 _, i. n$ u
完全没关系。
5 F t3 f8 ]& H! Q9 U/ ^8 _0 ?8 l; x( n# a/ b3 @) Y
那么双方签:
& ^+ \) M! Y4 k9 q4 u8 e/ p* s2 l
> **Mutual Recognition Agreement**3 Y) D7 n) F9 ^) ]2 F2 ]2 D
1 X. S. i: p( g4 i7 A
也就是:* y/ _! z. \# x u/ Y" C( `5 E
! x" P4 g9 i& Y2 J3 d **我承认你的监管体系满足某些共同最低标准。**
/ o/ k3 w& W! n5 h; S3 Y
7 [$ ?7 c X4 ?5 D0 o 这在国际贸易、航空、药品、金融等领域其实并不陌生。
$ x8 I; E# @: S6 D2 T& I1 y4 R# I: [' s6 U; i& z) j
于是:; d8 w2 j5 ]. B5 R9 |2 X6 Z
; b0 K6 Q/ _9 ?7 z( k |
|