|
|
赫然 发表于 2026-9-22 04:19
3 P1 z, y" ?- K$ L这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。
8 O# {5 A8 Z8 [ G8 M" u
3 s1 P- E* ]! e* q& T这里关键不是要不要安全管制,而是谁来 ... ) d" J% w8 \* u4 U
AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。! J* T" T; z* }- u6 O
7 ?$ B+ W2 z/ ^$ f你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
4 g0 ~9 p; G( b( \
3 P% \0 i* M7 t2 q) F& _5 o! H 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2
2 X8 A5 W( q2 U5 \/ J) `' u7 P s( G# \8 y) j) D
但我会稍微修正你的结论:1 a- P* b: h ^8 D0 d2 w- v
3 _8 J0 p4 e9 }9 o- @
> **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
1 Q; W1 i4 c1 {/ K: K
: z6 {1 R1 a; J4 r 这两个问题的解决方式其实完全不同。' i! i1 ^* O. c; m! L5 K* v5 |
3 _4 L" F8 u% k& m( }8 d( r3 n# T6 S
## 一、真正需要解决的不是“谁监管”,而是“谁验证”1 c' w; S9 A5 c8 d8 c+ w q) X
, T; n9 c5 n) S" d/ b) n: d
假设:8 a7 O- J5 c1 _% c9 K; r
: s5 i/ @5 u9 U8 L( S - 美国监管美国公司;
3 H$ p, [- C& |5 J- 中国监管中国公司;2 l) @" Y8 R2 f$ @3 _
- 欧盟监管欧洲公司。" p8 N1 D8 o4 H) z% U/ T
$ Z- [% E) P# q" W% Y+ b! D 这本身并没有问题。* j# S7 `1 y/ A# Z3 y
, q# x' U! {: o( w. e! c( F% h0 ~+ T
核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。1 N5 _# o4 B+ ~
9 T: h% g. p" @( v6 E5 M
真正的问题是:
' C' T M/ s, ~5 ^, y% ^* U( [3 t( ~+ `) S2 ~4 k4 j/ d
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**0 b) u# c) F* g5 D: S
>$ j9 o5 B# p5 }. w
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**
( Z& P# h4 B+ z& ?* @. Z% y( m4 @) l
如果答案都是“不知道”,国际体系就会陷入你说的困境。- q- h4 a+ a$ s
3 S1 i% a6 T" Q
因此,千万不要把目标设计成:$ N( C J/ {1 G6 ^
+ g! N6 f: a5 g% z2 p **“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
9 Z- d! n9 O9 m7 ]: e' K. I4 V6 P1 j! Z' J6 x
这几乎注定失败。
! k1 n* z9 Q8 ^+ z9 J. c
, i6 u# q+ I; _/ m; S 应该设计成:
% N0 _* I. \9 x# w* F, `8 x' D- u& i/ z/ o g$ I# `! h
**“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**
: U0 S& W7 t9 h9 ~8 g- R6 W8 P8 A& W" M. |! w" ?6 [
这两个制度差别极大。# Z$ W) b- e$ y* Q7 F" O; w
) S. v( `6 K; T5 C8 g
---; d9 E) A3 c/ W/ ^
0 ~2 J, B: [3 W # 二、我认为真正可行的模型,是“核查而不是监管”# M5 ^ b9 W1 l. k
9 v& w2 M- ]6 p( a9 q0 N* s0 t 这里可以借鉴一个很重要的国际关系经验:: s2 H/ ]! K3 @
# P) H+ F7 m' W, M& p. v **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**
- v1 h& q% g5 a x5 h
% F! H' v, H- } 换句话说:: a3 }& w/ I! H3 ]9 T8 X1 K
% z J8 i4 Q& q) u. v. @5 O; N
> 不需要美国相信中国政府。: ~( N n0 T; k4 F2 S5 G8 M5 \
>
9 Y9 v- L+ C* g6 j& k9 S> 不需要中国相信美国政府。/ [2 Z! `9 H: t3 O
>
7 ]9 H `- v/ q' I* f4 T9 r> 只需要美国相信一套验证程序,中国也相信同一套验证程序。& L7 G8 q$ }* c) n
N& Q3 v0 S: C# E- P( b
这就是制度设计的核心。/ L5 ~. c( E0 v; i" Z$ Y
6 m% G$ p/ C2 g/ j 例如建立一个国际 AI Safety Verification System。
. b5 V O2 y) T" Y
W0 e5 l; \# n8 T0 [1 L5 m9 ~9 a. | 它不拥有:
; }; \" l9 [9 G: v6 b; T8 c' e9 P3 i' [0 d3 U4 G% ]
- 逮捕权;
{2 I* u, q: Q) S+ v- G- 执法权;
7 f; b" w6 t1 F/ _0 Q+ Q( g/ D' N! i- 关闭美国公司的权力;
: @2 j. x! z- m- b7 U4 W- 关闭中国公司的权力;
( d5 j* y: S* n U6 J- 决定各国 AI 政策的权力。
. Y2 e( N- z3 V+ l3 E) {# W; k3 ~+ y; a: w9 X) V1 [* `
它只做一件事:
- n9 i& q5 _% e5 {. O k, A& q0 W3 u6 \1 E7 H7 u
> **验证一个 AI 系统是否满足共同定义的安全条件。**( p5 [* v% p& s2 r A
& J+ M( ^+ D) h0 \; |. W( @
这反而可能是中美都能够接受的。" K- P% h; k5 M( [
1 P+ C( z: B5 }: f D---/ j _! I6 X/ g" Q0 M: T' T5 L
6 X; z- M( J: ~. V! R6 n s
# 三、关键是把“监管”拆成三层2 Q8 {' m$ }5 E0 c
F+ o' n) q- p2 G 我觉得这是整个问题最重要的地方。; K8 h* I# z* b4 ^' A# @: _
1 ^ I- M' t* M& a2 J0 _8 y. {
### 第一层:国家监管
" U+ N1 M& d, e1 F( Q
1 |# K) b3 V/ i$ E5 @5 s 完全保留。
+ o4 k0 t/ g/ C- p- _! t2 {" |2 ^; k; C- P: d: o* @; `
美国: j2 N3 w9 T+ I+ B& c) O- k) a; B
0 V' i: d4 E6 @ > 美国政府 → 美国 AI 公司
5 L% I/ m+ `7 k
6 c Y0 ~/ Y' ?) n. O 中国:0 B2 o4 J( _8 Q% S
4 |$ \( I% n3 N% F t' A5 A5 g0 w) [ > 中国政府 → 中国 AI 公司
3 D& s# c- Y3 j7 M0 ~, p4 y
% k" d6 Y# P6 x+ J3 g 欧盟:
. c k- h3 ^1 I" P) P8 T# z# `
8 G; m! p" E- I8 @! I4 J. a6 r > 欧盟 → 欧洲 AI 公司 p1 o8 Z" Q. S. d5 I u
8 x, `& Y: S( q. q) ^8 ]
谁都不需要允许外国政府进入自己的监管体系。9 `1 ~7 W* i# J/ X% \9 G& a
! S' K0 }# O( [
---8 w7 r. f1 d x1 Y3 s y
, N' U" R9 T9 c" ~ ### 第二层:国际标准" G0 C' v, A3 B+ |7 `' L( W
5 R; O# f$ | n& p! s/ A+ J& Q 大家共同定义一些非常狭窄的东西,例如:
7 s. ]* H, a* U7 k) O5 T
( L7 y' z1 t# k/ G3 K* x6 f - 什么叫 frontier model;. e u2 y u9 W5 c) q& T% T* [
- 什么能力达到危险阈值;% ]% u T' o! C3 H" a8 c
- 哪些能力必须进行独立测试;
; G" j; r# @! g- 哪些事故必须报告;
7 v6 V9 @, f: {" b4 \' C- 什么叫“重大 AI 安全事件”;2 J& {$ q3 D% F0 O I* {
- 哪些模型必须进行 deployment review;
, e6 \% e9 p3 C* f" [3 A/ {; Y- 哪些模型必须保留审计记录;
; F: X- E$ x' Q! `% p- 什么测试结果达到什么风险等级。
* O0 G L! c) G5 W O! h9 ?: _, A+ X6 W" i. Y5 L
注意:4 m3 V) G4 z. y
5 k3 @5 T) s/ n5 t **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
4 F0 @1 L- G( Z2 H% h/ Q8 `6 Q. R! {# r; P' K$ c0 m
这会大幅降低主权冲突。
3 o+ U9 i3 }$ x! g+ u: Y- K
* R8 M) j$ q. m% w5 D---4 `8 G& S$ ]$ h0 M' n6 z5 u( A
; `3 B1 G9 N ^$ t ### 第三层:国际验证
8 g$ C, y6 b6 S5 d2 k
, h3 M! x: M& _" m% n3 r5 y 这是最关键的一层。3 ?$ ^; V6 e" p) c+ P9 B; s
7 _) J/ ]5 P$ s7 b: j" j 不是让中国监管美国。: g9 O+ K8 C! V- ?
0 E8 n* Z4 o! l 也不是让美国监管中国。
2 G' D5 o5 B! t+ G. v- f G$ x: l& z6 `. F, }4 ]" r7 h; [
而是:
g7 j# d0 D1 f3 o% b, m* H- r# P
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**
/ A, N8 N7 L% K+ f. @+ t5 `5 j, O+ h( D* W' t! p' n9 U g
例如:) ]6 |8 t7 W4 N. E$ ^9 q
8 c" [( w7 W7 \, Z9 [7 G
美国说:
) a' ~) n: D+ O) E2 T3 R9 G: e u1 y/ q' f! I, J7 U/ [( R
> “我们已经测试过 Model X,安全。”$ ?9 W: u5 Q4 E
l2 I$ y9 Z" X" }4 V 国际验证机构不需要接管美国监管。
/ G) Y8 y* J* k4 b. n# a. b6 o4 ]+ Y4 X* u0 s+ k/ M! T& N
它只需要检查:- f3 c) L9 O# p# U- y
$ H$ f4 E8 J& C' g) j9 o
> 你测试了吗?
8 }6 C3 ~) d. `8 v" R>" J/ j! O: m; A( c% I8 s' `
> 测试方法符合标准吗?
6 P, b, n/ i, D* I7 O) I>+ ^) U* q4 |% I8 ]7 D- i, X
> 测试数据有没有造假?
* H: }- f8 m+ [" a( ^% J; E>
4 [& ]. \: J& u& i% |' K> 有没有遗漏规定的测试?
. g* h. n9 @) ? ?* \ w- w0 L> N5 ]4 E# H: d! E. U$ `, k# g
> 测试结果有没有达到规定阈值?
, j, B- Z A% p# h" B* c( E6 S8 Z; b% E( ^( q
中国同理。- x7 T6 f) _ D/ B/ j( A9 J
9 n& l0 x4 c2 N
于是就出现了一个非常漂亮的制度:
: [9 t( Z- V" s# _0 ^" p3 O/ Q
: }# T- x* ]( ^ **国家拥有监管权,国际机构拥有验证权。**1 E T& {) X9 ^" g8 s; p: A
% i$ w! ~7 p* `; E% H7 c
---4 M& X' `' ^2 P9 W7 Q) l
, E, @; u1 t" D5 a # 四、甚至不需要相信“第三方”% C# r. ?1 T& W
" ?6 P+ P4 s5 R) d" q 这里还有一个更深的设计。
* q1 e U& B1 D+ N u+ L0 a9 R4 g! j, u4 R0 W( @" g) G3 u
假设中美连第三方都不相信。4 k# V/ X( C) W) }& h8 K# M$ `5 O
& h1 a: ] b4 ^
怎么办?% _% {1 A. V" z$ r# Y+ t- t
% y+ a% l) ~, I2 d) v; u
**让验证过程尽可能机器化。**3 [" w" O0 Y; y" s# _/ G, r* _
6 ?! z7 f) m" f) I
例如建立标准化的 AI Safety Evaluation Protocol。4 Q/ z* U3 R. @$ `
+ M( q, K+ O" l4 h
一家中国公司提交模型以后,不需要把模型权重交给美国。
9 k1 B+ D: ]! y
$ k* J6 L* l3 A6 l" g 一家美国公司也不需要把权重交给中国。
4 \& ~7 J: Z, B. b) J4 v% b) J" ?0 ^( Q
双方只需要运行一组国际认可的测试:" S, }" J1 O: J* L7 c* {
( I+ c0 |4 B" z: h1 K: D```9 |9 L5 a) R u8 I
Cybersecurity
+ y( m8 f D4 y& _Biosecurity% R: R( v% r. v
Autonomous replication! }. C: q4 {3 \ C& i" @
Deception
& s. F5 x$ K* H7 hPersuasion
. P9 z l7 q! ^6 cModel autonomy+ J0 Q" D' ~: ^5 \0 @; q; G
Critical infrastructure attacks' E# n6 `/ N0 J$ o& y$ H. W
Human-control loss' x' Q1 M3 ?% l A m$ ~4 e/ U
```, N0 D$ G+ B( `6 f
+ p1 s8 b# L: [+ D+ d% M* s: U6 H 然后产生:6 w6 g. M$ x1 h3 `9 v d
9 n6 [) v1 h! `5 h! k```6 S6 p) f; ~0 i3 F, q; k! E
Test ID
. h9 j9 U+ l( N$ {9 J' ]Version
7 f2 q7 l0 P' G' xResult
; D3 `3 r- n" V* bTimestamp
& P7 H \/ x, g7 O9 x! xEvaluator
2 |1 Q1 X, I+ Z3 \Cryptographic signature0 u( a% {3 Q; k6 h- {
```
) a% @/ A/ Q6 T3 h6 z
- C1 M+ e# |' M2 M1 ~ 类似航空领域的适航证书、软件供应链签名、金融审计记录。7 Q1 G+ d8 e1 _/ R3 V5 q0 [$ e3 I
( I8 p0 V( l' x2 p9 y* {: g 这样国际机制监督的不是:- m9 R* i% ?6 B' D/ W+ [% p- V
: h% h/ M3 ^# X8 k: Q7 m7 Z K. A > “你的模型内部到底是什么?”# D2 n2 o" {* K0 I0 a- }
! Q- U* g0 i" v, B+ X5 q& s" G
而是:
7 Y2 L& R2 z0 }) G9 y1 l" b
, q& \2 g" G* x) ^5 f; M7 C- K4 ] > **“你是否完成了规定的测试,以及结果是否真实可验证?”**
9 S7 U& \5 x. e! ^+ T1 ]
; p- `2 g5 |3 K) C' b) ^1 M 这会比“外国监管机构进驻你的 AI 实验室”现实得多。
4 W9 u2 a; B' u7 \+ T4 w5 k+ X. O0 G% `' \- N; ]
---9 L( r: ~' ^$ b+ B+ s% Y; E
2 n `, _# K, g$ S # 五、进一步可以采用“相互承认”制度
* \7 |4 b7 S+ x* x
/ l3 m% M! k8 D4 e Z2 J2 |+ ^ 这可能是最现实的突破口。
$ r: ~) \4 v2 \# J! z8 _/ s+ z
1 q J$ r4 `' \* V 例如:
& m0 K/ I" K7 ~+ Z) d5 k
6 m9 C- j- n2 ~! S5 ] 美国说:" s5 X' E: E# S2 _; P
) l: N+ {6 x/ _+ h6 }+ G
> 我不接受中国监管机构直接监管美国 AI。
( x; l9 ?9 d$ k* ^& z- S, l7 e, D. V+ A& S
中国说:. K4 c6 q' p. @4 s* C- c
% Z$ n/ D- Y; Q: y/ h) d8 a1 r6 A
> 我也不接受美国监管机构直接监管中国 AI。1 B9 p& S4 c& [/ A, u, k/ [7 F
% U& g2 U4 y7 F 完全没关系。
6 t$ R- O' J6 M3 D' U1 M. l9 x4 P
那么双方签:
: H8 Q( N5 o# ~6 O
/ n8 j9 u' Z$ g( @* s+ K, ~ > **Mutual Recognition Agreement**
5 y9 }! S/ q$ g$ l7 d) I5 L
3 ?4 {4 V& Z4 P4 R+ @- B4 Z 也就是:, {5 v) R0 B3 J" V3 K
& g, v) o) r4 Z
**我承认你的监管体系满足某些共同最低标准。**
. k1 r ~4 I7 w( D8 j4 R+ W
5 B4 t6 v2 W2 m+ s( O& D 这在国际贸易、航空、药品、金融等领域其实并不陌生。
) o, @" V$ F+ u6 e9 H: b$ v+ M: P& {9 m3 m; u9 T
于是:. t* b% l( g+ a, g0 h! h1 }. ^" k
$ q+ i- C% G% j' \ |
|