|
|
赫然 发表于 2026-9-22 04:19
$ T" P+ C* Z! c2 {# c& l, C这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。. [$ b2 u8 u) v, a5 ~* j2 l- V8 g
* U* e: n$ q2 @6 M) v* y5 a
这里关键不是要不要安全管制,而是谁来 ...
8 w8 Y5 `7 p6 g2 T6 f: pAI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
3 @4 a5 R. ~; h% n3 Q
$ u+ q) D! u6 Z: E( h你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
' L$ q( U! D# k% D3 [
: H- r. E) C. p! c 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2/ @: }- l- H# Z; Z& ^' j. s- A
3 u9 V$ y2 _1 [* ?
但我会稍微修正你的结论:
% P7 y% f5 @. b$ O
) K% m5 n' P" [1 b: E( k3 k > **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
$ q- e% k [: _# @. e) u; B+ x) p' p9 k- u
这两个问题的解决方式其实完全不同。
" _6 n/ s4 o8 o
, }+ w: l9 c4 w; @! o ## 一、真正需要解决的不是“谁监管”,而是“谁验证”
2 ~ n$ C. C) @ [* {- b9 A B7 N4 ^0 Y% G
假设:; L4 p8 L3 m7 P( E Y( W# V4 F
, G! B, K1 e, q/ J+ i6 o
- 美国监管美国公司;
! f' d) Q7 b( Z) _; e* ?- 中国监管中国公司;
: z, n7 w" M3 s1 K. T1 Y- 欧盟监管欧洲公司。1 e8 |& N$ L" `5 l h/ C
8 h9 G: K* R& @. h
这本身并没有问题。6 _( y3 o! M0 Y
4 p& d# A, ?& e( L) B# ^ 核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。
$ T$ j0 a8 N- |/ ^' c" O; W# o+ R' Y" j4 a3 w3 f( c
真正的问题是:
) g0 i4 W( B, C) F
/ B, R2 q7 X, M7 D7 G > **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**- c0 i" [, |: h, L
>3 V* {" @. a* |( V
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**" C8 b! ^: D4 B( {
' a# A# A4 Z0 v0 H% [ 如果答案都是“不知道”,国际体系就会陷入你说的困境。6 R6 D$ v7 l3 V
6 N' L6 D/ K0 ^0 X; a9 c$ o, c
因此,千万不要把目标设计成:. Q3 Z* B8 B5 e }
9 A' j% T2 q" \3 u **“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
" ]! |! A2 r& A" D$ w/ r; e- R9 u
这几乎注定失败。2 C" |5 E9 J, G/ l
: Y' s1 M5 [2 ~* W5 O" o 应该设计成:# G# T# I5 c. t, S7 `$ P
' D: j4 O+ ~" G l) }1 w **“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**
# E2 z/ _& F4 L6 u, J' W
& f( F& @5 b0 W 这两个制度差别极大。4 q2 q$ d7 U; ^3 l* H T
, e; z+ l! y& Q% w/ n: N+ a---. e, i" v9 C& B: E' [0 {: Q
; Q$ z* n# J+ ^8 W # 二、我认为真正可行的模型,是“核查而不是监管”9 P0 n9 w0 q" O) c0 @) v- O
: T2 K O; ~2 j* K3 o% u
这里可以借鉴一个很重要的国际关系经验:6 B" y' l7 X+ ^+ r- Y( `. W
( w4 z( w/ S% H) E8 {7 w. Q **国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**+ G9 E3 W7 ^6 J" e* {6 M3 L' U
5 W$ q3 p- t- q 换句话说:
1 i) s1 T6 c# s" H; j c+ l4 m! t H) n2 ~7 h
> 不需要美国相信中国政府。
. b* b' B. L: N; d' N- J# j* X>
3 j& c" `2 p z8 f# v> 不需要中国相信美国政府。
/ \2 B% [; \# B* q" _1 ?3 v>
6 ~5 ]2 I2 n* S- e6 D, Q> 只需要美国相信一套验证程序,中国也相信同一套验证程序。! M1 ~ R1 x: @+ t0 U& _
1 f: A, ? l0 k( O' z* B5 k 这就是制度设计的核心。 u$ N4 W5 ^2 r4 N, p: B+ s
6 ^1 R$ c. u1 ]: Q0 Z 例如建立一个国际 AI Safety Verification System。
3 m4 _& @7 }2 W/ p( `' v2 T. @# Z7 r- z9 B& Q
它不拥有:1 c/ a8 U; R- y/ e# _; ?4 N
; R. P# }; x7 U- N; L - 逮捕权;
& X6 m$ e4 x z T: w- 执法权;# h4 B8 [6 Q- m1 x8 I0 e
- 关闭美国公司的权力;2 r5 y& u T6 u: [1 i* Q
- 关闭中国公司的权力;
& j. g/ T6 B$ u6 u3 l9 c9 n- 决定各国 AI 政策的权力。- G) {0 Y6 ?% F W
* z2 Z) b' L1 ^: N$ X8 p% p" {
它只做一件事:
* a; s; D/ q/ k5 Y0 L/ A6 |1 k3 ^: b7 A
> **验证一个 AI 系统是否满足共同定义的安全条件。** `# [, l5 t8 ]& S4 U
- Z6 K2 L: \% S3 j" g5 L: T 这反而可能是中美都能够接受的。
3 b% a! t! h6 K; M" X4 o
* w; ]7 |; @* C5 N---
0 l: y2 D, A* v7 r/ s# I6 U) \; O }: S3 r
# 三、关键是把“监管”拆成三层. `. u+ {7 U4 ^7 n& j9 i7 d
2 k8 E; z0 W' V, K 我觉得这是整个问题最重要的地方。
4 J- v, p. s6 _1 ]" y
0 @. z, c1 X. c1 U ### 第一层:国家监管9 H. N" w' s2 y, i1 A d
: O% j% V9 `2 l4 i! |/ K. D
完全保留。
0 q( F+ a6 \/ H' ], i- j4 J' t; ~8 }/ m
+ }' f+ ?5 ]1 v* N 美国:+ ~! {' m5 q+ [! `$ }( [
+ `9 Z8 c8 L# t" T > 美国政府 → 美国 AI 公司
4 B" B- O/ w( U! k2 ~$ {1 Z
) G* t- Y' W9 V7 l4 h$ m9 \ 中国:
4 D- T( I4 I& n3 n* a2 c
" ]' Z: q' m; d% p' x% t > 中国政府 → 中国 AI 公司
& Z0 e5 [9 c7 b5 G2 Q3 N
3 A( }9 d5 d: {* |" U5 ` e x, m 欧盟:
' k# h3 i; K/ j' h! i; g1 P# S/ q5 p4 W$ _& f$ V; m! Q, j1 M
> 欧盟 → 欧洲 AI 公司
5 I. l: D$ V9 P7 H. H8 }# `' F. ?+ s' ]) Z0 f7 ?
谁都不需要允许外国政府进入自己的监管体系。
' Y4 Z$ Z) l$ h! r* x
; @5 _1 ]8 w7 n; x1 b---
/ D' O4 J! u6 G3 b
r* G* t' u& H5 R) p5 u ### 第二层:国际标准+ p4 W% }3 C& y
7 W' U6 ~( m( r, E9 h1 N6 L8 I 大家共同定义一些非常狭窄的东西,例如:
) {+ c( }3 [3 e) m0 u* A/ R
! j% o+ U( Q8 h& a A& w - 什么叫 frontier model;
3 F) I3 r, V. Y1 ^" ^5 ~- 什么能力达到危险阈值;
5 O% t2 o1 g3 [( a: y- 哪些能力必须进行独立测试;
F* @7 l! k: V; T3 l: |( d/ b8 P- 哪些事故必须报告;/ D# ~% V$ l5 L- G. Y, b
- 什么叫“重大 AI 安全事件”;
8 y S( U# ]7 M2 B) [- 哪些模型必须进行 deployment review;
1 Y6 W$ y# I W! G. d- 哪些模型必须保留审计记录;; ?( y; R1 y& P
- 什么测试结果达到什么风险等级。: {- y0 s, _6 c0 z7 B9 b6 N7 h
! O- n8 s* A' ]! T4 y0 n% a) x 注意:+ C* _; {* y0 w' U' z5 s+ Z
2 o8 C/ I; ^+ c& A **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
+ A' u# ~* u% m4 Z+ O* Z' {5 L% O: h
这会大幅降低主权冲突。
; C3 ?$ W v8 R' }
1 Y5 j9 w* X5 j) g/ N) y# V3 Q---7 y' r9 ]% Z" t' V! n( b& _
/ P( L( F; s! Y$ Z! [, m6 B ### 第三层:国际验证
# K5 X9 r( z( k9 Y Q6 F6 V! g/ R2 f; T; ~1 W- ~6 w2 z# Z- V2 j o
这是最关键的一层。
0 z5 C* r' ]' m6 A6 f# s5 S# ]
# K4 W; _; Y/ Y3 t7 f" l9 \; } 不是让中国监管美国。
, |' \9 [; \5 S/ k' v) i+ Q% Z
( O2 m& T0 j9 t3 z3 y. j 也不是让美国监管中国。
, V& b5 O# j) f' f2 @2 p H4 n$ Z
9 O3 _, n# b, b2 v' q 而是:
+ a% ^" o3 `9 p9 @$ b. H% i
. M" J6 W" m5 [4 @( ?+ K! c/ X > **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**. Q- J, H% o0 N
$ A4 Z p' S/ k4 b9 z; _
例如:, M- W% f1 [/ W: r+ B+ V- S0 L
% s$ r" n t) b( C, z" p* B 美国说:8 X! K. E" g x# X( ^2 j
' \2 a) O3 D1 H( A7 { > “我们已经测试过 Model X,安全。”
, x: U* u5 Y# Z
5 ~3 C! v! C$ q% |( o 国际验证机构不需要接管美国监管。
- x$ C0 A6 w9 f$ c4 w# R! O
4 v9 U' S/ r2 A/ Z6 [' \* L* u 它只需要检查:
k8 C, w2 [+ b+ T7 V( x5 Z1 ~# ^7 M$ t; q* L* h) @# U0 _, E
> 你测试了吗?
, {' h$ u9 ^1 I7 o9 Y>
4 k- T: w/ ]. J> 测试方法符合标准吗?/ T% f/ a* w, [' c4 t' e
>1 o, ^/ H' E8 F2 @+ |6 \
> 测试数据有没有造假?6 g: V' n/ k4 p, d! W
>
' I7 C( M* q" `8 v> 有没有遗漏规定的测试?0 b2 W$ K* c! F6 z
>) r; l* }3 \2 L# }. [* }' r
> 测试结果有没有达到规定阈值?5 f4 G" \0 m8 P7 D
2 J4 T, B( {5 g/ i% q) M" C
中国同理。
1 q3 Q* S, M9 t$ i, S: |0 T0 {
+ a4 K I* M. z+ P 于是就出现了一个非常漂亮的制度:% q5 X, @# R6 a4 L
% H+ w- A3 F: [ **国家拥有监管权,国际机构拥有验证权。**7 j8 W! H1 x0 _% V( k$ J
! y" L( X# l3 U. Q
---$ S0 S: m3 n" n" ]; x, M
* h4 E* p* ^7 O' I5 P1 T: { # 四、甚至不需要相信“第三方”
: l% E0 u; r) }' G- c3 r8 d5 ?
2 a8 L, d% ?: [( Q" f8 V 这里还有一个更深的设计。
5 s* _5 y! ^' l; Q: P) J; a4 |* H# Y, g
假设中美连第三方都不相信。) Z6 `8 z% D! c/ L# f+ `' m. l
* ]" W" E0 m. R* f 怎么办?
# q% f; d2 G' ]: p0 h- Y+ E4 U* T9 p* C# C K$ V* f7 z/ z4 F) p
**让验证过程尽可能机器化。**& X$ j2 T7 E+ ~ Y; U: K( ^
3 `9 k% Q( J$ F/ O) z- p) j, U5 P 例如建立标准化的 AI Safety Evaluation Protocol。# c0 g/ b3 @ d* L4 L
: m; s* G3 j- J! s% X( b 一家中国公司提交模型以后,不需要把模型权重交给美国。
/ k8 H9 l& Z& t7 p( } t4 Y! D/ S
% i. H; W A; \) _6 r- z 一家美国公司也不需要把权重交给中国。/ r1 c$ K; j" t
& ?" C2 l- J5 Z+ e7 ]4 G. p1 _ 双方只需要运行一组国际认可的测试:& y& V4 {: j- k2 n+ y, S* a
1 J# w' R0 e, t, x( [" W& \4 [( t```
5 s' A5 a: {; u |1 ]! }Cybersecurity
4 `& f7 b, g' H9 i3 C! O2 H4 }' nBiosecurity
2 ^- s% J& Q& B/ _9 W* u* A. HAutonomous replication6 ]( p9 K+ x$ w# ?9 r
Deception1 U5 a4 _$ Y8 z4 G7 O4 V
Persuasion
. C# e. q; j( Z7 G4 NModel autonomy
, J5 a: f* w1 j6 ^" ]/ \1 sCritical infrastructure attacks3 ?3 Y5 F* u4 L M! \3 G/ \
Human-control loss# W% @: C8 T( m) R
```
1 l. q, `# _3 C) `+ J& K/ _* p
: H. o/ s# ~( ^# o 然后产生:( A1 b+ r- a+ @6 B
& }9 R O$ [8 H2 X/ g+ V7 d
```
9 L. ~& b E& b' E* MTest ID" |+ V* ?( e+ h! H: n1 R. r# x
Version
6 ?& y Y# v2 B% D0 p$ ]" mResult
/ H7 f1 Z% A7 {4 h- iTimestamp% c* ?9 j9 n. Z3 O& D3 r7 G, ~
Evaluator/ ?; o9 f4 A& h3 y6 ? C' k
Cryptographic signature7 z" _% M5 h6 h
```) P- a b Z6 t8 D' a
: |/ d4 o% p3 U( i 类似航空领域的适航证书、软件供应链签名、金融审计记录。, a6 Q8 ^- ~ C7 _( Z7 Z/ \8 Q
* W) ^1 t5 {+ ]) d' t; Z
这样国际机制监督的不是:
* r7 a# f7 r6 W6 s: K2 W+ ]' T/ u; {* m
> “你的模型内部到底是什么?”7 T8 }' T T4 d9 M7 ]3 h5 J
8 n6 n! D3 v+ U, V5 R 而是:
1 p; y) F: ~$ L }- s+ ]2 ]+ s. J. |, R
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**5 B0 Y! g) @7 U2 Z
: h ?: q, X1 d" D 这会比“外国监管机构进驻你的 AI 实验室”现实得多。
1 w8 Y" ?8 n7 Q. D/ E' b
; G7 G5 v1 x6 o! C/ q1 \0 \/ g0 W---
: q0 s2 c( J- w8 |7 i. o# b; V: j$ A8 c: j7 r/ _/ i/ z7 S
# 五、进一步可以采用“相互承认”制度
5 Q( R, H" p+ z' _- }& Q8 {
# x/ W! v0 J) J# Z3 c 这可能是最现实的突破口。1 o$ l% w5 J/ y/ _! {2 I; A
* f! P- N( v3 m) s% H! U
例如:
7 ?1 k% x+ K; m! T0 x( k: N j# p3 z7 v, J
美国说:
4 p" G- E- k9 Z( | D7 r; t# S+ u% X+ J6 ]% ^7 l: ` s
> 我不接受中国监管机构直接监管美国 AI。
8 I6 Y4 \9 @ k* {& i# a! Z
; q) X9 p% C o1 @$ V 中国说:1 }6 B2 t7 V+ K
% C* @$ z6 T F; I4 A: r$ R- q! v' v; t
> 我也不接受美国监管机构直接监管中国 AI。0 E) X2 m, e }+ c) u
9 \( D) z# e5 X- U4 A) { 完全没关系。) V" g) F& B, D3 e# {2 x
% t1 s% G; T5 v7 [3 j 那么双方签:
& y, c( _8 o" p4 H. w" C" M
; D$ V2 e/ t* y& r9 \1 h. F' g8 I > **Mutual Recognition Agreement**
, n8 Q. o# T' w8 j4 h3 H# s
! H$ E H3 O1 i0 C, w 也就是:. w% |, z/ Y9 q- r% x% [1 v3 k
- F2 h; s1 D" b j1 G9 y$ ? **我承认你的监管体系满足某些共同最低标准。**6 V4 l5 ~- ]1 d2 o- I& w
) k, V$ r% K) [
这在国际贸易、航空、药品、金融等领域其实并不陌生。4 p( a4 i1 r& t y& G& x. ~
7 s/ A( E% p8 k [
于是:
) g9 A. e3 z$ e& y
/ J" @2 Z( E" `" ^4 n! j) @8 u |
|