|
|
赫然 发表于 2026-9-22 04:19
% b( |0 f+ ^ ]5 `3 \# \* V8 F/ r- x这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。, b# `9 w2 ~% O; X8 I' ^
, J1 _" H2 J2 A# M- W/ y- R这里关键不是要不要安全管制,而是谁来 ...
6 j/ h8 W' }7 u2 c# ~5 ~AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
! Z- c( S4 K: C7 W0 o# h+ o# n( I4 B* ]: C1 `* k$ M
你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。# }# S( D% G3 T/ [: x" D
: B' M$ R; C8 G2 b1 S 而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2, `6 G$ D/ ] Q' n3 M9 W
7 u& O0 K. o3 _( e# \ L8 n0 [ 但我会稍微修正你的结论:
- r' M; V$ h, _4 O/ R% \: g0 ]( j0 n$ H+ e& i1 M) R9 H- L
> **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**7 V; N5 v! M3 Z
* B+ e+ r: i) ] p& m
这两个问题的解决方式其实完全不同。& O4 x/ e$ t* P& u2 J% ^
- \ |4 W* ? j) H7 v
## 一、真正需要解决的不是“谁监管”,而是“谁验证”
3 a6 h! o/ |2 N- o4 Q! G8 `; z2 M& m2 w Y
假设:' p( {; [" X+ S) @- {+ F5 I
8 P q# |! T& r) b7 ] - 美国监管美国公司;
5 X7 T; h: S7 H3 O0 `- 中国监管中国公司; ^5 ^5 M# u4 h' Q$ p+ s
- 欧盟监管欧洲公司。" |8 c- V' `/ A
. T7 C+ A' \& J( C! k 这本身并没有问题。/ G! u: |# r* y9 ~5 p/ E; y. @+ e+ r
- C7 F& Z' S( a# d. F 核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。, |# v( D: j; J! ?$ L
, n% V, G& D e0 d 真正的问题是:
- H5 t) G' b4 h1 \7 t4 T9 n0 `# L, r( r; n: b4 a. j! P
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**
4 h* v0 B$ L7 U2 K7 @0 P9 x8 q>( W$ O/ Z( ^6 {' h: t3 r4 X
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**/ u' ?6 t3 j5 H. b. S
1 v) e- N& y i; R 如果答案都是“不知道”,国际体系就会陷入你说的困境。: S. r5 k3 n, P2 b, |
, q; f* @- A2 W0 S
因此,千万不要把目标设计成:3 h& u6 K J c
3 b3 X! ? h7 T9 C: M- z q
**“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**7 B. X/ L0 d! o$ W2 J; D
& o' a" ~7 x8 U8 I1 i3 M
这几乎注定失败。7 }3 Q5 \8 N' t4 C4 Y
! i" y* h# R' k8 `) V
应该设计成:
7 ?7 s3 V- F- p; i% c% U, q% u6 O& P/ F0 z
**“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**) \; R& g- L) ~. v3 j& q9 t( m
: a1 ?' c# T6 W/ G 这两个制度差别极大。 B5 L$ a! \: W9 j4 `
$ @' }5 e; s4 g+ Y) H
---0 G" i7 Z4 T8 k. t: \$ v" a. |. v
6 ?8 _# b3 P: }9 Z) V
# 二、我认为真正可行的模型,是“核查而不是监管”
; X9 F# @ i$ d! c' b7 W8 C$ }: j9 E: ^+ M9 L
这里可以借鉴一个很重要的国际关系经验:* c" P$ I" \+ [/ `" e, C4 l8 H
2 m; B6 x4 S1 F! d; n# |
**国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**
# g& q( T9 r8 M+ P- d
. n. k6 o( x' z 换句话说:
2 [. C/ N: e2 Y0 m9 K& A: o( V; P6 j3 z I" U7 i
> 不需要美国相信中国政府。4 T4 P' _0 x1 @: K; d. a
>% F' z. ]0 E" D4 V
> 不需要中国相信美国政府。
9 v$ E, D: D- T+ C) g4 f>
. D$ P4 g) l2 j! V$ V/ p+ M> 只需要美国相信一套验证程序,中国也相信同一套验证程序。# _2 f) T3 l8 Y. y5 h, l# r
8 j' o$ _" f$ z
这就是制度设计的核心。
" s# Y% U% Z8 ?+ }
5 ^1 w" u% s5 |5 Q y9 r 例如建立一个国际 AI Safety Verification System。, H& D0 {+ z& O* w- f+ A* S
+ g3 {: t! l( k: |& Z+ e D 它不拥有:1 P( h A6 ] [/ b' W/ c4 W& p
5 |! R4 v& B, N! ] - 逮捕权;+ ^4 s; g8 h; }2 w3 j
- 执法权;
" n4 l' o9 m# G- 关闭美国公司的权力;
% L0 H3 P: s! l" z* \* W- 关闭中国公司的权力;$ \! w# c% ]) R8 O
- 决定各国 AI 政策的权力。0 f6 j R7 w; O8 t9 H s
# A$ U8 {& m# W" d- G' h6 D& U 它只做一件事:$ o4 [/ a+ |5 L/ W/ W* H$ }
, e. {7 E4 K# g* u8 r; p% c > **验证一个 AI 系统是否满足共同定义的安全条件。**
# w' ~: e1 U" e8 o( I" C, u: x; |2 m1 d F* p
这反而可能是中美都能够接受的。
' @! x/ _8 R; j8 s5 P L
: P7 a7 @4 f) E3 J7 J8 a6 `---
8 R1 Y5 r* {. ]- B
3 P, j3 E( A" d" F # 三、关键是把“监管”拆成三层
: y0 i, D! I6 h. | G& J# h* ^, t" C7 ^0 A: @# @
我觉得这是整个问题最重要的地方。4 A, @6 H0 B9 g+ e* U; ~0 N: g
# ]. Q3 H8 g- J+ [: v ### 第一层:国家监管: d( d% x0 P9 Z& V5 L& V
0 \& q, k# r& ]* n. `9 N8 T
完全保留。6 R) I0 |" K F! u/ d
) j* Z" ~1 J! Z) K; z9 I$ `" r: Y, b 美国:
( g* c4 e+ n$ U1 ^/ U. d0 z* q$ \3 d) T! H! J! ^
> 美国政府 → 美国 AI 公司0 k. d1 ^3 Y$ N! f
" s$ o. c+ G: C& J( Y
中国:! p6 B! c3 L0 a& _
! ?2 i0 K; ?* M/ R2 K: Y, K
> 中国政府 → 中国 AI 公司1 F% b% X5 R0 N$ O+ r' J4 X- h, v9 S
0 y; x- O! t* B5 o ~' A 欧盟:. f9 Q! O- L3 I, ]9 @ t4 D4 ?
$ V6 h; E. |" z' ^
> 欧盟 → 欧洲 AI 公司
2 `7 S( ^6 X' {2 b0 k7 b: W- q+ \0 ~+ K" [0 O
谁都不需要允许外国政府进入自己的监管体系。3 {2 y. m6 r- U7 x+ V7 V W' ?
9 o* S: E- p* X# g) q ?8 c
---* ]$ U$ }# ~5 @2 M) i! N
. i, J v8 W2 N1 m [ ### 第二层:国际标准
% T8 W3 b7 `* B% I( Z, H% L' C; q7 c9 d5 Y _0 F7 V I
大家共同定义一些非常狭窄的东西,例如:9 y9 z$ B6 w# ]4 M
* h' o0 p B0 Z1 {0 z- q$ o - 什么叫 frontier model;4 {1 n: m+ s! R% J' X6 L8 `* Z! l: W/ s
- 什么能力达到危险阈值;. Z- w+ y u4 d- }" |
- 哪些能力必须进行独立测试;% R. W' Q4 w0 O, Z7 n m
- 哪些事故必须报告;" H) o; q6 W' `* D
- 什么叫“重大 AI 安全事件”;5 l( B4 D/ ^0 G0 ~, [" H& z& a
- 哪些模型必须进行 deployment review;4 o: R" z9 q: I" h h* ]
- 哪些模型必须保留审计记录;) N T2 g* N6 |3 D8 K5 \! i
- 什么测试结果达到什么风险等级。
5 T" q2 q, s) ?2 w g3 u) F/ ?3 {/ k* ]2 K: }7 _; [
注意:4 l! h- H. W9 F6 H) T
" n; M/ h( J5 a9 }& N **这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
, j* ~. M: `- K% S. ^' h/ S' s0 b c, t! y/ Q7 N3 k9 k& t
这会大幅降低主权冲突。
C6 k: s ^, r% x+ p0 i9 z
' U; J! K$ W5 s3 ^7 S! X; u. A---* J- a: f8 \2 G+ U- Y! O, c4 N( ~
; V q7 a) L! U, h9 h% Y; k ### 第三层:国际验证6 ^- ?1 s# K+ q% C
8 q( M* R V) T# r
这是最关键的一层。1 @$ G8 v1 G9 X w
+ m% u" D H# |5 Y; D) k8 y d) y1 M' y0 p 不是让中国监管美国。" j5 f- s7 v6 s# H
. r" x+ n2 l3 e$ }, k4 Y/ P 也不是让美国监管中国。6 w- c2 I+ i% m. Y4 v: c
2 x# E3 m) f3 o- d9 M g 而是:) E8 O# ?0 D9 b1 `
2 H3 m0 ^8 \ {" U. P( p# w7 Q
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**
* ~4 S* |; o' P7 j. T7 W
. O0 d6 |; C. x6 A 例如:
0 o( i/ ?1 E5 ^4 o6 }2 o( y& M6 p0 p9 ?2 `1 G
美国说:2 S+ f3 n. u i, Z2 Z. y
8 n `/ | H. ~ E; T) b& _
> “我们已经测试过 Model X,安全。”* }! m0 f7 P! w" b9 N$ J k, v
7 A0 l, Z/ \+ @0 k
国际验证机构不需要接管美国监管。, B$ { m1 j0 V, ^$ r" K3 z
S M: H1 `6 V2 z% I 它只需要检查:
+ j8 r1 C5 S9 G! \& j8 g6 D, N3 W
> 你测试了吗?
; M7 q: q! A. ]. [# w; E>0 e7 U" {7 Z! c5 X
> 测试方法符合标准吗?
4 s; x" s( n3 @9 {3 w- D/ O0 }6 U>1 o& z7 o- ]4 Q; R, N0 F; n. J
> 测试数据有没有造假?) ^: s1 U: ^8 g" V
>
& j& @. f" R. F. p# n( i6 B/ H u1 T> 有没有遗漏规定的测试?' W* @( t0 D( y
>. V, @( o: N, X& r1 f$ F- G
> 测试结果有没有达到规定阈值?1 }8 _3 c8 L2 d# y) X/ b7 }
# V9 n8 p9 W8 E/ |0 q9 k3 J5 u' Y
中国同理。
0 O( T4 ]* P K( m" R( S1 e6 s t: H6 ~% c% e- q' |
于是就出现了一个非常漂亮的制度:
: l6 [% f# E( B. g
0 s8 A& c0 T' D* o/ `$ G **国家拥有监管权,国际机构拥有验证权。**% Q ~- z( [: s1 R; G) n
8 t) |( S V3 r9 h0 j---0 I: N; k) Q. t8 E# {+ _
' q- B, s" k. ~ # 四、甚至不需要相信“第三方”$ T* F3 q* u" E3 L5 j/ L# Z! A
) f' _! \# S* A7 M, h3 Q 这里还有一个更深的设计。+ r. J$ k. T/ H& T
- ?* h' b$ ^, a* G0 m
假设中美连第三方都不相信。6 a+ n% b/ F( F4 q3 c4 Q& A
! N4 M' g- T p: w
怎么办? n+ i6 [; M. A, ~% m7 B' }9 I1 d9 j( D
# ?3 Z0 X5 B9 Y7 z# D. z$ | **让验证过程尽可能机器化。**
* V0 r( ~ n: w( l; N
/ H, e2 }0 E4 k+ Q/ w2 X 例如建立标准化的 AI Safety Evaluation Protocol。
5 `1 h; _( q. \
8 t0 z( T F( T1 N' J) S1 j 一家中国公司提交模型以后,不需要把模型权重交给美国。
: T! ~. b2 W2 B% ]4 S9 l4 U e$ n/ T7 Y6 A( c9 O, L! W8 l
一家美国公司也不需要把权重交给中国。6 `) O" g* y5 `3 U# n# f
; U" Z; H; u( O2 E: e
双方只需要运行一组国际认可的测试:
- l& I( I" N; c. l9 \
! _6 F5 f0 l/ v( H```0 k1 E/ q7 | H" |
Cybersecurity
9 E; s3 M7 q1 H @7 w5 }Biosecurity
0 ~: I- U0 y- V6 lAutonomous replication
3 B$ B% H# P' c$ BDeception: w1 O! ?3 K* g, R
Persuasion
! K$ N6 ?! Z7 a0 @# tModel autonomy
8 p7 h" Y1 C2 y6 M! X4 RCritical infrastructure attacks8 k* O5 b# g$ y* y9 }- \9 E
Human-control loss/ l" _! C) V2 H/ I' C) N5 M
```$ j8 o' g* d2 v' b
2 v2 E8 S. E+ {1 } 然后产生:
( f; ^" L3 c' @0 }3 w/ f
8 E7 C0 r4 F. R3 f```' B) e6 D, w4 f8 `7 n
Test ID
& s' ^% v) R: L* c, `Version
+ p+ t# ^" z5 I- _Result$ v) |2 J* K0 x S
Timestamp
: X' Q+ z8 ?; r# d0 |/ R' aEvaluator) b) Q% ?3 @9 N0 d1 A4 d( d
Cryptographic signature/ m9 o& v B* d5 d
``` U3 V( V6 [ A1 {5 a! D4 }8 f
; T( `* W5 H: A8 S+ y! s
类似航空领域的适航证书、软件供应链签名、金融审计记录。4 h8 U) p" `4 p5 ~) b2 a
0 t& Y2 P4 N" q6 ]% @! z* Y 这样国际机制监督的不是:
5 B5 Y3 P% g; l
- W9 l- s/ E: U" i: \. _) z > “你的模型内部到底是什么?”
& }4 d+ I" w t, i" L) u* N- G" A7 ^; Y$ h$ k
而是:; G! c1 I; _0 T% \2 I- q
5 }8 O" T) g6 g+ s8 w
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**+ f6 z4 X) @* v5 C# [3 {6 b, T
; v3 p3 W% k3 i( s* X
这会比“外国监管机构进驻你的 AI 实验室”现实得多。
. p C6 F2 |; H
+ v2 n# m+ z+ e5 L" A) s2 _! l$ T---
4 j# S8 c& q5 u8 S; x" _: u6 X3 c8 z, m$ `+ n! M, P
# 五、进一步可以采用“相互承认”制度
3 E1 V/ _! t" J& O3 e* N: F8 u7 P& c3 y" z' S* M. i2 t2 |# Q! s
这可能是最现实的突破口。9 t( U( f, v% c4 I. R- `3 ]
; K3 I* t2 K; p
例如:+ E, \ i; o$ y$ M" w, g
& _- Y+ [% f3 X% x& @
美国说:
; ?, c. s1 W2 m
* m* `( y5 l5 t# u" o/ ]: k > 我不接受中国监管机构直接监管美国 AI。
+ Y! d9 l2 t; F; s7 a4 i8 m; I% Q6 H* r& o5 v1 A
中国说:
- g* ^4 S2 n( G+ q7 V. y2 |6 Z) {" `
3 }9 m* ~/ A; w1 ~- V# f > 我也不接受美国监管机构直接监管中国 AI。
* L+ S. A9 C# j3 Q/ C% ~5 O& [+ r) w" O$ w: y
完全没关系。) s* f! P9 e/ A& H3 S" }; K0 ^1 i
7 Q! K0 }; ~2 y
那么双方签:. L+ e9 {# k# y9 R9 ?, I9 o$ r; g
' |1 }. u. m7 }" T( b# B > **Mutual Recognition Agreement**
- b+ p! R" v9 q
5 o* n ]% J, l 也就是:6 i! K' j9 ]( E0 F2 {
& m! F0 V$ G: M2 r$ E& `; W
**我承认你的监管体系满足某些共同最低标准。**
* a; e: X7 R2 y- ~; q& A5 z) H0 T7 h% \ ~! i% P
这在国际贸易、航空、药品、金融等领域其实并不陌生。3 k, A0 b" ]% G9 W [. h
( r/ M/ d% V& ^+ j, u# a2 c' O1 I
于是:
~7 }: _# r0 X K+ {
' M. I3 D+ M6 w% s% m) s |
|