|
|
赫然 发表于 2026-9-22 04:19; a2 ?# ~) K- x$ d/ K
这个不管思路脱钩与否,关于AI安全的会谈必然是不欢而散无疾而终。4 o) S* P; J2 l7 s$ d5 D& b
7 @* Y1 ~$ X9 n# n
这里关键不是要不要安全管制,而是谁来 ... 6 W. H& D+ P) G( ]! T
AI 的问题当然应当让 AI 来解决。所以俺问了狗屁通。下面是狗屁通提出的方案。基本模仿核武器与核设施的国际监管方案。看下来至少在纸面上是有可行性的。
- g. m* N5 m, L& A, [6 l2 C+ E# \$ }- p( ^
你的推理抓住了一个非常关键的制度设计问题:**AI 安全的难点可能不是“有没有规则”,而是“谁有权验证规则被遵守”**。
@, A6 D+ q, | i: i5 G* u6 U( ]5 j/ {8 d$ v9 E( z0 K) {
而且这个问题正在从理论变成现实。就在今天披露的美中磋商中,美国提出了建立 AI 安全事件“通知机制”的设想,讨论的重点包括国家安全、透明度和重大 AI 事件通报;与此同时,中美安全专家近期甚至提出了类似核安全领域的“护栏”思路。 Reuters+2+ i1 p. q& f/ X# b# S. N
- h# j" z1 A1 B& @( x& @$ y) ?' H 但我会稍微修正你的结论:
4 X) Y: A% q% u8 n
1 ?/ n5 }; P% E1 H1 {# z > **问题并不是“各自监管 = 没有监管”,而是“各自监管 + 互不信任”会形成一个严重的监管套利和军备竞赛问题。**
6 |( ^. ?% {( }; K! { M- C3 N3 @& N$ z! }! r# r3 u2 A5 r2 n. u
这两个问题的解决方式其实完全不同。! n/ a6 C5 }7 i4 e& \
$ s3 ~ ~ a( _0 Q3 H$ M- S
## 一、真正需要解决的不是“谁监管”,而是“谁验证”
# h% G; j* Y' I5 g" d- V& H4 J" w6 d& n( l. Z6 h+ o$ @8 v
假设:' ?1 ~, I0 G( p& K1 Y7 t
5 r, R; D9 C, Q* N) G0 t - 美国监管美国公司;% |5 T* s: B3 J2 O6 V( g' i) Z
- 中国监管中国公司;4 I3 F0 n, b# B
- 欧盟监管欧洲公司。* x6 V& V! c+ y
9 F# L5 w* |1 K9 ~9 _+ t
这本身并没有问题。; Y6 M& I2 o; a; D) I* S
7 k6 }; D C1 a% h- V7 c 核工业、航空、金融、药品等领域,本来就大量采用**主权国家监管**,而不是让外国监管机构直接进入本国机构。( c' {) f5 o$ G7 t8 v' C( e
0 x, @8 }3 o; P
真正的问题是:
6 t: q. E% }+ y2 J9 n" f1 q0 U" g% \* N) c g0 X
> **美国有没有办法知道中国监管机构说“中国这个模型安全”是真的?**: g" D. H) ^: e( q" V6 Q6 h
>" C5 ~+ g+ m# I0 c
> **中国有没有办法知道美国监管机构说“美国这个模型安全”是真的?**" Z4 r6 D0 u& R C3 B# a6 N$ ]
7 e+ I% _1 P9 G5 {4 b 如果答案都是“不知道”,国际体系就会陷入你说的困境。
1 ?2 Z* b7 i6 b6 x! s5 B) `+ Z+ c4 X5 d7 f5 s) w! C; N
因此,千万不要把目标设计成:$ Y1 b- i& Y/ }3 U5 P% H' v
: N+ _/ ?4 Q8 x8 p$ b* E" b
**“建立一个世界 AI 政府,由一个国际机构监管所有 AI。”**
- j) d+ ]. d. _3 M+ b1 G' j
" I/ ^5 F, e0 f$ j 这几乎注定失败。+ S- p+ Z( g, r
* D4 u+ }/ v2 n) C 应该设计成:" G. r, z) S5 g( i
" K/ k+ X8 A* [0 v3 R **“各国继续拥有监管主权,但必须接受一套跨国可验证的安全标准。”**, H# j5 h7 I9 N: X- g5 p
$ E) u( q; r; J) ? 这两个制度差别极大。
- t% o; l% w" X, O: \- I0 t/ R. M9 v% ?5 {7 g: T
---
9 d& k. d4 Z. ?7 F5 \
: W; G k4 }4 H# r& R # 二、我认为真正可行的模型,是“核查而不是监管”. L3 t$ W8 w$ m
) c, w9 }( T1 Y" r
这里可以借鉴一个很重要的国际关系经验:- l+ F, }$ i- G" I" H' \* }
$ T8 ~$ H$ J' m& q6 e6 \ A
**国际社会往往无法建立一个大家都服从的世界政府,但可以建立一个大家都害怕退出的核查体系。**
7 `6 }( D6 L1 I" N1 L7 [5 R4 J. M" l7 X5 d
换句话说:
# Y9 @, m3 R1 ], I- D4 T/ O5 h: G7 X7 } J2 n
> 不需要美国相信中国政府。
. O w: l9 c# y& [>
?* j6 l" { Z B/ S0 }' X" q> 不需要中国相信美国政府。
* ?7 L5 j1 N0 P8 x- {; H! X! Z>
4 E- K7 v0 J9 }0 C: K- x> 只需要美国相信一套验证程序,中国也相信同一套验证程序。
; t9 }1 x7 s' F7 F$ W# c \# ~2 D$ S/ l4 z# V) q& Y: P; Z5 c
这就是制度设计的核心。6 X0 m0 ]; g. g0 L
% Z- A9 L; D+ f2 j* M: N4 B6 @ 例如建立一个国际 AI Safety Verification System。
# B. I3 ]! K* t/ k! o
5 `5 n8 m. N% c+ P9 d& y+ I 它不拥有:& S" G! B/ k' ?8 m
$ n$ o+ ]2 G0 { P7 [% L% D - 逮捕权;
+ d8 |5 o5 [" z8 K- 执法权;. o% k& T" W }: _) r1 P
- 关闭美国公司的权力;3 r& v8 b* V4 R' \6 h% y+ ^, M
- 关闭中国公司的权力;
* f) @1 }# }* O* h6 l: D# u( ]- 决定各国 AI 政策的权力。
( b7 W9 u# h% J$ X0 I- n& R6 ~
% l. a# {$ Z- { 它只做一件事:( B9 U/ a$ z2 Z2 c) Y
* g: o0 a% P s u
> **验证一个 AI 系统是否满足共同定义的安全条件。**; I2 \2 `; R: l1 Y) u1 |
; o1 J4 D2 C! v5 K 这反而可能是中美都能够接受的。
2 L; n& ]7 Z. }5 c) R: m9 p
2 x$ i m& i! o `3 f---: h( }$ `; X1 c% |2 H& R# {, K
& g5 l- s& g* |3 v6 Y* G1 G2 U # 三、关键是把“监管”拆成三层, S2 q4 T H% s
3 Y1 S' a$ U h" D7 l6 m
我觉得这是整个问题最重要的地方。
2 b ]0 F. }& t6 F* C. L2 d9 T0 {3 @8 R6 g0 s R6 ?* a
### 第一层:国家监管: V$ d% w3 q! o# ?3 ?2 {3 [
- ~4 G& Z3 _: w# T: J
完全保留。" H, P* w! i, N
; g7 [4 _# ?+ c) h( S8 ~! f 美国:
3 t/ a( ]) z% a* ]! }/ F" F$ {4 S2 \- U1 q- O
> 美国政府 → 美国 AI 公司
( v, t, a, Q; o4 Q1 y' L5 N0 w. J* Z& m; y6 ]; q( a
中国:
( T0 ` [) y8 o1 Z8 A" G, p8 f3 @& D4 W, z! u" {- }# `
> 中国政府 → 中国 AI 公司
$ a$ V9 a8 q! _+ k* t6 T' J6 Q9 m7 F
欧盟:
M. b! X o) E1 c8 \& `; k# \* p- G! B0 q0 ]1 Q9 H" w
> 欧盟 → 欧洲 AI 公司
! _ P1 M6 [6 f- s. W* y3 w( [9 T. {- W. c
谁都不需要允许外国政府进入自己的监管体系。9 k9 G' y# r2 k
3 d) U0 q' a% D9 ~4 Z: N---
' w4 ~5 O2 z" a& ~1 z$ c. c" V& X: V' K: B! t% J
### 第二层:国际标准
$ [& @3 `4 x9 h+ d. ~6 y
8 V/ j% f- ?" ]6 B- T5 R 大家共同定义一些非常狭窄的东西,例如:
( S' U5 q3 G& M
& ~0 d9 c) ~" \ X# Z$ o' k - 什么叫 frontier model;" W4 e1 k$ c# j# l, x
- 什么能力达到危险阈值;
; ~ B, Y. U. l n$ \- 哪些能力必须进行独立测试;5 s3 U2 P" y( w
- 哪些事故必须报告;1 @, D, F6 W/ r( g7 D
- 什么叫“重大 AI 安全事件”;" Q8 u/ i3 Y7 q) z. e/ V- A, O
- 哪些模型必须进行 deployment review;
4 ], [5 @1 e2 k- 哪些模型必须保留审计记录;, J1 w8 `6 w% o+ I
- 什么测试结果达到什么风险等级。8 L" b r9 t: a* E5 a) d* q9 o# x
+ P) S2 H0 D& K% ]* G
注意:
- |! W$ `( w, K: b T; z# `" ?- {. [2 V( P
**这里只规定“测什么”和“怎么测”,而不是规定“你这个国家应该怎么治理”。**
+ U1 v) C! C- ^4 m" i
/ N9 M; n& n* L2 N 这会大幅降低主权冲突。
* Y: \4 e6 k2 z' n* j6 y) Q5 m8 k: W+ \/ x$ e; b
---# s% u0 M& B$ I, Q5 j1 s* U
- r: Q, @. Z1 W: v0 U ### 第三层:国际验证
2 D3 W" t- x. U
a4 W: [& E9 Z- o5 ~ 这是最关键的一层。$ ]7 w* ~! J2 z, y5 {
5 Q) I; c: t4 S5 r
不是让中国监管美国。- @2 E2 `0 \; R0 I! {! l) M
- [, f7 u- X; q3 m2 s 也不是让美国监管中国。
' W0 r+ N+ e' { t9 }; b) D1 G: d$ d. E& K( C
而是:
4 m0 o! r# L0 x# T$ X3 ~4 y; x
> **第三方机构验证“美国监管机构有没有按照共同标准完成测试”。**+ f: k1 [/ A5 o7 ~5 b, R1 z: @
" u& e3 x+ d/ z2 U- G& Q 例如:9 i1 ^) J. [! d9 o# _. O
$ @/ |8 s- {9 E 美国说:) D$ i- C! J+ _: [- e2 `, t/ E
$ U8 m; M# F& b$ t# A
> “我们已经测试过 Model X,安全。”1 P( i4 c& u. L# t# ^
. {$ T/ @( X Z" C 国际验证机构不需要接管美国监管。/ c# H/ R% D+ J" i' `
8 U+ P% h6 q' O E N
它只需要检查:
- d# `2 r0 g) H: Y' s/ y
" s5 b2 Q, V" I > 你测试了吗?
0 h8 \6 k0 I4 k>
T$ r6 P$ R2 `- T6 n8 E9 f> 测试方法符合标准吗?
8 ]5 U; D) ^$ H/ u1 N. {6 b># ]& J; _7 _! P5 M3 |. `3 n
> 测试数据有没有造假?; ?+ a6 X/ ]8 w: J+ a, `
>
/ q* H4 K% m( t* ] Q> 有没有遗漏规定的测试?0 U) ^& ~% ^1 F2 a8 ]$ l9 c
>$ N6 \. g! A# S8 S
> 测试结果有没有达到规定阈值?! L/ N+ o! m9 w0 x X5 W
% o' I8 }" e& a- X7 B: [2 h) ]" m
中国同理。
% P4 B, H/ N' H _" O* w& n% J* \; G7 m- }+ }" c
于是就出现了一个非常漂亮的制度:( g& ^0 y1 \6 o* f, o/ Y
6 U) m) X6 W/ z' c$ H- C5 A% n' p
**国家拥有监管权,国际机构拥有验证权。**( P1 P4 W1 w& E+ s
, ^# ~: j4 [ f& t5 o( h# ^/ b
--- J' L) a; k+ A9 D. ^) o) q8 x
1 n7 V$ s$ y$ Q2 R V
# 四、甚至不需要相信“第三方”
. c; ~" z4 u- N
Y2 B3 {# L6 c; H( [ 这里还有一个更深的设计。) `) w1 s) c+ f: B8 v
2 I. \" b9 r/ s" H# o% \ 假设中美连第三方都不相信。' M9 p0 r5 u. e% J% p) u2 D
% I& O! W9 d5 c; Y' g$ D9 I& b! }
怎么办?
- V$ m/ c/ e& E2 n, _& K& g6 K1 m& F. c0 V4 K9 w/ p7 W8 f$ n
**让验证过程尽可能机器化。**. `) G1 ]4 F$ B5 z( E
* p4 H Y q! [/ H 例如建立标准化的 AI Safety Evaluation Protocol。
+ L! \& w1 U+ w& ]% `7 u5 b3 v m6 y S5 E7 A* i$ i; M
一家中国公司提交模型以后,不需要把模型权重交给美国。& A! b& @' f: H: E4 b: X9 U, m) p. o; H; ?
* x3 |5 ~" c4 G4 V; G 一家美国公司也不需要把权重交给中国。& ]9 T2 }; z8 p" V" I! S( T
' s1 Z9 k# ^( L" {6 l 双方只需要运行一组国际认可的测试:. s1 I' |; a3 m: G. V/ k
# Q9 A z5 U" p; w. E1 L# J```: {$ ]: \$ g1 G' R
Cybersecurity
. O# d0 \4 f4 K6 A$ m8 ?Biosecurity
* T+ h! _* [! t3 l, GAutonomous replication
7 o1 k0 q5 C/ t% Q' Y7 wDeception# {$ @# g: D1 V K6 d
Persuasion! f- U T! {0 x& z$ X; D/ s9 y- r
Model autonomy0 C t/ e6 k, @ k
Critical infrastructure attacks
- p5 ] {7 S" Y8 ?# o( lHuman-control loss+ o! f0 L" p% | \3 {, K8 a
```9 H' A8 N8 ]# B; l
$ [) k# `& N! f8 N
然后产生:! h% u5 X" f1 [; J, c' J, Y( n' i( q: z
' r3 t" q9 p6 H
```, q2 ]" M" ^& K, f; W3 Z3 u
Test ID
5 _: k, ?* Z. L+ j; v+ Q5 ^7 ]Version
, [; T) B/ f4 n. S$ A) |Result
1 ?; W& w' Q6 ? l" t: HTimestamp
3 d% Z1 X7 V7 L. {: d. \Evaluator, [. ^* X6 Z* ~
Cryptographic signature6 E6 P* A O; I7 A8 o5 P0 g/ o ^
```
' r/ v% d) _2 p& g- p f/ ]: w$ s. |1 x6 a; A- P: \' A9 a j/ E
类似航空领域的适航证书、软件供应链签名、金融审计记录。) k3 o# c; s: `
+ p5 B+ U- Q& F. g' m3 z# b 这样国际机制监督的不是:2 {1 M, t7 g# |+ q" V. D0 h7 J
3 M% @3 G: j; I
> “你的模型内部到底是什么?”
0 k4 }; a7 p7 @+ A
" H7 ~+ {; l, U6 ?4 e4 X 而是:) C T. k: K* K4 I2 e* X7 j3 I- a: g
9 O* n4 S" v- c$ A; ^, ]! L& v
> **“你是否完成了规定的测试,以及结果是否真实可验证?”**8 h" N! o9 Q; ?( I* i6 l9 x2 g
) u H) u6 y' l# W* ]! B 这会比“外国监管机构进驻你的 AI 实验室”现实得多。3 o; o! g7 V7 _+ k; g: f3 ?( k
, q5 Y |8 o) |0 [# |$ ?" g4 E h1 C) U
---
5 o7 L- y% v. x% L/ W
1 U1 E7 d) ^( ^ # 五、进一步可以采用“相互承认”制度
S* o3 |# f: Y7 V8 V7 O/ l' ~3 Z; z
这可能是最现实的突破口。
7 @- x1 G( j. B: ^# T: Y0 C3 | z3 B3 n
例如: b! O9 o2 ]+ D- f
* }4 o8 P" y9 Q
美国说:
7 B! Y! U: Q' N5 k& V3 n
8 l2 T5 a2 G. j. y > 我不接受中国监管机构直接监管美国 AI。
3 [: M" `; X- t4 d, [4 U/ M( j* N2 p& y1 @4 m
中国说:
) r' _! }: H* M6 U) Z- c; v ^1 O9 \3 B( ^# R! p
> 我也不接受美国监管机构直接监管中国 AI。1 i6 p' w5 Q8 R ^
0 Q3 U! J' w* |1 ^
完全没关系。
' ?- \2 ^) d% ?! ]9 B$ U6 j2 W" k7 h5 s9 _7 D+ o: p- z! C
那么双方签:0 p' C% Y g6 V5 Y
) _" P l" f# I F9 M > **Mutual Recognition Agreement**8 B5 R; v% L2 R& [' E7 k
+ B* R1 ^0 T1 k9 I x! n. S 也就是:
8 h/ K. ]4 P# `/ s; r( ?2 K5 V. O/ z# }7 P8 v
**我承认你的监管体系满足某些共同最低标准。**
& V, f f y/ Q0 V% q0 Y# f- s7 Z4 J; Q/ X) U
这在国际贸易、航空、药品、金融等领域其实并不陌生。: `6 b- H& g) s/ h" O
6 i0 X% C" S$ t5 R- A9 L
于是:
# U( \2 e. k1 b6 v5 \* L+ _3 E w) o) g. t) Q, @7 i
|
|