喊「踩刹车」的人握着方向盘:AI竞赛的减速悖论
安全派掌门人发公开信喊踩刹车,回信只有一句:当真就把权重放开。这场对垒真正的看点,是谁都没说出那个前提——刹车要有效,得先有一块所有人都认的里程表。

周六早上刷Hacker News,Dario Amodei的新文章《We must pace the frontier》挂在热榜,743条评论还在涨。差不多同一时间,另一封公开信也在流传,标题更直白:《致Dario:如果当真,就开放权重》。
一边是Anthropic的CEO,AI安全叙事最大的受益者之一,呼吁整个前沿集体减速;另一边是批评者用他自己的逻辑反将他一军。评论区吵成一锅粥,但把两边的牌摆在一起看,事情比「安全派大战加速派」这种标签有意思得多。
先摊牌:两边各自在赌什么
Amodei的论点其实不新鲜:前沿模型能力爬得太快,评估、治理和社会消化都跟不上,所以前沿实验室应该协调减速,等一等。
回信的反击同样直白:你既然认为前沿AI危险到需要踩刹车,那把权重锁进自家保险柜算什么?封闭不会让危险消失,只是把危险集中到一家公司手里。要证明诚意,就把权重开放,让所有人看看你害怕的东西到底是什么。
这两张牌各有软肋。减速派的死结在于:单边刹车等于让位。你减速,别人照跑,先发优势让出去就再也拿不回来。所以「一起踩刹车」要成立,前提是所有人都确认别人也在踩,而这需要验证机制,现在没有。开放派的软肋同样尖锐:如果模型真有那么危险,开放权重等于把危险四处扩散。公开信里没提这半句。
| 封闭前沿(减速派现状) | 开放权重(公开信主张) | |
|---|---|---|
| 风险放在哪 | 集中在少数实验室手里 | 扩散到所有持有者 |
| 外部能否验证 | 无法验证,只能听宣传 | 任何人都可以检查 |
| 对竞争的影响 | 保住先发优势 | 抹平领先差距 |
| 隐含的赌注 | 封闭等于可控 | 摊开是最好的审计 |
说到底这是一道博弈论题,不是价值观题。两边都自称相信安全,差别只在于对「别人会怎么做」的判断不一样。

更麻烦的是,「快」本身在加速
同一个周末还有一条容易被忽略的消息:Lilian Weng更新了关于递归自我改进(RSI)的长文,从I. J. Good在1965年那句「设计更智能机器的机器」讲起,梳理了这个概念六十年的源流。她的判断是,前沿实验室的研究迭代速度已经明显加快,AI辅助研究不再是纸面设想。
把这条和Amodei的信放在一起读,才能看清减速讨论真正的难点。RSI的循环大致长这样:
- AI辅助产生研究想法
- 用AI写代码、跑实验
- 实验结果喂出更强的模型
- 更强的模型反过来加速前三步
每一轮循环在变快,人力监督的节奏却纹丝不动。董事会按季度开会,论文按月评审,监管立法按年推进。一旦循环周期短过所有人类流程,「踩刹车」这个动作本身就变得可疑:由谁、在哪一步、拿什么标准判断该踩?这些问题目前都没有答案。
我不认为RSI已经启动,那是言过其实。但「研究迭代被AI加速」这件事确凿发生了,而且它悄悄改写了安全讨论的时间尺度——你用来争论刹车的那个时间表,可能已经是旧的了。

算力央行与核电订单:另一条战线
《经济学人》这周把Nvidia称作「AI的央行」,这个比喻比听起来准确:GPU供给决定整个AI生态的「流动性」,谁拿到算力,谁才有参赛资格。Google的动作更实在,直接买下一座核电站一半的电力,竞赛从芯片烧到了能源。
这对减速讨论意味着什么?意味着燃料早就分配完了。前沿实验室手里的算力和电力合同全是多年期的,公开信写得再诚恳,机房的电闸不会因此拉下。资本开支已经沉没,董事会不会批准踩刹车。立场可以转向,资产负债表不会。
我的判断:先装里程表,再谈刹车
追了一整天这场争论,我越来越觉得它吵错了方向。问题不在「该不该减速」,而在「我们手里根本没有一块公认的仪表盘」。
减速要可信,至少得先有三样东西:
- 一套各方承认的前沿能力
benchmark,而不是各家自说自话的内部评测 - 算力与训练运行的披露机制,让「别人跑多快」变成可验证的事实
- 越线之后的执行手段,哪怕只是合同和舆论层面的
现在这三样,一样都没有。Amodei的信把「协调减速」摆上台面,算是一种进步;但验证机制缺位的情况下,它更像一份姿态声明。公开信主张的open weights倒提供了一个粗糙的替代方案:权重公开,谁都能审计,信息不对称至少被抹平一半。代价是能力扩散的风险,这笔账怎么算,我给不出结论。
说真的,这场争论最大的价值可能不在结论,而在它暴露的事实:最了解前沿模型的那批人,自己也不确定该踩刹车还是踩油门。这种不确定,比任何一方的口号都更值得记住。
减速的前提是所有人看着同一块仪表盘。仪表盘造出来之前,「踩刹车」只是修辞。