从AGI到ASI的Anthropic路线:递归自我改进的公开呼吁与争议
Anthropic在2026年6月4日发布的《When AI Builds Itself》一文,是ASI思想史上一个罕见的时刻——一家估值近万亿美元、正冲刺IPO的前沿实验室,主动呼吁全球保留"放缓或临时暂停前沿AI开发"的选项。这篇文章的真正分量,不在于它"呼吁暂停"(这在此前FLI公开信中已有),而在于它第一次由前沿实验室用内部量化数据,证明递归自我改进(RSI)正在自己的研发流程中发生。这使得Anthropic的路线既不是纯粹的加速主义,也不是彻底的暂停主义,而是一种"踩着油门呼吁装刹车"的矛盾姿态——也正是这种矛盾,引发了硅谷、华盛顿和学术界的激烈争议。
一、《When AI Builds Itself》:一份技术自白书文章由Anthropic研究所负责人Marina Favaro和联合创始人Jack Clark撰写,核心论点谨慎而克制:
这句话的三个限定词——"尚未"、"并非不可避免"、"可能更早"——精准定位了Anthropic的立场:不是预言RSI已至,而是指出RSI的工程路径正在快速收窄。
关键数据:AI正在"构建AI"的量化证据Anthropic披露的内部数据构成了文章的技术骨架:
四阶段演进框架Anthropic将AI参与自身研发的历史拆解为清晰的四个阶段:
而真正的"闭环"(Closing the loop)——即AI能够完全自主地构建和改进自身的继任者——被标注为"20XX?",意味着这一步尚未到达,但趋势线指向它。
二、Anthropic的公开呼吁:全球协调机制基于上述技术趋势,文章提出了在AI行业"颇为罕见"的主张:
Jack Clark在CNN采访中更直白地表达了这一隐喻:
呼吁的核心要素Anthropic的提议包含四个关键设计:
为什么是"协调放缓"而非"单方暂停"Anthropic明确区分了两种刹车:
公司表示将在未来数月召集各国官员、科学家、倡导团体及竞争企业,共同研议这类机制如何运作。
三、争议:三重解读的撕裂这篇文章在发布后48小时内引爆了硅谷和华盛顿的激烈争论,同一份文本被不同立场的读者解读为三种完全不同的东西:
解读1:"真诚的预警"(安全主义视角)支持这一解读的证据:
解读2:"竞争位置的锁定策略"(战略博弈视角)批评者认为这是一种以安全为名、行锁定领先地位之实的策略:
Bentley大学数学副教授Noah Giansiracusa更直接质疑:
一位微软产品经理的质疑代表了产业派的声音:
解读3:"不可执行的空喊"(现实主义视角)即使接受Anthropic的诚意,技术和政治的可行性也备受质疑:
更深层的矛盾:Anthropic自身的"言行张力"争议的核心在于Anthropic自身行为的矛盾性:
四、Anthropic路线在AGI→ASI光谱中的独特位置把Anthropic的立场放回我们之前梳理的AGI→ASI观点光谱中,它的位置非常特殊:
Anthropic既不是加速派,也不是暂停派,而是"预警的加速派"或"有条件的刹车呼吁者":
与DeepMind《从AGI到ASI》的对照2026年6月DeepMind发表的《From AGI to ASI》论文列出了ASI的四条路径:(1) Scaling AGI, (2) AI范式转移, (3) 递归自我改进, (4) 多智能体集体涌现。Anthropic的文章用内部实证数据证明了路径(3)的工程可行性正在快速逼近——这是产业界第一次用自己的研发数据验证了学术界的理论框架。
但DeepMind论文将ASI定义为"在认知上超越整个人类组织",而Anthropic关注的是更前期的RSI阈值——两者在ASI演进链条上形成了互补的观测点。
五、这场争议的真正意义拨开"营销还是预警"的口水战,Anthropic这篇文章的文明级意义体现在三个层面:
意义1:RSI从理论推演变为可观测工程趋势在此之前,递归自我改进主要是Good(1965)、Vinge(1993)、Bostrom(2014)笔下的理论概念或"科幻式风险想象"。Anthropic第一次用量化数据(80%代码生成、8倍生产力、4个月翻倍的任务时长、52倍训练加速)证明:RSI不是是否会来的问题,而是以多快速度到来的问题。
意义2:治理缺口的公开承认Jack Clark的"油门与刹车"隐喻,揭示了当前AI治理的根本缺陷——行业发展只有市场激励(油门),缺乏全球协调机制(刹车)。Anthropic的呼吁本质上是承认:前沿实验室自身的RSP(Responsible Scaling Policy)不足以应对RSI级别的文明风险,必须升级到多边治理层面。
意义3:竞争与安全的根本性张力争议本身暴露了ASI治理的"不可能三角":
Anthropic的"协调放缓"呼吁,本质上是试图在这个不可能三角中寻找一个脆弱的平衡点——而正如Giansiracusa所说,"zero chance"这一机制能够真正实现。
六、深层判断:Anthropic路线的历史定位
这篇文章的三重矛盾性——技术上的预警者、商业上的竞争者、治理上的呼吁者——恰恰是2026年ASI时代前沿实验室的真实写照:
第一,它证明了RSI的工程路径正在快速收窄,回应了Good 1965年提出的"智能爆炸"逻辑链——但这一次,证据来自产业内部而非理论推演。
第二,它暴露了当前治理框架的根本性失灵——Jack Clark的"没有刹车踏板"不仅是Anthropic的困境,更是整个文明的困境:当技术演进速度超越任何单一国家或组织的控制能力时,人类缺乏有效的集体行动机制。
第三,它揭示了"安全使命"与"商业现实"在前沿实验室内部的不可解张力。Anthropic一方面呼吁协调放缓,一方面继续训练Model 2、继续冲刺IPO——这不是简单的伪善,而是资本主义前沿科技企业面对存在性风险时的结构性困境。
与Vinge"初始条件可塑"的呼应回到Vinge 1993年的核心洞见:"我们有自由建立初始条件,以比其他方式更少敌意的方式让事情发生"。Anthropic的呼吁可以被理解为在RSI临界点之前"设置初始条件"的产业界尝试——但它面临的困境是:
这正是Anthropic路线陷入争议的根本原因——它正确地识别了问题,但提出的解法在当前国际格局下近乎乌托邦。
2026年8月的后续发展:RSP v3.4与风险报告值得注意的是,在《When AI Builds Itself》发布后两个月,Anthropic于2026年8月14日发布第二版风险报告(RSP v3.4下):
这些后续披露强化了Anthropic最初预警的可信度——但同时也暴露了RSP v3.0从"有约束力的能力触发暂停"转向"自愿透明机制"的结构性弱化。这种"言语上刹车、机制上油门"的张力,正是Anthropic路线最受批评之处。
七、结语:一份"最诚实也最矛盾的自白"回到我们这一系列探讨的主线——从AGI到ASI的演进不是单一超级智能体的突变,而是缩放连续推力与认知突破质变杠杆耦合后的系统性涌现。Anthropic的《When AI Builds Itself》第一次用产业界自己的数据,证明了这一系统性涌现在RSI维度上的真实进度。
这篇文章的真正价值,或许不在它提出的"协调放缓"呼吁(这一呼吁在政治上几乎不可执行),而在它诚实地展示了前沿实验室自身的困境:
这种"最诚实也最矛盾的自白",恰恰反映了2026年人类文明面对ASI时的真实处境。没有单一的 villain,也没有单一的解法——有的只是前沿实验室在商业生存、国家安全、文明责任之间的艰难平衡。
Anthropic路线的历史意义,可能在未来被这样评价:
它是第一家承认"我们没有刹车踏板"的前沿实验室,也是第一家尝试设计刹车踏板但发现刹车需要全球协调的实验室。 这一尝试虽然近乎乌托邦,但它迫使整个行业正视一个事实——RSI不是遥远的科幻场景,而是可能在"未来两年内,甚至更早"到来的工程现实。
正如清华智能法治研究院的精准点评:
2026年6月4日,Anthropic用一篇博客文章,把ASI治理的时钟向前拨了一大步——不是因为它解决了什么问题,而是因为它诚实地展示了问题的不可解性。这种诚实本身,就是ASI时代最稀缺的资源。
Vinge 1993年留给我们的"初始条件可塑"——在2026年的现实中,面临着Anthropic所揭示的残酷困境:当所有竞争主体都必须同时"设置初始条件"时,"初始条件"就不再可塑,而变成了集体行动的囚徒困境。
Anthropic的呼吁或许无法实现,但它的诚实——承认我们只有油门没有刹车、承认RSI可能早于预期、承认自身在商业与安全间的矛盾——本身就是ASI治理史上的一座里程碑。因为唯有诚实面对困境,人类才有可能在"事件视界"之前找到真正的刹车。
而这,或许就是Anthropic路线在AGI→ASI思想谱系中,留给文明的最珍贵遗产:不是答案,而是诚实的问题。
|
GMT+8, 2026-9-2 03:11 , Processed in 0.041412 second(s), 22 queries .
Powered by Discuz! X3.5
© 2001-2026 Discuz! Team.