曾被视作遥远目标的“人工智能自主提升效率与能力”,正加速走向现实。随着技术演进,开发者指出该领域已逼近“递归自我改进”(RSI)临界点,即AI模型能够自主寻找完善路径并构建继任者。科技高管警告,这一突破虽有望推动科学与医学进步,但也伴随着失控风险。

对未知前景的担忧引发了AI可能脱离人类控制的恐惧,促使多位行业领袖近期联合呼吁放缓技术发展步伐。与此同时,头部实验室在RSI进程上的披露,进一步揭示了这场技术竞速的现状与分歧。

从辅助到自主:RSI的定义与现实

Anthropic本周披露,其模型Claude已承担公司26%的模型研发工作。该公司表示,在人类监督下,Claude能够“从高层提示开始,端到端地完成大多数给定任务”,协助开发更智能的下一代版本。但强调这些模型目前并非完全自主运作。

业界对递归自我改进的定义尚存差异。非营利组织“未来生命研究所”CEO安东尼·阿吉雷指出,自主RSI的本质是AI设计下一代系统,进而设计再下一代,形成循环。由于AI运行速度远超人类,随着参与程度加深,迭代速度将急剧加快。

康奈尔大学助理教授约翰·蒂克斯特恩认为,围绕RSI的恐惧主要源于对失控超级智能的担忧。但他指出,某种形式的递归改进早已存在:“多年来,我们一直利用上一代模型编写代码,以辅助创建新一代模型。”尽管此前尝试未带来巨大的创造性飞跃,但阿吉雷表示,如今的AI公司在实现重大突破方面已更接近成功。

“从数据图表可以看出,越来越多的研究由AI完成,且越来越接近完全自主,”阿吉雷坦言,“这种成功的最终结果极其可怕,我怀疑这是人类历史上最糟糕的主意之一。”

巨头竞速:时间表与路线分野

Anthropic的公告虽未明确完全自主改进的时间表,但鼓励竞争对手分享类似指标。其他科技巨头则给出了更具体的规划或截然不同的理念。

OpenAI本月宣布开发出自动化“研究实习生”,可在人类指导下执行需熟练研究人员数天才能完成的任务。公司正朝着在2028年3月前创建自动化AI“研究员”的目标迈进。OpenAI强调,快速实现RSI并非必然追求的结果,推进与否取决于保持人类控制的能力及社会层面的知情选择。

相比之下,埃隆·马斯克显得更为急切。他今年3月表示,xAI的Grok模型在改进过程中的人类参与度逐渐降低,“每一代新模型均由前一代模型构建”。他澄清该过程尚未完全自动化,但目标可能在年底前实现,最迟不晚于2027年。

微软则采取了不同路径。微软AI首席执行官穆斯塔法·苏莱曼提出迈向“人文主义超级智能”,即服务于人类社会的先进AI能力。他在2025年的一篇文章中指出,这并非“拥有高度自主权的无边界实体”,而是“经过精心校准、置于特定语境中、并在有限范围内运行”的AI。

安全博弈:放缓呼声与内部分歧

确保安全措施与模型能力提升同步,是实验室面临的核心挑战。在业界呼吁协调放缓AI发展的背景下,科技行业内部出现明显分歧。

作为呼吁控制节奏的主要声音,Anthropic表示,若全球竞争对手以“可验证的方式”采取相同行动,它将放缓或暂时暂停开发工作。OpenAI则明确表示,尚不知道如何“安全地实现完全对齐的全功能RSI”,并警告不能假设对齐和安全方面的进步能跟上能力增长的步伐。尽管如此, pursuing RSI 仍是其重视的目标,因为“自动化AI研究员也可以成为自动化安全或对齐研究员”。