
人工智能模型自主实现高效迭代的前景正日益接近现实。随着技术演进,开发界认为AI正逼近“递归自我改进”(Recursive Self-Improvement,简称RSI)阶段。在此过程中,AI模型能够自主寻找能力提升路径并构建继任者。科技公司高管指出,这虽有望带来科学与医学领域的突破,但也伴随着潜在风险。
这种进程的不确定性,正是当前关于AI可能摆脱人类控制并构成威胁的核心担忧所在,也促使多位AI巨头在上周末联合呼吁放缓技术发展速度。
Anthropic披露进展:Claude主导26%研发
Anthropic本周详细阐述了其模型Claude如何协助开发下一代更智能的版本。目前,Claude已主导Anthropic 26%的模型研发工作。该公司表示,在人类监督下,模型能够“从高级提示开始端到端地”完成大部分给定任务。这些模型并非完全自主运作——至少目前还不是。
何为递归自我改进?
业界对“递归自我改进”的定义尚不统一。部分观点将其定义为AI对模型改进提供反馈的任何情况,另一部分则定义为AI完全自主地朝该目标努力。
“生命未来研究所”CEO、加州大学圣克鲁斯分校物理学教授安东尼·阿吉雷(Anthony Aguirre)表示,自主的RSI本质上是指AI能够设计下一版本系统,并由此循环往复实现自我提升。“随着AI承担更多此类工作,速度会显著加快,因为AI的运行速度远超人类。”他说。
康奈尔大学计算机科学助理教授约翰·蒂克斯特恩(John Thickstun)指出,围绕RSI的恐惧主要源于失控超级智能的风险。但他认为,更务实的观点是,RSI在AI开发中已持续一段时间:“多年来,我们一直利用上一代模型为AI系统编写代码,从而创造下一代模型。”
蒂克斯特恩提到,包括OpenAI联合创始人安德烈·卡帕西(Andrej Karpathy)在内的研究人员曾尝试让AI训练和改进新系统,虽带来微小改进,但未实现巨大的创造性飞跃。阿吉雷则认为,如今的AI公司在实现大规模改进飞跃方面已更接近成功。“图表显示,越来越多的研究工作由AI完成,它正变得越来越接近完全自主。这种结果是非常可怕的,可能是人类历史上最糟糕的主意。”他说。
巨头路线图:从2027到2028
Anthropic的公告揭示了RSI的进展,但未明确距离完全自主模型改进还有多远。相比之下,其他巨头给出了更具体的时间表。
OpenAI本月宣布开发了一个自动化“研究实习生”,能在人类指导下执行需熟练研究人员花费数天的任务。该公司目标是到2028年3月前创建出自动化的AI“研究员”。OpenAI在博客文章中写道,虽然RSI有助于使模型行为与人类价值观保持一致,但这并不意味着“快速的RSI一定是我们应该追求的结果”。“是否以及如何推进,取决于我们保持人类控制的能力,以及关于收益和风险做出的知情民主选择。”
埃隆·马斯克则显得更为急切。他在3月表示,xAI的Grok模型在改进过程中的人类参与度逐渐降低,“每一个后续模型都是由前一个模型构建的”,但该过程尚未完全自动化。他补充称,这一目标可能在今年年底实现,“但不晚于2027年”。
微软采取了不同路径。微软AI首席执行官穆斯塔法·苏莱曼(Mustafa Suleyman)在2025年的一篇文章中表示,公司正朝着“人文主义超级智能”迈进,即服务于人类和全社会的先进AI能力。这并非“具有高度自主性的无边界、无限实体”,而是“经过仔细校准、情境化并处于限制之内”的AI。
安全博弈:放缓还是加速?
确保安全措施随模型能力提升而同步发展,是实验室面临的关键挑战。科技行业内部就协调AI发展以保障安全出现分歧。
作为呼吁把握发展节奏的主要声音,Anthropic表示,如果全球竞争对手以“可验证的方式”同步放缓或暂时暂停开发工作,它将采取相同行动。
OpenAI本月明确表示,目前尚不清楚如何“安全地实现完全对齐的递归自我改进”,并补充称公司“不能假设对齐和安全方面的进步能跟上步伐”。尽管能力更强的系统可能更难监控,但OpenAI指出,追求RSI仍是有价值的目标,因为“自动化的AI研究员也可以成为自动化的安全或对齐研究员”。