OpenAI于周一发布一系列关于前沿人工智能开发的安全提案,重点聚焦于对齐研究与递归自我改进(RSI)。

该公司在博客文章中指出:“安全度过这一过渡期,需要对齐研究与技术能力同步发展,以确保我们及他人构建的系统始终符合人类价值观,并处于人类控制之下。”

OpenAI呼吁开展国际合作以制定前沿标准,建议在全球现有AI安全研究所的工作基础上进行建设。该公司表示,这些技术标准应侧重于前沿AI模型及其开发者,并针对包括RSI在内的自动化AI研究人员进行收益风险管理。

警惕RSI潜在风险

RSI因有潜力创建无需人类干预即可自我升级的基础模型,令AI开发人员兴奋不已。然而,该领域的进展也引发部分技术专家担忧:随着AI系统日益复杂且无处不在,基础模型制造商可能会失去对底层技术的控制,或未能充分考量潜在的意外后果。

“完全自主的RSI目前尚未实现,在我们能够确保安全之前,不应追求这一目标。”OpenAI指出,若缺乏适当的谨慎和防范,RSI可能导致人类在实际操作中失去对AI开发的控制权,从而无法对不再理解的研发过程提供监督。

行业安全辩论升温

上周,竞争对手Anthropic也发布了其关于安全开发前沿AI模型的理念,以此回应近期行业研究人员关于AI对人类威胁的一系列警告。

此前近两周,曾在Anthropic和OpenAI任职的Jacob Coxon宣布辞职,并称这两家公司正在“拿我们的生命赌博”,此举引发了一场全球性辩论。