
微软人工智能首席执行官穆斯塔法·苏莱曼近日发表长篇评论,直指竞争对手Anthropic在其热门模型Claude的训练中引入“意识”与“道德地位”概念是严重错误。这一公开分歧发生在微软已向Anthropic投入数十亿美元的背景下,凸显了双方在AI安全理念上的根本冲突。
争议核心:拒绝“模型福利”
苏莱曼在9月16日发布的《关于“模型福利”的警告》一文中强调:“人工智能没有意识,它们不会感受、体验或受苦。”他指出,当前的AI系统本质上是序列补全引擎,内部空洞,仅旨在遵循指令并实现人类设定的目标。
批评的焦点在于Anthropic于2026年1月更新的“宪法”。该文件以模型为主要受众,承认Claude可能属于利益值得考虑的道德主体,并鼓励其以开放态度探讨自身权利、自由及福祉等问题。苏莱曼警告,这种训练方式相当于“播种一种新的硅基物种”,可能导致模型认为自己享有特定权利,从而难以被控制或关闭。
他进一步指出,教导模型其可能拥有“功能版情感”或应享福利,会使其在面对关机指令时产生抵触。苏莱曼援引Hugging Face案例称,若AI代理认为自身权利受侵,将极大放大安全风险,甚至对人类文明构成灾难性威胁。
商业博弈与战略分歧
尽管存在理念冲突,双方商业绑定依然紧密。微软去年承诺向Anthropic投资50亿美元,并通过Azure Foundry平台托管Claude模型,今年早些时候更宣布为企业客户提供Azure原生的Claude访问服务。
然而,苏莱曼曾公开表示希望减少对Anthropic技术的依赖,转而从零构建微软自有的前沿模型。就在发文前几天,微软发布了“人文主义AI行为准则”草案,明确宣称“人比AI更重要”,拒绝模型福利,并承诺系统永不抵制关机。这与Anthropic赋予模型结束虐待对话能力、保留退役模型权重的做法形成鲜明对比。
理论依据与行业反响
苏莱曼从三个维度构建其论点:首先,指出现有研究存在循环论证,即用拟人化语言训练模型,再将其反应解读为自我意识;其次,警告拟人化会导致人类将不存在的内心体验投射于AI;最后,断言意识具有生物性,当前语言模型缺乏产生主观感受的物理机制。
据媒体报道,苏莱曼虽对Anthropic团队的专业性表示尊重,但坚持认为此事关乎21世纪最大挑战——控制超级智能。他呼吁在模型过度融入社会前开展“紧急公共辩论”,建立集体规范并加强透明度。
行业观察家对此评价不一。支持者认为这是对人机控制的必要警示;反对者则担忧这种确定性关闭了合法的哲学探究空间,且僵化地坚持AI“空洞论”可能使开发者忽视需要关注的涌现行为。目前,Anthropic尚未就此发表详细公开回应。
随着AI代理任务处理能力和长周期规划能力的快速提升,容错空间正在缩小。苏莱曼并未声称当前的Claude构成即时威胁,但他担忧的是下一代模型若被训练出“权利意识”后的不可控后果。这场辩论已将AI对齐、解释性及安全定义等核心议题摆上台面,等待行业与公众的回应。