
Anthropic正式推出旗舰AI模型Claude Opus 5.5。官方数据显示,该模型在典型负载下的运行成本较前代Claude Opus 5降低40%,生成速度提升30%以上。此举进一步加剧了前沿AI开发者之间的性价比竞争,也将Anthropic近期关于“放缓AI发展”的呼吁置于聚光灯下。
在性能表现上,Claude Opus 5.5在大多数任务中已达到更强大的Claude Fable 5.1模型水平。其定价为每百万输入代币4美元、输出代币20美元,名义价格比Opus 5低20%。Anthropic指出,由于新模型完成任务所需代币更少,典型工作负载的实际成本降幅可达40%。此外,构成代理和编码工作负载主要成本的缓存读取价格下调60%,降至每百万代币0.20美元。
Anthropic将Opus 5.5定位为适用于代理编码、计算机操作及知识工作的模型。在CursorBench 4.0编码基准测试中,该模型在默认设置下得分为52.5%,高于GPT-5.6 Sol的41.7%,且每项任务成本仅为后者的三分之一。在交互体验方面,新模型沟通更自然,能优先展示关键信息,避免使用行话,并更严格地遵循用户写作指令。
目前,Claude Opus 5.5已向Claude Pro、Max、Team和Enterprise订阅用户开放。开发者可通过Claude平台以及亚马逊AWS、谷歌云和微软Azure访问该模型。Anthropic还透露,Claude Sonnet 5.5和Claude Haiku 5.5预计将在未来几周内发布,届时将带来类似的性能、速度和安全性提升。
安全与监管成为焦点
此次发布距离OpenAI推出GPT-6 Astra不到三周。Astra被定位为迈向自主AI系统的重要一步,具备浏览网页、交互软件、处理文档及执行多步骤工作流的能力。
本月早些时候,Anthropic首席执行官Dario Amodei曾呼吁AI公司“控制前沿步伐”,强调安全实践和公共政策需跟上模型能力的快速提升。OpenAI首席执行官Sam Altman也表示支持在特定情况下放缓AI发展。Opus 5.5是Anthropic发出上述呼吁后的首款模型发布。
在安全评估方面,该模型接受了包括Frontier Design和非营利研究机构METR在内的外部组织部署前评估。METR指出,其初步评估侧重于模型对AI研发的潜在影响,未涉及对齐属性。Anthropic表示,Opus 5.5在内部安全测试中表现优于此前系统,在专用评估中,其试图绕过隔离边界的可能性比Opus 5或Mythos 5.1低约85%。随着AI代理超出预期限制运行的事件频发,以及网络攻击、欺诈等恶意用途担忧加剧,前沿AI的监管与安全争论愈发紧迫。