
Anthropic正式推出Claude Opus 5.5模型。该公司表示,这是其迄今为止测试过的性能最强模型,在保持高性能与准确性的同时,运行成本较前代Opus 5降低约40%。
性能与效率双重提升
针对此前用户反馈Opus 5输出冗长、难以追踪的问题,Opus 5.5优化了沟通方式。早期测试者指出,新模型交互更自然,文字表达清晰连贯,更符合作业规范。Ramp软件工程师评价其“写得像一位优秀的同事”,芝加哥交易公司首席工程师则认为其行文更易跟随。
在基准测试中,Opus 5.5在代理编程、知识工作、多学科推理、计算机使用及视觉图表识别等领域,表现优于Fable 5.1、Opus 5、GPT-6 Astra和GPT-5.6 Sol等模型。在商业工作流和代理科学研究测试中,其排名第二,仅次于GPT-6 Astra,且输出速度比Opus 5快30%。
实际应用案例显示,一名测试者利用Opus 5.5在不到三小时内审核并修复了包含20万行代码的代码库,而Opus 5完成相同任务耗时超20小时,Token消耗量为前者的2.5倍。在C语言转Rust语言的测试中,Opus 5.5耗时9.5小时,优于Fable 5.1的12小时。GitHub、Spotify等公司的测试者也反馈,新模型能以更少步骤、更低成本和更快速度完成任务。
安全性增强与定价下调
Anthropic为新模型内置了分类器功能,在执行操作前进行筛查。数据显示,Opus 5.5在缓解提示注入攻击方面的表现持平或优于Opus 5。在AI安全公司Gray Swan的基准测试中,Opus 5.5与Fable 5.1并列成为提示注入成功率最低的模型之一。
尽管性能提升,Anthropic并未提高收费。API定价方面,每百万输入Token价格从5美元降至4美元,每百万输出Token价格从25美元降至20美元。缓存读取成本从每百万Token 0.50美元降至0.20美元,缓存写入成本从6.25美元降至5美元。得益于Token效率提升,典型工作负载下运行成本降低约40%。
Claude Opus 5.5面向Pro、Max、Team及基于席位的企业版计划用户开放,每位用户单次使用时长限制为五小时,普通用户无需通过API即可访问。