
Anthropic正式推出Claude 5.5系列的第二款模型——Claude Sonnet 5.5。该模型定位为旗舰模型Opus 5.5的快速、低成本补充方案,旨在处理范围明确的日常任务,而非最复杂的判断性工作。
定位日常任务,性能显著跃升
相较于专为复杂工作设计的Opus 5.5,Sonnet 5.5在修复代码错误、制作文档、幻灯片及电子表格等日常场景中表现更强。Anthropic称其为Sonnet 5的“显著升级”,在性能、协作、成本、速度和安全性之间取得了更佳平衡。
数据显示,Sonnet 5.5在编码评估Terminal-Bench 4.0中得分70.6%,远超Sonnet 5的10.3%;在多职业真实工作测试GDPval-AA中,其表现仅落后Opus 5.5两个百分点。此外,Sonnet 5.5成为首个仅凭截图通关《宝可梦 红》的Sonnet模型,印证了其在长程推理和图像理解上的进步。
Anthropic确认,面向高吞吐量和对成本敏感场景的Claude Haiku 5.5将在未来几周内加入该系列。
速度提升30%,任务成本降低
Sonnet 5.5的输出速度比Sonnet 5快30%以上,是迄今最快的Sonnet模型。尽管单token价格不变,但由于完成相同任务所需token更少,每任务成本可降低高达30%。
早期测试反馈显示,Epic Games在系统设计审计和数据流审查中见证了其效率增益;Base44指出,构建实际应用所需的迭代次数不到Sonnet 5的一半;Box则表示,在处理敏感文档时,该模型速度快2.4倍,token使用量减少12%。在未更改提示词的情况下,Sonnet 5.5在几乎所有离线评估中均使用约14%更少的输出token并实现了性能改进。
保持亲民定价,全平台可用
Sonnet 5.5维持与Sonnet 5相同的定价:输入token每百万2美元,输出token每百万10美元,缓存读取每百万0.20美元。其输入和输出成本仅为Opus 5.5(分别为每百万4美元和20美元)的一半。
尽管价格更低,Sonnet 5.5仍继承了Opus 5.5的部分优势,包括更清晰的写作能力和对设计的敏锐度。测试者指出,其生成的幻灯片模板遵循度极高,几乎无需后续编辑。目前,Sonnet 5.5已在亚马逊云科技(AWS)、谷歌云和微软Azure等所有平台上可用。