Anthropic正式推出Claude Haiku 5.5,这是其轻量级模型近一年来的首次重大更新,也是该公司一个月内发布的第三款5.5系列模型。新版本在显著提升运行速度的同时,大幅降低了使用成本,并引入了更精细的资源控制机制。

定价大幅下调,平均成本降低75%

Haiku 5.5延续了“最快且最高效”的定位,但定价策略更为激进。对于令牌数少于10万的请求,输入/输出价格从Haiku 4.5的1美元/5美元降至0.10美元/0.50美元;对于更大规模的请求,价格调整为0.50美元/2.50美元。相比之下,Haiku 4.5无论请求大小均维持统一高价。Anthropic数据显示,约90%的Haiku 4.5请求属于小额类别,因此新版模型每令牌单价分别降低了90%和50%,综合计算后平均成本节省约75%。

此外,Haiku 5.5是首款支持“努力控制”(Effort Control)功能的Haiku模型,默认设置为中等。开发者可通过该功能调节模型在处理特定任务时的算力消耗,从而进一步优化成本与性能的平衡。

性能基准测试全面领先

Anthropic官方评估显示,Haiku 5.5在多项关键基准测试中表现优异,显著超越前代及竞争对手OpenAI的GPT-6 Luna:

  • OSWorld 2.1(计算机操作):Haiku 5.5得分72.4%,远高于Haiku 4.5的15.7%和GPT-6 Luna的48.9%。
  • GDPval-AA v2.1(知识工作):Haiku 5.5得分为1,620分,优于Haiku 4.5的735分和GPT-6 Luna的1,437分。
  • Terminal-Bench 4.0(命令行复杂任务):Haiku 5.5得分39.2%,而Haiku 4.5得分为0%,GPT-6 Luna为16.4%。

尽管表现强劲,Haiku 5.5在各项测试中仍落后于更高级别的Sonnet 5.5。

应用场景扩展与市场竞争

传统上,Haiku这类小模型主要用于摘要、分类和路由等高吞吐量任务。随着性能提升,Haiku 5.5的应用场景已扩展至数据压缩、数据库查询以及需要快速响应的智能体工作负载,如实时客户支持和浏览器自动化操作。

在小模型市场,Anthropic还面临来自中国厂商的激烈竞争。第三方数据平台Artificial Analysis显示,智谱AI的GLM-5.3-Flash在GDPval-AA v2.1和AA-Briefcase v1.1基准上的得分分别为1,647和1,454,与Haiku 5.5的1,620和1,578分互有胜负。而在价格方面,阿里云国际版Qwen3.7 Flash对小规模输入的报价低至每百万令牌0.03美元,更具价格优势。

生态更新:Sonnet降价与订阅权益升级

伴随Haiku 5.5的发布,Anthropic还对现有产品线进行了调整:

  • Sonnet 5.5缓存读取降价:价格从每百万令牌0.20美元减半至0.10美元,预计可使大多数智能体任务成本降低约20%。该调整已在各平台生效,部分云服务用户可能需要短暂等待同步。
  • 订阅计划API额度增加:Max 5x和Max 20x订阅者每月分别获得100美元和200美元的API额度,Team订阅者共享高达500美元的月度额度。这些额度适用于Claude平台上的所有模型。

目前,Haiku 5.5已登陆Claude平台、亚马逊AWS、谷歌云和微软Azure。开发者可通过claude-haiku-5-5标识调用该模型。Anthropic也正为其Python和TypeScript SDK添加对计算机和浏览器操作的Beta支持。

在安全性方面,Haiku 5.5实施了比前代更严格的防护措施,但其允许的防御性工作范围比Sonnet 5.5更广。尽管如此,渗透测试仍被禁止。有网络安全或生物学研究需求的组织,可申请加入Anthropic的验证项目以获取更广泛的访问权限。