Anthropic发布Claude Haiku 5.5,价格较上代降九成

nashnova research
今天发布阅读约 5 分钟

Anthropic正式发布Claude Haiku 5.5,标称定价较上代降约九成,但实际节省约75%——新分词器多耗三成Token、长上下文仅降价一半是主因。跑分大幅领先同价位对手,但复杂编程仍明显逊于自家Sonnet 5.5,定位是高并发、低复杂度的执行层模型。

01

标称降九成,实际省多少?

短上下文定价:输入0.10美元/百万Token、输出0.50美元/百万Token,是上代Haiku 4.5的十分之一,也是Sonnet 5.5的二十分之一。
但官方自己测算,同等任务实际节省约75%,未达标称九成。这意味着→ 有两个隐藏成本在吃掉差价:①超10万Token的请求只降了一半;②新分词器让同样的文本多消耗约三成Token。
用大白话说= 如果你的调用都在10万Token以内,省钱效果接近宣传;一旦上下文变长,折扣就大幅缩水。
02

和GPT-6 Luna比,谁更划算?

10万Token以内,Haiku 5.5与GPT-6 Luna价格完全一样。
长上下文场景下Luna更便宜:Luna到约27万Token才涨价,涨后输入0.20美元、输出0.75美元;Haiku 5.5超过10万Token就按输入0.50美元、输出2.50美元计算。
这意味着→ 如果应用场景以长文档处理为主,Luna的长上下文成本优势明显;短调用场景下两者无差。
03

跑分领先同价位,但天花板在哪?

OSWorld 2.1(测试AI操控真实电脑完成多步任务):Haiku 5.5 Max档72.4%,同价位Luna 48.9%,上代Haiku 4.5仅15.7%——代际跃升极大。
终端编程Terminal-Bench 4.0:Haiku 5.5得39.2%,Luna 16.4%,但Sonnet 5.5达70.6%。这反映出复杂编程仍是大模型与小模型的核心分界线。
知识工作GDPval-AA:Haiku 5.5拿下1620分,Luna 1437分,Sonnet 5.5 1840分。Anthropic官方也明确建议:复杂Agent编程仍应优先用Sonnet 5.5或Opus 5.5。
04

它适合干什么?

Anthropic将Haiku 5.5定位为"量大、要快、要省钱"的执行层模型,适用于摘要生成、数据库查询、内容分类、实时客服等高并发低复杂度场景。
用大白话说= 不是让它当主力思考,而是当流水线上的快手——简单任务跑得快、跑得便宜。
实际案例:Cognition的Devin用Opus 5.5做主模型、Haiku 5.5做子Agent,FrontierCode得分66.2%,高于两个模型单独运行,同时降低了成本和延迟。金融AI公司Rogo则用它从10-K财报中批量提取分部营收数据。
05

开发者迁移要注意什么?

五处关键接口变动:`budget_tokens`须改为自适应思考+Effort档位;`temperature`、`top_p`、`top_k`参数须删除;assistant消息预填充功能取消;电脑操作工具须升级至`computer_toolset_20260801`;自适应思考默认开启,响应首个内容块可能是思考块,解析逻辑须按`type`字段过滤。
同等文本在新分词器下Token数量多约三成,`max_tokens`设置和成本预估都要重新算。
这意味着→ 不能简单换个模型名就上线,接口层和成本预算都得重新过一遍。
06

还有哪些同步动作?

Sonnet 5.5缓存读取价格从每百万Token 0.20美元降至0.10美元,官方估算多数Agent任务因此可降本约20%。
Max和Team订阅用户本周起可领取每月API额度:Max 5x 100美元、Max 20x 200美元、Team最多500美元(团队共享)。
Haiku 5.5已在Claude客户端、Claude Code及AWS、谷歌云、Azure、Cursor、OpenRouter等平台上线,上下文窗口100万Token,单次最多输出12.8万Token。Anthropic模型矩阵中仅剩Fable 5.5尚未发布。

市场有风险,内容仅供研究参考,不构成投资建议。