Anthropic發布Claude Haiku 5.5,價格較上代降九成

nashnova research
今天发布阅读约 5 分钟

Anthropic正式發布Claude Haiku 5.5,標稱定價較上代降約九成,但實際節省約75%——新分詞器多耗三成Token、長上下文僅降價一半是主因。跑分大幅領先同價位對手,但複雜編程仍明顯遜於自家Sonnet 5.5,定位是高併發、低複雜度的執行層模型。

01

標稱降九成,實際省多少?

短上下文定價:輸入0.10美元/百萬Token、輸出0.50美元/百萬Token,是上代Haiku 4.5的十分之一,也是Sonnet 5.5的二十分之一。
但官方自己測算,同等任務實際節省約75%,未達標稱九成。這意味著→ 有兩個隱藏成本在蠶食差價:①超10萬Token的請求只降了一半;②新分詞器令同樣的文本多消耗約三成Token。
簡單來說= 如果你的調用都在10萬Token以內,慳錢效果接近宣傳;一旦上下文變長,折扣就大幅縮水。
02

和GPT-6 Luna比,邊個更抵?

10萬Token以內,Haiku 5.5與GPT-6 Luna價格完全一樣。
長上下文場景下Luna更平:Luna到約27萬Token才加價,加後輸入0.20美元、輸出0.75美元;Haiku 5.5超過10萬Token就按輸入0.50美元、輸出2.50美元計算。
這意味著→ 如果應用場景以長文檔處理為主,Luna的長上下文成本優勢明顯;短調用場景下兩者無差。
03

跑分領先同價位,但天花板在哪?

OSWorld 2.1(測試AI操控真實電腦完成多步任務):Haiku 5.5 Max檔72.4%,同價位Luna 48.9%,上代Haiku 4.5僅15.7%——代際躍升極大。
終端編程Terminal-Bench 4.0:Haiku 5.5得39.2%,Luna 16.4%,但Sonnet 5.5達70.6%。這反映出複雜編程仍是大模型與小模型的核心分界線。
知識工作GDPval-AA:Haiku 5.5拿下1620分,Luna 1437分,Sonnet 5.5 1840分。Anthropic官方亦明確建議:複雜Agent編程仍應優先用Sonnet 5.5或Opus 5.5。
04

它適合做甚麼?

Anthropic將Haiku 5.5定位為「量大、要快、要慳錢」的執行層模型,適用於摘要生成、數據庫查詢、內容分類、實時客服等高併發低複雜度場景。
簡單來說= 不是讓它當主力思考,而是當流水線上的快手——簡單任務跑得快、跑得平。
實際案例:Cognition旗下Devin用Opus 5.5做主模型、Haiku 5.5做子Agent,FrontierCode得分66.2%,高於兩個模型各自單獨運行,同時降低了成本與延遲。金融AI公司Rogo則用它從10-K財報中批量提取分部營收數據。
05

開發者遷移要注意甚麼?

五處關鍵接口變動:`budget_tokens`須改為自適應思考加Effort檔位;`temperature`、`top_p`、`top_k`參數須刪除;assistant消息預填充功能取消;電腦操作工具須升級至`computer_toolset_20260801`;自適應思考默認開啟,響應首個內容塊可能是思考塊,解析邏輯須按`type`欄位過濾。
同等文本在新分詞器下Token數量多約三成,`max_tokens`設置和成本預估都要重新計算。
這意味著→ 不能簡單換個模型名就上線,接口層和成本預算都要重新過一遍。
06

還有哪些同步動作?

Sonnet 5.5緩存讀取價格從每百萬Token 0.20美元降至0.10美元,官方估算多數Agent任務因此可降本約20%。
Max和Team訂閱用戶本週起可領取每月API額度:Max 5x 100美元、Max 20x 200美元、Team最多500美元(團隊共享)。
Haiku 5.5已在Claude客戶端、Claude Code及AWS、谷歌雲、Azure、Cursor、OpenRouter等平台上線,上下文窗口100萬Token,單次最多輸出12.8萬Token。Anthropic模型矩陣中僅剩Fable 5.5尚未發布。

市场有风险,内容仅供研究参考,不构成投资建议。