Anthropic 在 2026年10月7日推出 Claude Haiku 5.5:歷來最便宜、最快、能力最強的小模型。平均運行成本比 Haiku 4.5 低約 75%,定位是高用量短任務與子代理。這篇整理官方發布重點,以及 Hacker News 上 322 則留言的爭論焦點。
互動圖解版可看這頁:https://derek-static.pages.dev/claude-haiku-55-explainer.html
一句話定位
Haiku 5.5 適合摘要、分類、compaction、資料庫查詢,以及掛在 Opus 5.5、Sonnet 5.5 底下當寫碼子代理。它也是 Anthropic 至今標準速度最快的模型,適合即時客服與瀏覽器操作。複雜的代理式寫碼,還是 Sonnet 5.5 與 Opus 5.5 的地盤。
效能:進步幅度很大,但要看對照組是誰
| 基準 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| OSWorld 2.1(離線子集) | 72.4% | 15.7% | 48.9% | 83.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 | 46.4% | — | 42.4% | 52.1% |
| Chartography | 46.4% | 6.4% | 29.1% | 61.6% |
相對 Haiku 4.5 是全面輾壓,但 Terminal-Bench 上 Sonnet 5.5 的 70.6% 仍遙遙領先。這正是官方自己畫的線:Haiku 負責範圍窄、過去成本過高的任務,大模型負責複雜推理。
Haiku 5.5 也是首個支援可調 effort 設定的 Haiku 級模型,可以在成本與智慧程度之間取捨。
定價:10 萬 token 的斷層
| 每 100 萬 token | Haiku 5.5(10 萬以內/超過) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 快取讀取 | $0.01/$0.05 | $0.10 | $0.10 |
| 輸入 | $0.10/$0.50 | $1.00 | $2.00 |
| 輸出 | $0.50/$2.50 | $5.00 | $10.00 |
10 萬 token 以內與 Luna 同價($0.10 輸入/$0.50 輸出),超過直接乘 5 倍。這是 HN 上吵最兇的一點:代理式工作很少低於 10 萬 token,有人直言官方圖表的價格要先乘 5 再看。而且這個斷點只適用 Haiku,Sonnet 與 Opus 沒有。
同期還有兩個異動:Sonnet 5.5 快取讀取從 $0.20 降到 $0.10,多數代理任務便宜約 20%;Max 5x 每月發 $100、Max 20x 發 $200、Team 合計最高 $500 的 API 額度,可用在任何模型。
HN 爭論一:每 token 便宜不等於每任務便宜
只看 token 價格,Haiku 贏;看每完成一個任務的成本,Luna 與 Sol 常反超。Luna 在分類任務因分詞與短輸出更便宜,Sol 的 medium 推理則更聰明。Haiku 唯一沒有爭議的優勢是速度:OpenRouter 均值每秒 93 token,Artificial Analysis 測到 137 以上。
「中國模型只要一折」的說法也被打臉:GLM-5.3 Flash 要 $0.15/百萬 token,Haiku 只要 $0.10,並沒有數量級差距。但便宜中模逼出這波價格戰,是多數人同意的事實。
HN 爭論二:Agent SDK 訂閱驚魂
說明文件一度暗示 claude -p 要移出訂閱制,引爆「從後門收費」的罵戰,官方員工兩度出面澄清沒有移除、文件已經修正。額度本身倒是受歡迎:終於能把訂閱用在自家 harness 上。
HN 爭論三:沒人手選 Haiku,但 Opus 會派單給它
實戰派的用法高度一致:commit 訊息、log 解析、文件解析、工單分類初篩。沒人主動選 Haiku,但 Opus 會自動把雜活丟給它。Rogo 的證言是最佳寫照:大模型負責做簡報,Haiku 子代理鑽進 10-K 把部門營收數字抓出來。Devin Fusion 以 Haiku 當助手,FrontierCode 守住 66.2 分,同時降低成本與延遲。
少數衰退回報也有:有人稱 5.5 在低延遲任務出現提示外洩又更慢。反方則認為 4.5 本來就弱,應該是提示詞該遷移,而非模型退步。
實務選擇
- 短雜活(摘要、分類、初篩、log 解析):Haiku 5.5,壓在 10 萬 token 內。
- 大模型底下的子代理:Haiku 5.5 配 Opus 或 Sonnet 編排。
- 複雜代理寫碼:Sonnet 5.5 或 Opus 5.5,順便吃到剛降價的快取讀取。
- 上下文動輒超過 10 萬的 agent:避開 Haiku 或重算帳,5 倍計價會吃掉所有紙面優勢。
出處
- 官方發布:https://www.anthropic.com/claude-haiku-5-5
- HN 討論串(647 分,322 則):https://news.ycombinator.com/item?id=49996437
- 模型研究筆記已收錄於個人 wiki
models/anthropic-claude-haiku-5-5.md
