Claude Haiku 5.5 上線,輸入價降到每百萬 token 0.10 美元
Anthropic · 2026-10-07
Claude 最小的一級模型 Haiku 換代,輸入價從 Haiku 4.5 的 $1.00 降到 $0.10/百萬 token,同時在電腦操作與推理類 benchmark 上大幅拉開與上一代的差距。模型 ID 為 claude-haiku-5-5,2026-10-07 起在 AWS、Google Cloud、Microsoft Azure 與 Claude Platform 上提供。
Anthropic 的說法是「平均而言,執行成本約少 75%」。這個數字是官方的平均值,實際省多少取決於你的輸入、輸出與快取比例。
原本的問題
高流量、對成本敏感的工作(分類、抽取、路由、子代理)通常會選 Haiku,但 Haiku 4.5 在需要操作介面或寫程式的任務上能力不足。官方表格中 Haiku 4.5 在 Terminal-Bench 4.0 為 0.0%,OSWorld 2.1 為 15.7%,這類工作只能升到 Sonnet,單價高出一個量級。
價格對照
Haiku 5.5 有兩段價格,以單次請求是否超過 100k token 區分。下表為每百萬 token 美元價(官方定價表):
| 項目 | Haiku 5.5(≤100k) | Haiku 5.5(>100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 輸入 | $0.10 | $0.50 | $1.00 | $2.00 |
| 輸出 | $0.50 | $2.50 | $5.00 | $10.00 |
| 快取讀取 | $0.01 | $0.05 | $0.10 | $0.10 |
| 快取寫入 | $0.125 | $0.625 | $1.25 | $2.50 |
長上下文那一段(>100k)的價格是短段的 5 倍,仍低於或等於 Haiku 4.5 的單一價。只要大部分請求在 100k 以內,輸入、輸出、快取四項都是 4.5 價格的十分之一。
能力變化
官方列出的 benchmark 中,Haiku 5.5 對 Haiku 4.5 的提升幅度很大,但仍落後 Sonnet 5.5:
| Benchmark | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 | GPT-6 Luna |
|---|---|---|---|---|
| OSWorld 2.1 | 72.4% | 15.7% | 83.9% | 48.9% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 70.6% | 16.4% |
| FrontierCode 1.1 | 46.4% | — | 52.1% | 42.4% |
| HLE(無工具) | 45.9% | 10.2% | 56.9% | — |
| HLE(有工具) | 57.4% | 18.7% | 64.5% | — |
幾個值得注意的位置:OSWorld 2.1 的 72.4% 距離 Sonnet 5.5 約 11.5 個百分點,但價格只有後者的五十分之一左右(輸入 $0.10 對 $2.00,以 ≤100k 計);Terminal-Bench 4.0 的差距則大得多(39.2% 對 70.6%),終端機代理類任務仍有明顯落差。官方表中的 GPT-6 Luna 在這幾項都低於 Haiku 5.5,但官方頁面未說明 Luna 的測試設定。
影響範圍
- 用 Haiku 4.5 跑大量呼叫的服務:把模型字串換成
claude-haiku-5-5即可評估,先用自己的 eval 比對輸出品質,再看帳單。 - 因為 Haiku 4.5 做不了 computer use 而改用 Sonnet 的流程:OSWorld 2.1 的數字顯示值得重測,成本可能大幅下降;Terminal-Bench 類的任務則要小心。
- 請求常超過 100k token 的應用:進入較高價格段,要重新試算,不能直接套用 10 倍便宜的印象。
- 用 Sonnet 5.5 且大量重複讀快取的人:官方同步把 Sonnet 5.5 的快取讀取價降了 50%,現為 $0.10/百萬 token。
其他同日更新
官方頁面同時提到 Max 與 Team 訂閱者有每月 $100 至 $500 的 API 額度,以及 SDK 加入 computer use 與 browser use 的 beta 支援。頁面未公布 context window、最大輸出長度與 Haiku 4.5 的停用時程,這些要查文件或等後續公告。