AI 前沿 2026 年 10 月 8 日

2026-10-08 — Claude Haiku 5.5 上線,輸入價降到每百萬 token 0.10 美元

primary=https://www.anthropic.com/claude-haiku-5-5

Claude Haiku 5.5 上線,輸入價降到每百萬 token 0.10 美元

Anthropic · 2026-10-07

Claude 最小的一級模型 Haiku 換代,輸入價從 Haiku 4.5 的 $1.00 降到 $0.10/百萬 token,同時在電腦操作與推理類 benchmark 上大幅拉開與上一代的差距。模型 ID 為 claude-haiku-5-5,2026-10-07 起在 AWS、Google Cloud、Microsoft Azure 與 Claude Platform 上提供。

Anthropic 的說法是「平均而言,執行成本約少 75%」。這個數字是官方的平均值,實際省多少取決於你的輸入、輸出與快取比例。

原本的問題

高流量、對成本敏感的工作(分類、抽取、路由、子代理)通常會選 Haiku,但 Haiku 4.5 在需要操作介面或寫程式的任務上能力不足。官方表格中 Haiku 4.5 在 Terminal-Bench 4.0 為 0.0%,OSWorld 2.1 為 15.7%,這類工作只能升到 Sonnet,單價高出一個量級。

價格對照

Haiku 5.5 有兩段價格,以單次請求是否超過 100k token 區分。下表為每百萬 token 美元價(官方定價表):

項目Haiku 5.5(≤100k)Haiku 5.5(>100k)Haiku 4.5Sonnet 5.5
輸入$0.10$0.50$1.00$2.00
輸出$0.50$2.50$5.00$10.00
快取讀取$0.01$0.05$0.10$0.10
快取寫入$0.125$0.625$1.25$2.50

長上下文那一段(>100k)的價格是短段的 5 倍,仍低於或等於 Haiku 4.5 的單一價。只要大部分請求在 100k 以內,輸入、輸出、快取四項都是 4.5 價格的十分之一。

能力變化

官方列出的 benchmark 中,Haiku 5.5 對 Haiku 4.5 的提升幅度很大,但仍落後 Sonnet 5.5:

BenchmarkHaiku 5.5Haiku 4.5Sonnet 5.5GPT-6 Luna
OSWorld 2.172.4%15.7%83.9%48.9%
Terminal-Bench 4.039.2%0.0%70.6%16.4%
FrontierCode 1.146.4%—52.1%42.4%
HLE(無工具)45.9%10.2%56.9%—
HLE(有工具)57.4%18.7%64.5%—

幾個值得注意的位置:OSWorld 2.1 的 72.4% 距離 Sonnet 5.5 約 11.5 個百分點,但價格只有後者的五十分之一左右(輸入 $0.10 對 $2.00,以 ≤100k 計);Terminal-Bench 4.0 的差距則大得多(39.2% 對 70.6%),終端機代理類任務仍有明顯落差。官方表中的 GPT-6 Luna 在這幾項都低於 Haiku 5.5,但官方頁面未說明 Luna 的測試設定。

影響範圍

  • 用 Haiku 4.5 跑大量呼叫的服務:把模型字串換成 claude-haiku-5-5 即可評估,先用自己的 eval 比對輸出品質,再看帳單。
  • 因為 Haiku 4.5 做不了 computer use 而改用 Sonnet 的流程:OSWorld 2.1 的數字顯示值得重測,成本可能大幅下降;Terminal-Bench 類的任務則要小心。
  • 請求常超過 100k token 的應用:進入較高價格段,要重新試算,不能直接套用 10 倍便宜的印象。
  • 用 Sonnet 5.5 且大量重複讀快取的人:官方同步把 Sonnet 5.5 的快取讀取價降了 50%,現為 $0.10/百萬 token。

其他同日更新

官方頁面同時提到 Max 與 Team 訂閱者有每月 $100 至 $500 的 API 額度,以及 SDK 加入 computer use 與 browser use 的 beta 支援。頁面未公布 context window、最大輸出長度與 Haiku 4.5 的停用時程,這些要查文件或等後續公告。

原始來源:Anthropic:Introducing Claude Haiku 5.5


End of article
0
Would love your thoughts, please comment.x
()
x