Anthropic 發布 Haiku 5.5,執行成本比前代低約 75%
Anthropic 10 月 7 日發布 Claude Haiku 5.5,稱是公司至今最便宜、最快、能力最強的小模型,平均執行成本比 Haiku 4.5 低約 75%。Anthropic 同時把 Sonnet 5.5 的快取讀取價格砍半,並將為 Max 與 Team 訂閱用戶每月提供 API 額度。
Haiku 5.5 鎖定大量且對成本敏感的工作,例如摘要、壓縮上下文、資料庫查詢與分類,也適合在 Opus 5.5 或 Sonnet 5.5 處理程式任務時擔任子代理。它也是 Anthropic 目前速度最快的模型,官方建議用在即時客服與瀏覽器操作這類講求速度的任務。這也是第一款可以調整運算投入程度(effort)的 Haiku 模型,使用者能在成本與能力之間取捨。
提示 10 萬 token 以內,輸入每百萬 token 0.1 美元
Haiku 5.5 採分段定價。提示在 10 萬 token 以內時,每百萬 token 輸入 0.1 美元、輸出 0.5 美元,快取讀取 0.01 美元,都只有 Haiku 4.5 的十分之一;超過 10 萬 token 時,輸入與輸出分別是 0.5 美元和 2.5 美元。Anthropic 指出,送到前一代 Haiku 的請求約九成都在 10 萬 token 以內。
Terminal-Bench 4.0 從 0% 升至 39.2%,仍落後 Sonnet 5.5
根據 Anthropic 公布的跑分,Haiku 5.5 在電腦操作測試 OSWorld 2.1 拿下 72.4%,Haiku 4.5 只有 15.7%,OpenAI 的 GPT-6 Luna 為 48.9%。程式代理測試 Terminal-Bench 4.0 則從 Haiku 4.5 的 0% 升至 39.2%,高於 GPT-6 Luna 的 16.4%,但和 Sonnet 5.5 的 70.6% 仍有差距。Anthropic 也說,複雜的程式代理任務還是 Sonnet 5.5 與 Opus 5.5 比較適合,Haiku 5.5 適合範圍明確、過去用 Claude 成本太高而做不起來的工作。
資安防護方面,Haiku 5.5 比 Haiku 4.5 嚴格,但比近期其他模型寬鬆,允許的防禦性資安工作比 Sonnet 5.5 更多,仍會擋下滲透測試等較可能被攻擊者使用的手法。需要更大權限的機構可以申請 Anthropic 本週稍早擴大的資安驗證計畫。
Sonnet 5.5 快取讀取降至 0.1 美元,Max 用戶每月送 API 額度
Anthropic 同步把 9 月底上線的 Sonnet 5.5 快取讀取價格,從每百萬 token 0.2 美元降到 0.1 美元。由於快取讀取占模型 token 用量的很大一部分,官方估計多數代理任務的成本會因此降低約 20%。
Max 與 Team 訂閱用戶本週也會開始獲得每月 API 額度,可在 Claude Platform 上用於任何模型:Max 5x 每月 100 美元、Max 20x 每月 200 美元,Team 方案最多 500 美元,由團隊成員共用。Anthropic 另外更新 Python 與 TypeScript SDK,以測試版支援電腦操作與瀏覽器操作。Haiku 5.5 已在 Claude Platform 以及 AWS、Google Cloud、Microsoft Azure 上線。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。




