
AI 摘要
- Anthropic 推出新一代輕量級 AI 模型 Claude Haiku 5.5,平均執行成本降低 75%。
- 新模型首度加入推理強度控制功能,並在多項基準評測中取得顯著效能增長。
- 定價採階梯制收費,長提示詞情境下的實際成本優勢引發開發者討論。
人工智慧研發公司 Anthropic 於週三(10/7)正式發表新一代輕量級 AI 模型 Claude Haiku 5.5。該模型主打極低成本、快速回應能力,特別鎖定需要大量處理重複性工作負載的企業與開發者應用環境。Anthropic 官方指出,Claude Haiku 5.5 是目前該系列中執行速度最快且運算能力最強的模型,其平均執行成本相較前代大幅降低 75%,同時也是 Haiku 系列中首款支援彈性調整推理強度的產品。
定位輕量高頻任務,支援子代理人架構
在 Anthropic 的模型架構體系中,Haiku 定位為資源消耗最精簡的輕量系列,主要應用於文章摘要、資料分類、結構化資料庫查詢以及即時客服系統等情境。此外,在複雜的 AI Agent(代理人)架構中,Haiku 亦能與大型模型如 Sonnet 及 Opus 互相搭配,負責擔任執行特定小範圍任務的「子代理人」(Sub-agent),而高難度的複雜邏輯推理與多步驟程式開發則交由旗艦模型處理。

階梯式計費結構:短提示詞降幅達九成
Claude Haiku 5.5 最關鍵的調整在於 API 定價策略。新版採用以 10 萬 Token 為分界點的階梯定價:
- 提示詞 10 萬 Token 以內:每百萬輸入 Token 費用為 0.1 美元,輸出 Token 為 0.5 美元,相較 Haiku 4.5 降價幅度達 90%。
- 提示詞超過 10 萬 Token:每百萬輸入 Token 費用為 0.5 美元,輸出 Token 為 2.5 美元,較前代降幅為 50%。
Anthropic 統計數據顯示,前代 Haiku 約有 90% 的 API 請求落在 10 萬 Token 以內。在綜合考量實際 Token 消耗型態後,官方估算整體平均使用成本降低約 75%。

基準測試效能大幅提升,新增推理強度調節機制
在基準測試數據方面,Claude Haiku 5.5 展現了顯著的運算效能進展:
| 評測項目 | Claude Haiku 5.5 | 前代版本表現 |
|---|---|---|
| OSWorld 2.1(電腦操作能力) | 72.4% | 15.7% |
| GDPval-AA v2.1(知識工作評測) | 1,620 分 | 735 分 |
此外,新版本首度導入推理強度(Reasoning Effort)控制功能,提供 Low、Medium、High、Xhigh 及 Max 等五種調節設定,讓開發者能夠依據個別任務的複雜程度精準分配算力,進一步平衡運算延遲與營運成本。
業界實測回饋:長提示詞成本優勢受檢驗
儘管定價大幅調降,知名獨立開發者 Simon Willison 提出實測分析指出,在 10 萬 Token 以內的短文字情境中,Claude Haiku 5.5 的定價與競爭對手 OpenAI 的 GPT-6 Luna 相當;然而一旦輸入長度超過 10 萬 Token,Haiku 5.5 的計費單價將立刻跳升 5 倍,相較之下 Luna 的高階費率門檻則設在 27.2 萬 Token。此外,Willison 實測發現,在處理相同長文本時,Haiku 5.5 所消耗的 Token 數量相較前代增加了約 25%,這意味著使用者在特定長提示詞情境下的實際節省幅度可能低於官方標示的降幅。
生態系配套與雲端部署
除了發表新模型,Anthropic 亦宣布同步將 Sonnet 5.5 的快取讀取(Cache Read)費用調降 50%,預期可讓 AI 代理人工作流程的運作成本減少約 20%。同時,官方針對 Claude Max 與 Team 方案的企業訂閱用戶,提供每月 100 至 500 美元不等的 API 使用額度,以促進開發者生態圈的應用佈建。
目前 Claude Haiku 5.5 已經全面上線,開發者可透過 Claude Platform API 直接調用,或經由 AWS、Google Cloud 及 Microsoft Azure 等主流公有雲平臺取得模型服務。
Reference Link : ithome.com.tw




