Anthropic 推出 Claude Sonnet 5:性能逼近 Opus 4.8,輸入每百萬 Token 最低 2 美元

Anthropic 推出新一代中階模型 Claude Sonnet 5,定位為兼具性能與成本效益的代理式 AI 模型。在恢復 Claude Fable 5 模型使用之前,Anthropic 先行發布 Claude Sonnet 5,並自週二起將其設為免費版與 Claude Pro 方案的預設模型。

Claude Sonnet 5 可供 Anthropic 所有訂閱方案使用,涵蓋 Claude Max、Team 與 Enterprise 用戶,同時支援 Claude Code 及 Claude 平台。開發者也能透過 Claude API,以 claude-sonnet-5 模型識別名稱呼叫該模型。

代理式編碼表現較 Sonnet 4.6 提升

Anthropic 表示,Claude Sonnet 5 在推理、工具使用、編碼與知識工作等代理式 AI 能力方面,相較前代 Claude Sonnet 4.6 有實質改進。基準測試顯示,Claude Sonnet 5 在代理式編碼項目的得分為 63.2%,高於 Claude Sonnet 4.6 的 58.1%,但仍低於 Claude Opus 4.8 的 69.2%。

模型代理式編碼基準測試
Claude Sonnet 563.2%
Claude Opus 4.869.2%
Claude Sonnet 4.658.1%

在知識工作基準測試中,Anthropic 表示 Claude Sonnet 5 的表現甚至略勝 Claude Opus 4.8。不過,官方仍指出,若使用者追求更高的整體準確度,Claude Opus 4.8 依然是首選。

Anthropic:可在性能與成本之間調整

Anthropic 在官方部落格文章中表示:「若要追求更高的準確度,Claude Opus 4.8 仍是首選模型。然而 Claude Sonnet 5 為開發者提供價格較低、且品質遠較以往可用選項更高的選擇。」

該公司並指出,使用者可以在 Claude Sonnet 5 與 Claude Opus 4.8 之間,依需求調整投入的努力程度,以尋找性能與成本之間的平衡點。這項定位顯示,Claude Sonnet 5 主要面向需要長時間執行推理、工具操作與程式開發工作的代理式 AI 應用。

限時價格與正式計費方式

Claude Sonnet 5 在 8 月 31 日之前採用優惠價格,每百萬個輸入 token 收費 2 美元,每百萬個輸出 token 收費 10 美元。優惠期結束後,價格將調整為每百萬個輸入 token 3 美元,以及每百萬個輸出 token 15 美元。

計費項目8 月 31 日前優惠價之後價格
每百萬個輸入 token2 美元3 美元
每百萬個輸出 token10 美元15 美元

安全評估結果

Anthropic 表示,內部安全評估發現,Claude Sonnet 5 的不良行為發生率低於 Claude Sonnet 4.6,因此在代理式 AI 環境中的使用通常更安全。不過,現有資訊未提供評估方法、具體測試數據或不良行為的定義,相關結果仍需配合更完整的技術報告解讀。

整體而言,Claude Sonnet 5 的產品定位介於成本較低的中階模型與性能更高的 Opus 系列之間。其代理式編碼表現已明顯超越前代,知識工作測試則略勝 Claude Opus 4.8,但在追求最高準確度的使用情境中,Anthropic 仍將 Opus 4.8 視為較適合的選擇。

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles