Cloudflare Clef 開源決策模型正式發佈!主打超低延遲判斷並整合 Workers AI

BlueSky

AI 摘要

  • Cloudflare 推出專為 AI 代理打造的開源決策模型 Clef 與 Clef-flash。
  • 新模型已整合至 Workers AI 並支援 64K 上下文長度與圖片輸入。
  • Clef-flash 中位延遲僅 38.8 毫秒,較 Jev 大幅縮短判斷時間。

雲端服務大廠 Cloudflare 正式發佈全新決策模型 Cloudflare Clef 與主打極速推論的 Clef-flash。兩款新模型專為 AI 代理(AI Agents)的高速分類、判斷與決策流程而設計,現已正式整合至 Cloudflare Workers AI 平台,並同步以 Apache 2.0 開源授權釋出模型權重,開發者可自由下載或於雲端直接部署。

定位清晰的決策模型:專注精準判斷而非文字生成

與傳統負責文字生成、長篇推理或工具操作的大型語言模型不同,Cloudflare Clef 專門處理範圍明確的判斷任務。開發者可預先設定一組可接受的答案選項,模型在讀取輸入資料後,直接針對預設答案計算分數與機率,並回傳指定格式的結果,完全省去逐步生成文字的時間。

例如在智慧客服場景中,系統收到用戶訊息後,可即時交由模型判斷案件是否緊急、指派至業務或技術團隊,以及評估問題嚴重程度,進而快速啟動後續工作流或轉由人工接手。

基礎架構與技術指標

Cloudflare Clef 支援文字與圖片多模態輸入,具備高達 64K 的上下文長度(Context Window)。在底層模型選擇上,Clef 與 Clef-flash 分別基於不同的開源模型進行深度決策訓練:

  • Cloudflare Clef:以 Qwen3.8-27B 為基礎訓練,兼顧精準度與決策能力。
  • Clef-flash:以 Qwen3.5-9B 為基礎打造,特別針對極致反應速度最佳化。

效能評測:推論延遲顯著降低

根據 Cloudflare 公布的 43 項基準評測數據,Clef 系列在推論延遲表現上展現強大優勢。相較於相容介面的競品 Jev,Clef 系列大幅壓縮了決策時間:

模型名稱基礎模型上下文長度中位延遲 (Median Latency)授權方式
Cloudflare ClefQwen3.8-27B64K209.3 毫秒Apache 2.0
Clef-flashQwen3.5-9B64K38.8 毫秒Apache 2.0
Jev––524.1 毫秒–

測試顯示,Clef-flash 的中位延遲僅需 38.8 毫秒,Cloudflare Clef 則為 209.3 毫秒,兩者皆大幅超越 Jev 的 524.1 毫秒。不過官方也指出,各模型在特定測試項目的準確度互有領先,Jev 在部分特定指標仍保有優勢。

推出管道與微調服務

Cloudflare Clef 採用與 Jev 相容的 API 介面,讓現有應用程式能無縫銜接換用。目前開發者可透過 Cloudflare Workers AI 直接調用,或至 Hugging Face 下載開源權重自行部署。此外,Cloudflare 已同步推出由官方工程團隊協助的客製化微調服務,未來亦規劃上線自助式微調平臺,讓企業自主訓練專屬決策模型。

Reference Link : ithome.com.tw

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles