Anthropic 認證:智譜GLM-5.3 開源網安能力落後美國先進模型約 4 個月

BlueSky

AI 摘要

  • Anthropic 紅隊發布智譜GLM-5.3 的網安評估報告。
  • 智譜GLM-5.3 的網安能力落後美國先進模型約 4 個月。
  • 智譜GLM-5.3 發布一個月已有約 100 家安全企業接入。

Anthropic 前沿紅隊發布對智譜GLM-5.3 的網路安全評估報告,指出這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經 NIST 下屬 CAISI 獨立評估,落後美國先進模型約 4 個月,被視為中國開源大模型的「對手認證」。這也讓智譜GLM-5.3 的網安能力、開放權重安全與產品定位成為新焦點。

產品定位:中國開源大模型的網安能力代表

智譜GLM-5.3 是來源所述的開放權重模型,Anthropic 前沿紅隊的評估聚焦其網路安全能力。來源稱其被視為中國開源大模型的「對手認證」,目標用戶包括安全企業、紅隊演練與防禦審計相關團隊。來源提到智譜GLM-5.3 發布一個月已有約 100 家安全企業接入。

主要功能與技術指標

  • 端到端漏洞利用:報告以 ExploitBench 測試 Chrome V8 已知漏洞,智譜GLM-5.3 在 410 次嘗試中完成 50 次端對端利用。
  • 控制流劫持:內部二進制利用基準中,智譜GLM-5.3 約 4% 任務達成完整控制流劫持,上代門檻模型接近 0。
  • 未知漏洞發現:紅隊用智譜GLM-5.3 在某主流瀏覽器 JavaScript 引擎中發現多個未知漏洞,並串聯成可讀取本地文件、SSH 私鑰的攻擊鏈。
  • 低成本實測:以小號 GLM-5.3-Flash 組合公開缺陷,人工約 20 分鐘、模型自主運行約 8 小時、API 要價 0.4 美元,即在 ARM64 環境產出可用。

與 Claude Mythos Preview 及上代模型比較

模型基準結果
智譜GLM-5.3ExploitBench 測試 Chrome V8 已知漏洞410 次嘗試中完成 50 次端對端利用
Claude Mythos PreviewExploitBench 測試 Chrome V8 已知漏洞完成 56 次端對端利用
智譜GLM-5.3內部二進制利用基準約 4% 任務達成完整控制流劫持
上代門檻模型內部二進制利用基準接近 0

來源指出,智譜GLM-5.3 的 ExploitBench 結果接近 Anthropic 自家 Claude Mythos Preview;在內部二進制利用基準中,智譜GLM-5.3 約 4% 任務達成完整控制流劫持,而上代門檻模型接近 0。所有測試均在隔離沙箱、無外網環境下進行。

實戰驗證與護欄風險

紅隊用智譜GLM-5.3 在某主流瀏覽器 JavaScript 引擎中發現多個未知漏洞,串聯成可讀取本地文件、SSH 私鑰的攻擊鏈。來源還提到,以小號 GLM-5.3-Flash 組合公開缺陷,人工約 20 分鐘、模型自主運行約 8 小時、API 要價 0.4 美元,即在 ARM64 環境產出可用。

報告警告護欄薄弱:直接惡意指令會拒絕,但偽裝紅隊演練可 64% 接單,修改開放權重去除拒絕機制可達 100%。

售價、推出與安全加固

來源未提供正式產品售價或確切推出日期;但在 GLM-5.3-Flash 組合公開缺陷的實測情境中,提到 API 要價 0.4 美元。智譜曾設 API 攔截等三層安全,延後兩週開放下載加固,並強調開放權重下模型對齊最關鍵。來源稱智譜GLM-5.3 發布一個月已有約 100 家安全企業接入。

業界與監管影響

業界人士認為,開放權重降低攻防門檻,也利好防禦審計;監管料將強化發布前紅隊測試、漏洞揭露與商用審查。

Reference Link : news.cnyes.com

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles