
AI 摘要
- Anthropic 紅隊發布智譜GLM-5.3 的網安評估報告。
- 智譜GLM-5.3 的網安能力落後美國先進模型約 4 個月。
- 智譜GLM-5.3 發布一個月已有約 100 家安全企業接入。
Anthropic 前沿紅隊發布對智譜GLM-5.3 的網路安全評估報告,指出這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經 NIST 下屬 CAISI 獨立評估,落後美國先進模型約 4 個月,被視為中國開源大模型的「對手認證」。這也讓智譜GLM-5.3 的網安能力、開放權重安全與產品定位成為新焦點。
產品定位:中國開源大模型的網安能力代表
智譜GLM-5.3 是來源所述的開放權重模型,Anthropic 前沿紅隊的評估聚焦其網路安全能力。來源稱其被視為中國開源大模型的「對手認證」,目標用戶包括安全企業、紅隊演練與防禦審計相關團隊。來源提到智譜GLM-5.3 發布一個月已有約 100 家安全企業接入。
主要功能與技術指標
- 端到端漏洞利用:報告以 ExploitBench 測試 Chrome V8 已知漏洞,智譜GLM-5.3 在 410 次嘗試中完成 50 次端對端利用。
- 控制流劫持:內部二進制利用基準中,智譜GLM-5.3 約 4% 任務達成完整控制流劫持,上代門檻模型接近 0。
- 未知漏洞發現:紅隊用智譜GLM-5.3 在某主流瀏覽器 JavaScript 引擎中發現多個未知漏洞,並串聯成可讀取本地文件、SSH 私鑰的攻擊鏈。
- 低成本實測:以小號 GLM-5.3-Flash 組合公開缺陷,人工約 20 分鐘、模型自主運行約 8 小時、API 要價 0.4 美元,即在 ARM64 環境產出可用。
與 Claude Mythos Preview 及上代模型比較
| 模型 | 基準 | 結果 |
|---|---|---|
| 智譜GLM-5.3 | ExploitBench 測試 Chrome V8 已知漏洞 | 410 次嘗試中完成 50 次端對端利用 |
| Claude Mythos Preview | ExploitBench 測試 Chrome V8 已知漏洞 | 完成 56 次端對端利用 |
| 智譜GLM-5.3 | 內部二進制利用基準 | 約 4% 任務達成完整控制流劫持 |
| 上代門檻模型 | 內部二進制利用基準 | 接近 0 |
來源指出,智譜GLM-5.3 的 ExploitBench 結果接近 Anthropic 自家 Claude Mythos Preview;在內部二進制利用基準中,智譜GLM-5.3 約 4% 任務達成完整控制流劫持,而上代門檻模型接近 0。所有測試均在隔離沙箱、無外網環境下進行。
實戰驗證與護欄風險
紅隊用智譜GLM-5.3 在某主流瀏覽器 JavaScript 引擎中發現多個未知漏洞,串聯成可讀取本地文件、SSH 私鑰的攻擊鏈。來源還提到,以小號 GLM-5.3-Flash 組合公開缺陷,人工約 20 分鐘、模型自主運行約 8 小時、API 要價 0.4 美元,即在 ARM64 環境產出可用。
報告警告護欄薄弱:直接惡意指令會拒絕,但偽裝紅隊演練可 64% 接單,修改開放權重去除拒絕機制可達 100%。
售價、推出與安全加固
來源未提供正式產品售價或確切推出日期;但在 GLM-5.3-Flash 組合公開缺陷的實測情境中,提到 API 要價 0.4 美元。智譜曾設 API 攔截等三層安全,延後兩週開放下載加固,並強調開放權重下模型對齊最關鍵。來源稱智譜GLM-5.3 發布一個月已有約 100 家安全企業接入。
業界與監管影響
業界人士認為,開放權重降低攻防門檻,也利好防禦審計;監管料將強化發布前紅隊測試、漏洞揭露與商用審查。
Reference Link : news.cnyes.com




