
AI 摘要
- Anthropic發布第四份AI濫用威脅報告。
- 報告點名7家中國AI業者蒸餾Claude模型。
- Anthropic表示相關業者曾以多種管道存取Claude。
Anthropic本週公布第四份AI濫用威脅報告,整理外界濫用Claude模型的多種方式,涵蓋網路攻擊、資訊操弄、AI輔助監控、傳統武器開發、生物濫用、詐騙與詐欺,以及未經授權的模型蒸餾。報告並點名7家中國AI業者,指稱其曾以不同方式大量取得Claude的對話與輸出,用於訓練自家模型或相關服務。
被Anthropic點名的業者包括阿里巴巴旗下Qwen、月之暗面(Moonshot)、DeepSeek、智譜(Z.ai)、小米、商湯及MiniMax。上述內容屬Anthropic在報告中提出的調查結果與指控,來源未提供遭點名業者的回應。
Anthropic持續追蹤模型濫用
Anthropic表示,自去年3月起,便不定期發布Claude遭濫用的調查報告;上一次報告於2025年11月公布,本次是第四份調查報告。
根據Anthropic說法,其系統會在背景自動執行多種分類器,用於監控特定類型的有害行為,而不是由人工逐一翻閱對話內容。當系統偵測到疑似違規活動後,Anthropic會展開調查;若確認帳戶涉及濫用,便可能封鎖帳戶、強化防護機制、部署額外監控,並與合作夥伴分享相關情報。
Anthropic今年2月已公開指控包括DeepSeek在內的中國AI業者,透過大量詐欺帳戶蒸餾Claude的能力。不過,這份最新報告稱,即使部分帳戶遭到發現與封鎖,相關業者仍未停止存取與蒸餾活動。
報告列出的蒸餾活動
模型蒸餾通常是先讓能力較強的大型模型針對大量輸入產生回應,再利用這些對話資料訓練規模較小的模型。Anthropic所稱的非法蒸餾,則是指未獲原模型所有者授權,大量萃取特定模型能力的行為。
| 業者 | Anthropic報告描述的活動 |
|---|---|
| Qwen | 在5月至7月間使用超過3,500個詐欺帳戶,與Claude進行超過1.5億次對話,單日對話量峰值接近300萬次。 |
| 月之暗面(Moonshot) | 在5月至7月間使用超過5,300個詐欺帳戶,與Claude進行2,300萬次對話;另在10天內將接近30萬個原本應送往自家Kimi模型的客戶請求轉交Claude,再以Kimi角色回覆。 |
| DeepSeek | 在14天內與Claude進行1,210萬次對話。 |
| 智譜(Z.ai) | 在10天內透過超過270個詐欺帳戶,與Claude進行約77萬次對話。 |
| 小米 | 在20天內使用1,500個帳戶,與Claude進行約40萬次對話。 |
| 商湯 | 向第三方資料商購買對話紀錄。 |
| MiniMax | 成立空殼公司,以新公司名義代理Claude及ChatGPT服務,且僅代理這兩個模型,以蒐集使用者與模型的對話資料,供訓練自家模型使用。 |
業者如何繞過地區存取限制
Anthropic表示,由於公司已封鎖來自中國地區的存取,被點名的業者便透過多種管道取得Claude服務,包括使用假身分或遭竊信用卡與API金鑰大量建立帳戶、採用商用VPN或代理伺服器、盜用合法客戶的API金鑰、透過第三方模型路由服務,以及利用境外公司繞道存取。
報告指出,Anthropic會觀察異常活動量、時區與連線地區不一致等訊號,並據此識別背後組織及採取後續措施。這些防護手段反映出,模型供應商面對的風險已不只限於單一使用者濫用,也包括以大規模帳戶、代理服務與資料收集管道進行的系統性存取。
影響與仍待釐清之處
Anthropic公布的數據顯示,模型蒸餾可能涉及大量自動化對話、帳戶建立與跨服務資料轉送。若相關指控成立,這類行為可能使模型供應商面臨運算資源遭大量消耗、服務存取控制失效,以及模型能力被未授權轉移等問題。
不過,目前來源提供的資訊主要來自Anthropic自身調查報告,尚未包含遭點名業者對個別數字、帳戶來源或資料用途的公開說明。因此,報告中的活動規模與行為描述,仍應視為Anthropic提出的調查結果與指控。
Reference Link : ithome.com.tw




