OpenAI 揭露蒸餾行動,Moonshot Kimi K3 開放權重模型再受關注

BlueSky

AI 摘要

  • OpenAI 揭露並阻止一項協調式模型蒸餾行動。
  • OpenAI 將其中一個核心活動集群歸因於與 Moonshot AI 有關的人士。
  • Moonshot Kimi K3 是 Moonshot AI 於 7 月推出的開放權重模型。

Moonshot AI 的 Moonshot Kimi K3 於 7 月推出,採用 2.8 兆參數架構,是中國 AI 產業目前規模最大的開放權重模型之一。這款模型原本以開放權重與雲端合作布局受到市場關注,但 OpenAI 週三揭露一起協調式模型蒸餾行動,並將其中一個核心活動集群歸因於與 Moonshot AI 有關的人士,讓 Moonshot Kimi K3 再次成為美中 AI 競爭與模型安全議題的焦點。

產品定位與推出時程

Moonshot Kimi K3 於 7 月推出,屬於 Moonshot AI 的 Kimi 系列模型。來源指出,Moonshot Kimi K3 為開放權重模型,使用者可以下載及修改;不過 2.8 兆參數模型需要龐大運算資源,因此大型雲端業者仍是 Moonshot 拓展企業客戶的重要渠道。

Moonshot 在 5 月完成超過 20 億美元融資,當時市場消息稱公司正準備潛在的香港上市計畫。

規格與技術指標

  • 推出時間:7 月。
  • 架構:2.8 兆參數。
  • 模型類型:開放權重模型,使用者可下載及修改。
  • 規模定位:目前中國 AI 產業規模最大的開放權重模型之一。
  • 運算需求:2.8 兆參數模型需要龐大運算資源。

雲端合作與商業布局

Reuters 8 月報導指出,Moonshot 正與 Microsoft (MSFT-US)、Amazon (AMZN-US) 及 Alphabet 旗下 Google (GOOGL-US) 洽談 Moonshot Kimi K3 相關服務的營收分成,希望這些美國雲端業者協助託管 Moonshot Kimi K3。消息人士當時表示,Moonshot 尋求從 Azure、AWS 及 Google Cloud 上的 Moonshot Kimi K3 相關服務取得最高 30% 的營收分成,但相關談判仍處於早期階段,最終是否達成協議尚無定論。

蒸餾爭議與業界指控

OpenAI 表示,最早在 7 月 1 日觀察到相關活動,初期規模不大,但 7 月 24 日及 25 日出現大幅激增,短短兩天內就有超過 4,000 名使用者發出 1.6 萬次相關請求。進一步調查後,OpenAI 在超過 1.5 萬名使用者組成的活動集群中發現相關提示模式,並在 7 月 28 日前完成阻斷。

OpenAI 將這類行動稱為「對抗式蒸餾」(adversarial distillation),意思是系統性利用一個 AI 模型的輸出或推理內容,協助訓練、複製或改善另一個模型。OpenAI 指出,相關人士並未破解公司的加密系統,也沒有入侵資料庫或直接取得使用者儲存的對話內容;操作者是透過操弄模型互動方式,試圖讓原本不會直接呈現給使用者的隱藏推理內容,以可讀形式重新產生。有些方法甚至涉及將一段加密的推理內容從一個對話複製到另一個對話,再要求模型解密並轉錄其中內容。

OpenAI 表示,無法確認觀察期間所有操作者都來自同一個行動者,但經過分析後,公司將其中一個核心活動集群歸因於與 Moonshot AI 有關的人士。Moonshot AI 截至目前沒有立即回應 CNBC 的置評要求。

Moonshot AI 則曾否認 Moonshot Kimi K3 的性能來自蒸餾。Reuters 8 月報導指出,Moonshot 當時表示 Moonshot Kimi K3 的性能提升來自底層架構的原創修改,而非透過模型蒸餾取得。

Anthropic 報告與同類事件比較

這起事件也發生在 AI 模型蒸餾爭議持續升溫之際。Anthropic 今年 9 月公布威脅情報報告,指出其 Claude 模型遭到多個中國 AI 業者的大規模蒸餾活動利用。Anthropic 稱,其調查發現 5 項不同的蒸餾行動,合計涉及近 2 億次模型互動,其中包括歸因於阿里巴巴集團 (BABA-US) 的一項行動。

Anthropic 表示,涉及阿里巴巴的活動是其觀察到規模最大的批量模型蒸餾行動,2026 年 5 月至 7 月間約有 1.51 億次互動,高峰期間單日接近 300 萬次,涉及約 3,500 個帳戶。Anthropic 認為,這些互動使用固定提示詞萃取 Claude 的推理內容,目的是建立可用於訓練阿里巴巴 Qwen 系列模型的資料。

Anthropic 同時指稱,另一項與 Moonshot AI 有關的活動在 10 天期間透過約 5,000 個帳戶向 Claude 發出近 30 萬次請求,主要鎖定 Claude Opus 模型。Anthropic 報告稱,部分請求疑似直接透過中國軍方相關網路路由。這些內容屬於 Anthropic 對其調查結果的描述,並非獨立確認的司法認定。

項目 OpenAI 揭露行動 Anthropic 報告:阿里巴巴相關行動 Anthropic 報告:Moonshot AI 相關行動
觀察或報告期間 7 月 1 日觀察到,7 月 24 日至 25 日激增,7 月 28 日前阻斷 2026 年 5 月至 7 月 10 天期間
規模 超過 1.5 萬名使用者的活動集群;兩天內超過 4,000 名使用者發出 1.6 萬次請求 5 項行動合計近 2 億次互動;其中阿里巴巴相關行動約 1.51 億次互動,高峰單日接近 300 萬次,約 3,500 個帳戶 約 5,000 個帳戶發出近 30 萬次請求
主要目標 萃取受保護的推理過程 建立可用於訓練阿里巴巴 Qwen 系列模型的資料 主要鎖定 Claude Opus 模型
歸因或關聯 其中一個核心活動集群歸因於與 Moonshot AI 有關的人士 歸因於阿里巴巴集團 與 Moonshot AI 有關

OpenAI 的防護與阻斷措施

  • 封鎖或限制涉及欺詐的帳戶。
  • 強化註冊與基礎設施控制。
  • 擴大對相關網路活動的監控。
  • 加強隱藏推理內容的防護。
  • 關閉一條可讓已取得其他使用者加密推理內容的人員重新播放並恢復內容的途徑。
  • 增加對可能暴露模型推理內容的串流輸出的偵測機制。

OpenAI 認為,隨著前沿 AI 模型能力提高,對抗式蒸餾活動可能變得更加複雜,因為利用蒸餾可以用較低成本模仿先進模型的部分能力。公司表示,未來將持續強化模型內容萃取防護、協調式活動偵測及帳戶執法,並與產業及政府機構進行更多威脅情報共享。

產業影響

此次事件凸顯中國 AI 業者與美國前沿模型公司的競爭已延伸至模型能力取得與複製方式。Moonshot 在 Moonshot Kimi K3 推出後持續拓展雲端合作,同時面臨美國 AI 業者對模型蒸餾的指控;OpenAI 及 Anthropic 則相繼公布相關調查結果。對整個 AI 產業而言,如何在開放模型、API 服務及模型能力分享之間建立防止未授權蒸餾的技術與商業防線,正成為新的安全議題。

Reference Link : news.cnyes.com

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles