阿里巴巴發布2.4兆參數旗艦模型 Qwen3.8-Max 下週開放權重

阿里巴巴週一(8月3日)發布新一代旗艦人工智慧模型 Qwen3.8-Max。官方表示,該模型總參數量達2.4兆,是目前規模最大、能力最強的 Qwen 系列模型。Qwen3.8-Max 現已透過千問 AI 平臺及阿里雲百鍊提供 API 服務,模型權重則預計於下週開放。

這將是 Qwen 系列首款開放權重的 Max 等級旗艦模型。權重開放後,開發者可自行部署及調整模型,但阿里巴巴目前尚未公布相關授權條款與硬體需求。

採用 MoE 架構,降低實際運算負擔

Qwen3.8-Max 以 Qwen3.5 架構為基礎,採用稀疏混合專家(Mixture of Experts,MoE)架構及混合注意力機制。雖然模型總參數量達2.4兆,但每次處理任務時僅啟用約950億個參數,藉此在維持大型模型能力的同時,降低運算成本與延遲。

模型支援文字、圖片、文件及影片等多模態輸入,主要強化程式開發、工作協作、科學研究及長時間任務等使用情境。

程式開發與研究重現測試表現

根據阿里巴巴公布的測試結果,Qwen3.8-Max 在 Terminal Bench 2.1 程式開發測試中取得86.6分,低於 GPT-5.6 Sol 的88.8分,但高於前代 Qwen3.7-Max 的74.5分。

在評估人工智慧重現研究論文能力的 PaperBench 測試中,Qwen3.8-Max 取得93分,阿里巴巴表示其成績超越 GPT-5.6 Sol、Claude Opus 4.8 及 Fable 5。不過,由於不同模型可能採用不同的測試框架與設定,這些結果不宜直接視為完全等值的比較。

展示長時間自主執行能力

阿里巴巴展示的案例指出,Qwen3.8-Max 曾連續自主運作約16天,從零建立一套程式代理人框架。該框架可根據使用者意見、測試結果及執行紀錄持續改進,期間完成265次程式碼提交及127項拉取請求。

在另一項研究重現案例中,模型花費約125小時重現一篇人工智慧訓練研究論文,執行33輪 GPU 訓練,並自行提出及測試18種改良方法。阿里巴巴表示,經過這些改良後,AIME24 數學測試成績較原論文方法提高2.7分。

開放權重仍面臨部署門檻

開放權重可讓開發者取得更高程度的部署與調整彈性,但 Qwen3.8-Max 的總規模達2.4兆參數,實際部署預期仍需要大量運算能力與儲存資源。

在阿里巴巴尚未公布權重授權條款、硬體需求及相關部署細節前,開發者能否在一般企業或個人環境中有效運行,仍取決於模型實際的資源需求與授權限制。

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles