據中國媒體《晚點 LatePost》報導,字節跳動正在討論訓練一款參數規模超過 5 兆的大型模型。若計畫落實,該模型的參數量將超越阿里巴巴 Qwen 3.8-Max 的 2.4 兆參數,以及月之暗面(Moonshot AI)Kimi K3 的 2.8 兆參數,有望成為目前中國國內已知參數規模最大的模型。
不過,相關計畫目前仍處於早期階段,並不代表模型最終一定會完成或對外發布。現階段外界也尚未掌握模型的具體架構、訓練時程、運算資源配置及預計推出時間。
Seed 團隊主導模型規劃
報導指出,新模型計畫將由字節跳動 Seed Foundation 負責人項亮主導,並與大語言模型預訓練數據負責人沈科合作。為推進相關工作,Seed 正重新梳理組織架構,進一步劃分職責並分配資源。
這項規劃被視為字節跳動重新尋求大型模型競爭優勢的一部分。據悉,Seed 內部多個團隊持續檢討現有發展策略,認為與其在既有模型尺寸上持續追趕,不如將參數規模一次提升至同業數倍,以爭取更明顯的領先位置。
中國大型模型競爭升溫
字節跳動在 2 月中旬推出由 Seed 負責人吳永輝執掌後推出的關鍵模型 Seed 2.0,但市場反應相對有限。另一方面,智譜開源的 GLM-5 被市場視為中國國內首個可與 Anthropic Opus 系列相提並論的模型;月之暗面發布 Kimi K3 後,多項第三方評測也認為其能力已接近海外閉源旗艦模型。
在競爭者陸續推出高能力模型的背景下,字節跳動若推進超過 5 兆參數模型,可能代表其將以更大規模的預訓練模型作為差異化策略。然而,模型參數量並不等同於整體能力,最終表現仍取決於訓練資料品質、模型架構、訓練方法、運算資源與推理效率等因素。
計畫仍待後續確認
目前消息來源僅指出字節跳動正在討論相關方案,尚未確認模型是否正式立項、能否完成訓練,以及未來是否會公開發布。因此,超過 5 兆參數仍屬規劃階段資訊,後續實際規模與產品方向仍可能調整。




