SpaceXAI 發表 Grok 4.5:主打編碼與代理任務,宣稱 token 效率達同級模型兩倍

完成品牌重塑並更名為 SpaceXAI 後,xAI 發表新一代人工智慧模型 Grok 4.5。該模型與日前收購的 Cursor 合作訓練,主要聚焦編碼、代理式任務及知識工作,SpaceXAI 宣稱其在實際工程任務與多項技術工作中,具備優於同級先進模型的表現。

訓練資料涵蓋編碼、科學與工程領域

SpaceXAI 表示,Grok 4.5 的訓練資料集涵蓋編碼、科學、數學及工程等領域。除了增加原始 token 用量,團隊也投入資料篩選與整理,包括移除重複資料、進行品質評分,以及挑選特定領域內容,以維持資料集的覆蓋範圍與訊號密度。

在模型訓練方面,Grok 4.5 使用數萬個 NVIDIA GB300,並採用針對大規模運算設計的訓練與穩定性技術。SpaceXAI 同時擴大強化學習(Reinforcement Learning,RL)的規模,將訓練重點放在提升每個 token 所產生的智慧效益。

強化學習聚焦多步驟軟體工程任務

SpaceXAI 表示,Grok 4.5 的強化學習訓練涵蓋數十萬項任務,核心內容包括多步驟軟體工程及其他技術工作。相關訓練採用自動化與基於模型的評分機制,用於評估代理程式在複雜工作流程中的執行結果。

其技術堆疊則針對高度非同步訓練環境打造,使 Agent 執行流程可以持續運作數小時,同時讓完整學習流程仍能在數萬顆 NVIDIA 晶片上進行。

Grok Build 預設模型,主打完整應用程式開發

Grok 4.5 已成為編碼工具 Grok Build 的預設模型。SpaceXAI 稱,該模型可處理具挑戰性的 Rust 與 C/C++ 任務,也能支援從提示開始、一路完成至正式部署的完整應用程式開發流程。

SpaceXAI 執行長馬斯克(Elon Musk)則在 X 發文表示,團隊內部評估認為 Grok 4.5 的能力大致相當於 Claude Opus 4.7,但處理速度更快。這項說法屬於 SpaceXAI 方面的評估,來源未提供第三方測試結果。

定價與 token 效率

在成本方面,SpaceXAI 宣稱 Grok 4.5 能以具競爭力的價格提供服務,並達到同級先進模型兩倍的 token 效率。官方定價如下:

項目價格
輸入 token每百萬個 2 美元
輸出 token每百萬個 6 美元

SpaceXAI 認為,綜合每單位時間與成本的模型表現後,Grok 4.5 可提供同級模型中的高水準效能。不過,來源未提供 token 效率的具體測試方法、比較模型或獨立驗證數據,因此相關數字仍應視為公司公布的主張。

已在多個平台開放使用

Grok 4.5 即日起可在 Grok Build、Cursor 所有訂閱方案,以及 SpaceXAI 控制台使用。開發者取得 API 金鑰後,透過數行程式碼即可開始介接。

目前 Grok 4.5 尚未在歐盟地區的 SpaceXAI 產品或 API 中提供,SpaceXAI 預計於 7 月在歐盟推出相關支援。

Related Articles

Stay Connected

0FansLike
0FollowersFollow
22,800SubscribersSubscribe
spot_img

Latest Articles