科技巨頭 Google 的人工智慧(AI)產品線出現重大技術迭代。原定於 6 月份登場的旗艦級「Gemini 3.5 Pro」模型,目前已被證實無預警延後推出。然而,Google 並未放慢研發節奏,在毫無預告的情況下,閃電發布了兩款主打極致效能與輕量化的全新模型——Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite。這兩款新模型在運算性能、處理速度及長文本解析能力上均有顯著飛躍,同時進一步降低了 Token 的輸出成本,為企業級應用帶來更高性價比的選擇。
Gemini 3.6 Flash:中量級主力 性能超越前代旗艦
根據 Google 官方說法,新推出的 Gemini 3.6 Flash 定位為主力中量級模型,核心優勢在於強大的多模態理解、複雜程式碼生成以及長文本處理實力。在實際測試中,3.6 Flash 相較於舊款 Gemini 3.5 Flash 有著大幅度升級,尤其在複雜編程、機器學習工程與超長文本檢索等高難度場景中,表現尤為突擊。
在衡量複雜長流程工程能力的測試「DeepSWE v1.1」中,3.6 Flash 的表現從前一代的 37% 大幅拉升至 49%;而在「MLE-Bench 機器學習工程測試」中,更展現了 63.9% 對比 49.7% 的跨越式進步,其性能數據甚至超越了目前的旗艦級模型 Gemini 3.1 Pro。此外,針對過往長文本模型容易遺漏資訊(Needle in a Haystack)的痛點,在 1M Tokens 視窗的關鍵資訊檢索測試(GDM-MRCR v2)中,Gemini 3.6 Flash 的準確率由 26.6% 飆升至 54.0%,顯著改善了長文檢索的精準度。
Gemini 3.5 Flash-Lite:主打低成本 電腦操作能力力壓對手
另一款同步登場的 Gemini 3.5 Flash-Lite,則是目前 Gemini 家族中最輕量、成本最低的推論模型。該模型專為大批量數據處理、自動化客服檢索及高頻 API 呼叫等「價格敏感型」的商業場景而設計。儘管定價較上一代 3.1 Flash-Lite 略有調整,但在整體邏輯推理、自動化 Terminal 控制、電腦操作(Computer Use)及長 context 檢索等領域,均帶來了突破性的進步。
在 Agent(AI 代理)與電腦操作能力上,3.5 Flash-Lite 的升級幅度巨大。在 GDPVal-AA v2 知識工作評測中,其 Elo 分數從 642 分暴增至 1140 分;在 OSWorld-Verified 電腦操作能力測試中,則達到了 74.0% 的準確率。這項成績不僅遠超前代的 54.3%,更一舉超越了競爭對手的 GPT-5.4 mini(72.1%)與 Claude Haiku 4.5(50.7%)。在 128k 視窗長文本綜合檢索(GDM-MRCR v2)測試中,3.5 Flash-Lite 取得了 72.2% 的優異成績;即使在 1M Tokens 的極限視窗下,仍保有 21.3% 的檢索成功率,確保企業在處理超長合約或日誌分析時不遺漏關鍵數據。
戰略佈局:旗艦版 3.5 Pro 延遲原因曝光 下代 Gemini 4 已在路上
針對市場關注的旗艦級 Gemini 3.5 Pro 延宕消息,Google 官方透露,延期主要是為了針對複雜邏輯作出更深度的能力調校。Google 旨在確保該旗艦模型在面對 GPT-5.6、Grok 4.5 與 Claude 5 等潛在強敵時,能具備絕對的競爭優勢。
專家建議,目前正在使用 Gemini 3.1 Pro 的開發者與用戶,在等待期間可先切換至表現優異的 Gemini 3.6 Flash 作為過渡方案。與此同時,Google 內部已正式啟動下一代基座模型 Gemini 4 的前期研發與預訓練工作,展現其持續領跑 AI 市場的決心。至於 Gemini 4 的具體發布時間,官方表示將於未來另行公佈




