
AI 摘要
- Google 推出基於 Gemini 3.6 Flash 的圖像生成模型 Nano Banana 2.1。
- 新模型支援多輪局部編輯並維持主體一致性,首度加入三級 Thinking 推理模式。
- 最高可輸出 4K 解像度圖片,並修正 1:8 與 8:1 等超寬比例拼接問題。
Google 正式發表新一代圖像生成與編輯模型 Google Nano Banana 2.1。該模型底層採用 Gemini 3.6 Flash,專為解決過往 AI 繪圖需反覆重新抽卡的痛點而設計,大幅強化了連續多輪修改時的主體一致性、文字繪製能力與提示詞遵循度,同時兼顧生成速度與成本效益,目前已開始陸續整合至 Gemini 及 Google 旗下相關 AI 產品中。
支援多輪對話修改 精準保持主體外觀一致
過往使用 AI 圖像生成工具時,微調畫面往往會導致整體構圖或人物樣貌大幅改變。Google Nano Banana 2.1 支援連續多輪局部修改功能,使用者可直接透過自然語言對話,要求模型微調服裝樣式、背景元素或更換文字,在編輯過程中能精準維持特定人物與物體的核心外貌特徵不變。

首度導入 Thinking 推理模式 彈性平衡速度與畫質
為了滿足不同應用情境的需求,Google Nano Banana 2.1 首度引進「Thinking」推理模式,並劃分為三個等級供使用者與開發者自由調配:
- minimal:以極致生成速度為優先,降低運算成本。
- medium:平衡畫質表現與處理時間。
- high:全力調用深度推理能力,呈現最高品質圖像細節。
根據內部測試數據,啟用 Thinking 模式後的偏好度得分達到 1,050 分,整體表現超越前代模型。
解像度全面升級 支援 4K 畫質與極端超寬比例
在輸出規格方面,Google Nano Banana 2.1 預設為 1K 解像度,並可進一步輸出 2K 與 4K 高畫質影像。此外,開發團隊針對極端比例進行了全景圖片拼接紋理修正,能穩定產出 1:4、4:1、1:8 及 8:1 等特殊超寬畫面。
Nano Banana 系列模型規格與效能比較
| 模型名稱 | 基礎架構 | Thinking 推理模式 | 偏好度測試得分 | 最高輸出解像度 | 支援超寬比例 |
|---|---|---|---|---|---|
| Google Nano Banana 2.1 | Gemini 3.6 Flash | 支援(minimal / medium / high) | 1,050 分 | 4K | 支援(最高 1:8 / 8:1) |
| Google Nano Banana 2 | 未公佈 | 未支援 | 低於 1,050 分 | 未標明 | 未標明 |
| Google Nano Banana Pro | 未公佈 | 未支援 | 低於 1,050 分 | 未標明 | 未標明 |
Reference Link : unwire.hk




