Google推出生成式影片模型Gemini Omni 1.1 Flash,新版聚焦於長影片生成與畫面控制,新增影片延伸、首尾影格指定、360p快速草稿及最高4K解析度輸出等功能。目前模型已透過Gemini API提供,並可在Google AI Studio使用。
影片延伸能力提升至最高40秒
Gemini Omni 1.1 Flash可從既有影片繼續生成後續畫面。模型在延伸影片時,最多可參考前方10秒內容,每次向後生成10秒,累計影片長度最高可達40秒。
相較先前版本只能參考影片最後1秒,新版增加可分析的前段內容。Google表示,這項調整有助於維持人物、場景與故事發展的一致性,但實際生成結果仍取決於輸入影片及提示內容。

可指定影片開始與結束畫面
新版加入首尾影格控制功能,使用者可指定影片開頭與結尾的兩個畫面,再由模型自動生成兩者之間的連續影像。
這項功能讓製作者能更明確控制鏡頭起始位置與最終停留畫面,可應用於鏡頭移動、畫面轉場及可重複播放的短片。相較單純以文字描述影片內容,首尾影格控制提供額外的視覺條件,讓生成流程具備更明確的畫面約束。
360p草稿模式降低測試成本
Gemini Omni 1.1 Flash新增360p低解析度影片草稿選項。Google表示,與720p影片相比,360p生成速度最高可快60%,成本約為三分之一,適合在正式輸出前快速測試不同的腳本、動作或畫面版本。
確認內容後,模型可將影片輸出為1080p或4K。這類4K輸出是透過後續處理提高解析度,並非模型直接以原生4K解析度生成,因此輸出細節與畫面品質仍可能受到原始生成內容限制。
支援最長3秒參考影片
新版也能使用最長3秒的影片作為參考素材,模型會根據參考影片中的動作與畫面內容生成新影片。例如,開發者可以提供人物圖片及舞蹈影片,要求圖片中的角色模仿參考影片動作,藉此提升生成角色與動作的一致性。
這項能力可讓開發者在生成影片時加入更具體的動作參考,不過來源資訊未說明模型對不同人物、鏡頭或複雜動作的適用限制。
提供方式與適用服務
- Gemini Omni 1.1 Flash已透過Gemini API提供。
- 開發者可在Google AI Studio使用新版模型。
- Google Flow向Google AI Plus、Pro與Ultra訂閱用戶提供新版模型。
- Gemini應用程式新增影片場景延伸功能。
整體而言,Gemini Omni 1.1 Flash的更新重點在於延長可生成影片的時間、增加對影片起迄畫面的控制,並透過低解析度草稿降低反覆測試的時間與成本。至於模型在長時間敘事、人物連續性及高解析度輸出上的實際表現,仍需視不同使用情境與生成內容進一步評估。
Reference Link : ithome.com.tw




