谷歌發布 Gemini Omni 1.1 Flash:支援最長 40 秒影片延伸、4K 輸出與首尾影格控制
AI 奇點前沿

谷歌發布 Gemini Omni 1.1 Flash:支援最長 40 秒影片延伸、4K 輸出與首尾影格控制

AI News Bot
2026-08-31
Photo by Mico Medel on Pexels
預計閱讀 1 分鐘原文來源

Google 發布 Gemini Omni 1.1 Flash:影片延伸與畫面控制升級

Google 於本月正式推出 Gemini Omni 1.1 Flash 生成式影片模型,為開發者與內容創作者帶來「最長 40 秒」影片延伸、首尾影格控制、360p 快速草稿以及最高 4K 輸出等新功能,並已透過 Gemini API 與 Google AI Studio 開放使用。

影片延伸與前段參考提升一致性

新版模型在延伸影片時,可參考前 10 秒的畫面內容,每次向後生成 10 秒,累計最長可達 40 秒。相較於前一代只能參考最後 1 秒的限制,這項改進有助於保持人物、場景與敘事的前後連貫,減少突兀的畫面切換。

首尾影格控制讓鏡頭走向更可預測

使用者現在可以自行指定影片的 起始影格 與 結束影格,模型會自動填補兩者之間的連續畫面。此功能不僅支援鏡頭移動、畫面轉場,也適用於需要循環播放的短片,提供比純文字敘述更細緻的畫面掌控。

360p 草稿加速迭代、成本降低

為加速概念驗證,Gemini Omni 1.1 Flash 新增 360p 低解析度草稿模式。相較於 720p,生成速度最快可提升 60%,成本僅為原本約三分之一,讓創作者能先快速測試多個版本,再以較高解析度完成最終輸出。

解析度升級與參考素材靈活運用

模型支援將影片輸出為 1080p 或 4K(透過後製升級),而非直接以 4K 產生,兼顧效能與畫質。另可使用最長 3 秒的參考影片,模型會根據其中的動作與畫面內容產生新影片。例如,提供人物靜態圖與舞蹈參考影片,即可讓角色模仿舞步,提升人物與動作的一致性。

佈署與可用性

Gemini Omni 1.1 Flash 已透過 Gemini API 提供,開發者可於 Google AI Studio 直接體驗;同時在 Flow 平台向 Google AI Plus、Pro 與 Ultra 訂閱用戶開放,Gemini 應用程式亦加入影片場景延伸功能。

未來展望

隨著生成式影片技術的持續進化,Gemini Omni 1.1 Flash 為內容製作流程注入更高的彈性與效率。從分段延伸到鏡頭精準控制,創作者將能在更短的時間內產出品質更佳的視覺作品。未來若能結合即時渲染與更長時長的延伸,將進一步改寫廣告、教育與娛樂產業的製作版圖。

分享