Google DeepMind 今日推出 Gemini Omni 1.1 Flash,這是一套全新的創意控制與生成式影片功能,旨在支援開發者。Gemini Omni 最初為生成式創作帶來了真實世界的推理能力,而今日的更新則讓 Omni 1.1 透過 Google AI Studio 中的 Gemini API 達到專業生產就緒的水準。
無論您正在建構生成式影片工作流程、創意工具或媒體編輯軟體,這些更新都將使生成式影片更具控制性、更快的迭代速度,並能產出更精緻的成品以供實際部署。以下是本次更新的重點功能。
場景延伸功能讓您可以將現有影片無縫地從結束處繼續生成新的片段,以創造更長的故事情節。透過 Omni 1.1,模型現在可以分析長達 10 秒的先前上下文,這比之前僅參考最後一秒的模型有了巨大飛躍。這將帶來更好的視覺一致性和敘事連貫性,讓您能建構更長的故事或開拓新的創意方向。您可以以 10 秒為增量延伸影片,總長度最多可達 40 秒。
透過指定鏡頭的起始和結束影格,您可以實現流暢的轉場和鏡頭運動。Omni 1.1 能夠在兩個關鍵影格之間生成連續影片,這對於複雜的鏡頭環繞、縮放轉場或無縫循環片段來說非常理想。
現在您可以以 360p 解析度生成輕量級預覽影片,速度比 Omni 1.1 標準的 720p 解析度快上 60%,且成本僅為三分之一。這對於快速原型開發、故事板迭代以及開發者平台中的快速渲染非常有幫助。根據 360p 與 720p 解析度的系統吞吐量,生成速度最高可提升 60%。
透過 Omni 1.1,您可以生成精緻、高解析度的 1080p 或 4K 輸出,這些成果已準備好用於專業製作。
在創作場景時,您可以參考長達三秒的影片,這讓您能夠根據影片參考來維持視覺上下文和角色一致性。
文章中也提供了開發者如何將這些新功能應用於自訂工具和創意工作流程的一些啟發性概念。我們的客戶已經透過 Agent Platform API 將 Gemini Omni Flash 應用於實際生產中,您可以探索他們創作的影片並了解他們如何使用此模型。
Omni 1.1 正在 Google 開發者生態系統中全面推出。您可以在 Google AI Studio 中直接試用 Omni 1.1,企業用戶則可透過 Agent Platform API 直接使用 Omni 1.1 進行建構。此外,開發者可以查閱官方文件、教學手冊和提示詞指南,了解如何將場景延伸、影片參考和升級功能整合到應用程式中。
從今天起,Omni 1.1 也將在全球範圍內向所有 Google AI Plus、Pro 和 Ultra 訂閱者開放,可在 Google Flow 中使用。而場景延伸功能則向全球所有 Google AI Plus、Pro 和 Ultra 訂閱者開放,可在 Gemini app 中使用。



