教學:Gemini Omni 1.1 Flash 登場 兩張相無縫接一鏡到底 自製電影轉場

用 AI 生成影片,最怕效果不可控,出來的畫面跟文字差很遠。Google 最近為 Google Flow 升級新一代 Gemini Omni 1.1 Flash 模型,一口氣加入了首尾幀控制、40 秒場景延伸、360p 快速草稿和 4K 輸出等實用功能。

今次教學會集中示範如何利用 Google Flow 的「首尾幀」控制功能,將兩段完全不同的影片素材無縫串連在一起。相信大家平時都見過一種相當帥氣的運鏡轉場,鏡頭由建築物外圍突然急速穿梭飛入室內,看似一鏡到底,其實以往要花大量時間用電腦 CG 逐格調整;但現在透過 Google Flow,整個製作流程大幅簡化,即使是新手都可以輕鬆試玩。

Google Flow : https://labs.google/fx/tools/flow

▲利用 Gemini Omni 1.1 Flash,可以把兩個不同場景串連起來,例如由會展外圍,穿梭到會展內的會議室

▲ 今次最大特點是 360p 快速草稿,可以節省 Credits,等到你滿意影片成果,再以 1080P 下載影片

為何必須用 Google Flow?

不少用家平時習慣在 Gemini 直接影片生成,但 Gemini 本質上屬於對話式介面,亦缺乏時間軸、分鏡組合以及畫質微調等功能。真正能夠發揮 Gemini Omni 1.1 Flash 完整實力的平台其實是 Google Flow。Google Flow 採用彈性點數制度,多解像度選擇與首尾幀控制介面,讓創作者對成品更有控制權。

▲ 進入 Google Flow 網頁後,只要打開新專案就可以開始做 AI 片

▲ 打開新專案後,我們可以用文宇生成畫面,或者上傳不同素材 (包括圖片和影片)到專案

▲ Google Flow 的界面更專業,比起 Gemini 純對話式界面更大控制空間

新賣點:360p 快速草稿模式

要提高創作效率,新加入的「360p 快速草稿」功能非常幫到手。在生成前,設定解像度為 360p,系統運算速度比標準 720p 快最多 60%,而且,每次生成消耗點數成本僅需三分之一。生成影片後,滿意成果先把影片畫質升至 720P,或直接升級至 4K 輸出,省下大量等待時間與生成點數。

▲ 在生成前,設定解像度為 360p,每次生成消耗點數成本僅需三分之一

實戰示範一:建立商業穿透運鏡(會展 ➔ 會議室)

示範影片一:會展 ➔ 會議室

我們今次用 AI 製作了從會展外圍,快速穿梭到會展內部會議室的畫面。我們會使用兩個素材,分別是一張會展的相,一張會議室內部的相片。

操作步驟:

進入 Google Flow 的操作介面後,新手最常遇到的卡關位就是找不到首尾幀設定。這裡有一個非常關鍵的前置步驟:必須先關閉畫面上的「代理」(Agent)功能。當開啟代理助手時,系統會切換成對話式的自動輔助模式,並收起底部的標準生成工具列,導致無法手動指定首尾幀;只要關閉右側的代理設定側欄或在輸入框取消代理模式,底部的標準生成介面就會重現。

▲進入 Google Flow,按「新專案」

▲ 一定要關掉「代理」功能,一打開 Google Flow,「代理」功能會預設開啟

 

▲ 關掉「代理」功能後,點擊右下角的生成設定

▲影格代表「Frame」,可用於設定首尾幀或指定關鍵影格,我們選擇這個

▲其他你要知道的按鈕包括「x1 x2 x3 x4 」, 意思是單次 Prompt 同步生成的候選版本數量,數量越多,點數越多

圖像 / 影片:選擇輸出靜態圖片定係動態影片(當前選中「影片」)

並設有 16:9 或 9:16 的影片設定

▲選好影格後,我們把兩張圖片上傳到 Google Flow,分別是一張外圍的會展圖片,另一張做是一般的會議圖片

▲ 之後把會展圖片拉進「首幀」( First Frame),會議圖片拉進「尾幀」( Last Frame)

Google Flow 專業的是,生成前會表明使用多少點數,你可以好好計劃你的影片步驟

另外,Google Flow 一定要輸入指令,但你只需要打「人話」便可以,以下是參考:

指令參考:

鏡頭從會展中心外觀極速向前推移,掠過水面並無縫穿透玻璃窗,直接衝入現代會議室並平滑減速,展現圍坐會議桌的人士,高快門、零動態模糊、全段清晰對焦、超寫實 4K、畫面乾淨無飛行器。

▲大概一分鐘完成生成,而且即使影片生成時設定了 360P,最後下載也可以升級至 720P

▲素材方面,我們今次到 Google Vids 下載現成的商用 Stock Footage

▲ Google Vids 上有不少影片素材,可以免費使用,當然讀者們也可以用自己拍的素材

實戰示範二:ChatGPT 概念圖跨尺度變焦(滿月 ➔ 月表搞笑食月餅)

第二個示範則是充滿趣味的「月球上食月餅」創意鏡頭。第一張是黑夜中清晰的天文望遠鏡滿月特寫,第二張則是戴著透明太空頭盔、坐在月球岩石上食月餅的女生。素材方面,除了在在 Google Vids 下載月亮圖片,我們另外在 ChatGPT 生成了一張科幻圖片,一名女子在月球上食月餅。操作步驟和實測 1 一樣。

素材:

▲用 ChatGPT 生成一張女子在月球上食月餅的圖片

指令參考:

從滿月表面極速推進縮放,平滑過渡至荒謬搞笑的月球地貌:戴著透明太空頭盔的亞洲女生坐在月球岩石上搞笑地想咬月餅

支援 10 秒長脈絡延伸與 4K 輸出:構建工業級影片工作流

完成首尾幀過渡後,如果需要進一步擴展敘事,Gemini Omni 1.1 Flash 支援參考前面長達 10 秒影片脈絡,每次向後延伸 10 秒,最長可串接累積至 40 秒完整短片。配合 360p 快速試錯、首尾幀定位與後續 4K 升級輸出,Google Flow 已由單純 AI 玩具轉型為一套具備工業級控制力的影像生成工作流。

不過 4K 輸出就要 Google AI Ultra 先用到,筆者所用的 Google AI Pro 帳戶未能試玩。

總結:由「抽盲盒」走向可控創作

以往用 AI 生成影片往往要不斷盲抽重試,既耗費時間又浪費點數。今次 Google Flow 升級 Gemini Omni 1.1 Flash 後,最大意義在於將運鏡的主導權真正交還給創作者。

透過「360p 低成本快速試錯 ➔ 首尾幀鎖定關鍵畫面 ➔ 場景延伸補足劇情」的完整流程,用家可以先用極低門檻驗證動態效果,再精準串接不同素材,大幅解決過往畫面失控的通病。雖然 4K 輸出暫時仍有帳戶級別限制,但單憑首尾幀帶來的精準控制與草稿模式的效率提升,Google Flow 已經跳出單純「試玩娛樂」的層次,成為值得創作者納入日常影像製作與分鏡設計的實用工具。

Comments (0)
Add Comment