Gemini影片可接40秒,先用360p試鏡

(媒角抵加/林承志綜合報導)人物短片接連續鏡頭,備好角色參考圖與首尾畫面。Google 8月27日推出 Gemini Omni 1.1 Flash,可把短片接至40秒,用兩張畫面安排過場。單次輸出仍限3至10秒,1080p、4K為升頻輸出。台灣創作者可用360p試鏡,記下重拍成本,再選高畫質版本。
- 發生什麼事:Google 在 Gemini API 推出正式版
gemini-omni-1.1-flash,加入影片延長、首尾畫面轉場與解析度控制。 - 40秒怎麼來:每次接續可加10秒,累計最長40秒;並非一次生成一支40秒影片。
- 怎麼控制畫面:可用兩張圖指定開頭與結尾,再描述中間的鏡頭與動作。
- 4K代表什麼:官方文件把1080p與4K標示為升頻輸出,720p才是預設解析度。
- 台灣先做什麼:台灣Google One頁面列有可使用Google Flow的AI方案;實際模型、點數與功能仍要登入帳號確認。
40秒來自分段接續,長鏡頭仍要逐段驗收
Google 8月27日的 Gemini API 更新紀錄顯示,Gemini Omni 1.1 Flash 已從預覽版進入正式版。官方模型頁列出的單次輸出長度是3至10秒,解析度可選360p、720p、1080p與4K,輸出為每秒24格。
所謂40秒,是把短片接續起來。官方操作指南說明,模型會在片尾生成3至10秒的新段落;用10秒延長時,可一路累計到40秒。要做到完整40秒,創作者仍要接受第一段與後面三段的銜接結果。延長只會加在片尾,不能從片頭向前接,也不能在片段中間補一段畫面。
這個限制很實際。人物轉身、商品交接、鏡頭橫移這類動作,交付前都要逐段看人物臉部、服裝、光線、物件位置與聲音是否延續。影片變長,不代表可省去剪輯驗收。
首尾畫面讓轉場有起點與終點
過去要做兩個靜態畫面之間的過場,團隊通常先畫分鏡,再多次嘗試提示。Omni 1.1 Flash 現在可把兩張圖分別當作開頭和結尾,讓模型生成兩者間的過場;Google 操作指南也提供相應做法。
這項功能適合把已核准的產品照、角色設定或場景圖接成一個短鏡頭。例如電商團隊先確認商品在桌上的開始畫面和手拿商品的收尾畫面,再用文字描述推鏡、手部動作與環境聲。兩張圖界定的是畫面邊界,中間的動作與細節仍由模型生成,成品要回看是否符合原本的商品與人物設定。
4K是升頻輸出,先用360p排掉重拍版本
官方文件明列720p為預設解析度,1080p與4K是升頻輸出。這讓「先低畫質試鏡,再輸出高畫質」成為較合理的順序:先在360p檢查分鏡、角色、動作和接續,再把通過的版本送去高解析輸出。

獨立科技媒體 The Decoder 整理的 API 單價為每秒360p 0.03美元、720p 0.10美元、1080p 0.15美元、4K 0.30美元。若一支40秒影片只算一個可用版本的輸出時間,720p約為4美元、4K約為12美元;輸入用量與被淘汰的重拍版本不在這個估算內。
這些數字採 API 收費,Google Flow 則使用訂閱方案與點數,台灣含稅售價也另有規則。團隊可把「看起來做得快」拆成可管理的帳:有多少秒真的可交付,為了接住同一個人物重跑幾次,高畫質輸出前花了多少時間。
公開留言先追問人物一致性與可重現性
功能推出後,早期使用者持續追問接續後的人物和場景會不會變樣。在 Google AI Developers Forum,一名使用者以相同提示和720p比較1.1與前版,回報複雜花紋、建築裝飾失真,認為新版沒有達到預期。人物臉部、花紋、文字、光線與物件位置,因而成為每一段影片都要重看的交付項目。
r/GoogleFlow 的討論也聚焦在角色、光線與氛圍於延長後是否漂移;其中一名使用者稱,服飾短廣告搭配多角度角色參考圖後,人臉一致性有所改善。另一個 r/GenAIGallery 展示貼文同時收到稱讚、質疑與追問提示詞的留言。
不同使用者使用的提示、角色圖與輸出條件各異,客戶仍會檢視示範片以外的可重現性。若要拿模型接案,團隊應保留角色參考圖、提示、每一段輸出、重拍次數與剪輯版號,讓下一個案子能重做相同流程。
每秒價格拉開,團隊得算重拍成本
同一份價格比較顯示,Veo 3.1 Lite 的720p與1080p每秒價格低於 Omni 1.1 Flash。Omni 1.1 的價值要回到首尾畫面、片尾延長與對話式修改能否減少重拍與後製來衡量。
對短影音團隊來說,同一組角色圖、同一段首尾畫面、同一個提示,應同時記錄三件事:第一次通過的人物一致性、剪輯需要補救的時間、每一個可用秒數的實際費用。這樣才能判斷畫面控制是否真的換到更低的製作成本。
台灣創作者先確認帳號,再做小型試作
Google 的台灣 Google One 方案頁列有 Google AI Plus、Pro、Ultra,並列出 Pro、Ultra 在 Google Flow 可取得更多影片生成模型存取權。頁面沒有逐一保證每個帳號都能使用 Omni 1.1 Flash,也沒有以 API 的美元單價替代 Flow 的點數規則。
若要用在提案或客戶案,先做一支10秒試作就能看出方向:用已獲授權的角色與商品素材,指定首尾畫面,先輸出360p,檢查人物、文字、商品比例、聲音和動作;確認可用後才延長鏡頭與輸出高畫質。把重拍與後製工時記下來,才知道這個工具是減少拍攝成本,還是把成本移到挑片與修片。
常見問題
Gemini Omni 1.1 Flash 能一次產出40秒4K影片嗎?
不能這樣理解。官方規格的單次輸出是3至10秒,40秒來自後續分段接續;1080p與4K也被官方標示為升頻輸出。長片仍須檢查每段銜接。
人物一致性已經解決了嗎?
還不能下這個結論。官方提供首尾畫面、參考媒體與延長控制;公開論壇和社群則同時有改善自述與細節失真的回報。現階段最可靠的做法,是用自己的角色、商品與鏡頭需求做可重複的測試。
台灣使用者現在就能用嗎?
台灣Google One頁面已列出 Google AI 方案與 Google Flow 的影片生成模型權限,但特定模型、帳號點數與可用功能會依方案和帳號狀態而不同。實際接案前,應先登入確認。
資料來源與更新紀錄
- 2026年8月27日:正式版發布、影片延長、首尾畫面與解析度控制,參考 Google Gemini API更新紀錄。
- 2026年8月27日:模型名稱、3至10秒輸出與24 FPS,參考 Google Gemini Omni Flash模型頁。
- 2026年8月29日查核:延長限制、40秒上限、首尾畫面與4K升頻說明,參考 Google操作指南。
- 2026年8月27日:API價格整理與Veo比較,參考 The Decoder報導。
- 2026年8月28日至29日查閱:早期使用者的細節失真回報、人物一致性自述與示範片討論,參考 Google AI Developers Forum、r/GoogleFlow、r/GenAIGallery。
- 2026年8月29日查核:台灣方案與Google Flow資訊,參考 Google One台灣頁面。