Gemini Omni 1.1 Flash AI影片功能:40秒延伸、4K升頻與首尾幀控制

Gemini Omni 1.1 Flash 是甚麼?Google AI影片可延伸至40秒、支援4K與首尾幀控制

Direct Answer

Gemini Omni 1.1 Flash 是 Google 於 2026 年 8 月 27 日推出的生成式影片模型正式版,模型代號為 gemini-omni-1.1-flash重點不是一般文字聊天,而是把 AI 影片由「一次生成」推向較可控制的製作流程:可把場景延伸至累計 40 秒、指定首尾幀、用 360p 快速起稿、把成品升頻至 1080p 或 4K,並加入短片參考。

香港用戶要留意,Google 最新的 Google AI Studio/Gemini API 支援地區清單未列香港,不能單憑「全球推出」便假設本地帳戶可直接使用所有入口;實際功能仍須按平台、帳戶、訂閱及推出進度核實。

懶人包(TL;DR)

  • Gemini Omni 1.1 Flash 是影片生成及編輯模型,不是另一個通用聊天機械人。
  • 新版核心是「控制」:場景延伸、首尾幀插值、360p 草稿、1080p/4K 升頻及影片參考。
  • 場景可每次延伸 10 秒,累計最長 40 秒;單次輸出為 3 至 10 秒、24 FPS,並可生成原生音訊。
  • Gemini API 沒有免費層;Google 公布的 720p 有效影片輸出價約為每秒 US$0.10。
  • 香港是否可用要逐個入口核實;即使功能可開啟,品牌文字、人物權利、複雜動作及廣告聲稱仍要人手審批。

Google 在 2026 年 8 月 27 日把 Gemini Omni Flash 推進至正式可用(GA)的 gemini-omni-1.1-flash。這次更新最值得留意的,不只是輸出解像度提高,而是創作者開始可以用一組較清楚的控制點,把 AI 影片放入「草稿—比較—修改—輸出」流程。

Google 官方發布同日亦交代了 Flow、Gemini App、Google AI Studio 及企業平台等入口,但不同入口的權限並不完全相同。

1. Gemini Omni 1.1 Flash 是甚麼?先分清「影片模型」與「Gemini 聊天」

Gemini Omni 1.1 Flash 是一個面向影片生成、影片編輯與連續修改的多模態模型。Google 的開發者文件把模型定位為高速度影片生成及編輯工具,支援文字生成影片、圖片生成影片、影片編輯、首尾幀插值及場景延伸;影片亦可帶有模型生成的音訊。

所以,「Gemini Omni」不等於整個 Gemini 應用程式,也不應理解成一個新的通用聊天模型。較準確的說法是:Gemini App、Google Flow、Google AI Studio 或企業平台可以成為入口,而 Omni 1.1 Flash 是背後負責生成及編輯影片的模型。

這個分別對企業尤其重要。使用者如果只想在介面內製作一段短片,關心的是帳戶是否見到功能、配額及輸出權限;開發者如果要把影片生成接入產品,則要關心模型 ID、API 地區、收費、資料處理方式與錯誤處理。兩者不能混為一談。

開發者更新:舊預覽模型代號是 gemini-omni-flash-preview。Google 的 Gemini API 更新紀錄表示,該預覽端點將於 2026 年 9 月 30 日進入棄用狀態;現有整合應評估轉用正式版。

2. 五項核心升級:由「生成一段片」變成較可控制的製作流程

第一,場景延伸(scene extension)。Omni 1.1 Flash 可分析最多 10 秒的先前內容,再以 10 秒為一個增量延伸影片,累計最長 40 秒。這不等於一次生成一條 40 秒完整影片,而是逐段延伸,讓創作者每一段都可以重新判斷故事方向。Google 的 Omni 1.1 發布說明列出了場景延伸、首尾幀、360p 草稿、升頻及影片參考等更新。

第二,首尾幀控制(first and last frame interpolation)。創作者可指定開始與結束畫面,模型負責生成中間的連續運動。這對運鏡、場景轉換、循環片段及產品由一個狀態過渡到另一個狀態特別實用。

第三,360p 快速草稿。Google 表示,360p 相對標準 720p 可快最多 60%,成本約為三分之一;「最多 60%」是按系統吞吐量比較,不代表每次生成都固定快 60%。最合理的用途是先測構圖、節奏與創意方向,確認後才輸出高解像版本。

第四,1080p 與 4K 輸出。這兩個解像度由升頻(upscaling)產生,不是原生 4K 生成。升頻可以改善交付尺寸,但不能自動修正角色、文字、產品細節或動作邏輯。

第五,影片參考與多輪編輯。官方文件支援最多三段影片參考,每段最長 3 秒;參考片的音訊會被忽略。這適合借用人物外觀、物件或動作線索,但不應理解成模型會完整複製一段參考影片的所有細節。

Gemini Omni 1.1 Flash 五項升級:場景延伸、首尾幀、360p 草稿、4K 升頻與影片參考
Gemini Omni 1.1 Flash 的五項主要更新,重點由單次生成轉向可反覆控制的影片流程。

3. Gemini Omni 1.1 Flash 規格、價錢與入口一表看清

以下資料以 Google 於 2026 年 8 月 27 日公布的模型規格開發者指南價格頁為準。價格、配額、地區及帳戶資格都可能更新,正式使用前應再核對官方頁面。

項目 官方資料(截至 2026-08-27) 實務解讀
正式模型 ID gemini-omni-1.1-flash(GA) 開發整合不要再以舊 preview 名稱作長期設定
單次影片輸出 3–10 秒、24 FPS 較適合以短段落組合,而非一次完成長片
場景延伸 每次 10 秒,累計最長 40 秒;可參考最多 10 秒前文 40 秒是逐段延伸的累計上限
解像度 360p、720p(預設)、1080p、4K 1080p 及 4K 均為升頻輸出,不是原生生成
音訊 影片可帶原生音訊輸出 語音編輯與上載音訊參考目前不支援
影片參考 最多 3 段,每段最長 3 秒;參考音訊被忽略 用作外觀或動作線索,仍需檢查一致性
API 價格 無免費層;720p 有效影片輸出約 US$0.10/秒 10 秒 720p 約 US$1,只計影片輸出估算;其餘輸入/輸出另按官方表計算
開發者入口 Gemini API/Google AI Studio、Gemini Enterprise Agent Platform Developer API 與企業平台的地區及權限可不同
創作者入口 Google Flow;Gemini App 提供場景延伸 Google 指 Plus、Pro、Ultra 訂閱者全球推出,但仍須以帳戶實際顯示為準
來源識別 所有生成影片加入不可見 SynthID 有助來源驗證,但不取代版權、同意及內容審批

對一般創作者,最有用的數字未必是「4K」,而是 360p 草稿成本約為 720p 的三分之一。AI 影片通常要生成多個版本才找到合適方向;把早期探索放在低解像度,可避免每次試錯都付出完整輸出成本。

4. 香港用戶可否使用?「全球推出」不等於所有入口已直接開放

這一點必須說清楚。Google 的最新 Google AI Studio/Gemini API 支援地區清單列出新加坡、台灣等地,但截至頁面最新版本並沒有列出香港。官方亦建議,不在清單內的地區可研究 Gemini Enterprise Agent Platform。換句話說,香港團隊不應直接假設可以用 Developer API key 在本地環境接入 gemini-omni-1.1-flash

另一方面,Google 的 Omni 1.1 發布文章表示,功能會向 Google AI Plus、Pro 及 Ultra 訂閱者在 Google Flow 全球推出,而 Gemini App 亦會向上述訂閱者提供場景延伸。這個「全球」描述的是產品推出範圍,不等於每個香港帳戶、每項功能、每個工作或學校帳戶,以及每個 API 入口都同時可用。

  1. 先確認要用的是 Gemini App、Google Flow、Google AI Studio、Developer API,還是企業平台;
  2. 在實際帳戶查看 Omni 1.1、場景延伸、首尾幀及輸出解像度是否出現;
  3. 核對訂閱層級、配額、商業使用條款、資料處理及可用地區;
  4. 如果要接入正式產品,先以小型測試驗證計費、延遲、錯誤處理及內容安全,不要把消費者介面的可用性當成 API 生產保證。
香港使用 Gemini Omni 1.1 Flash 的入口判斷:Flow、Gemini App、AI Studio/API與企業平台
香港團隊應先分清使用入口,再核對帳戶、地區、訂閱與商業要求。

5. 最實際工作流:360p 起稿,再用控制點逐步收窄

Omni 1.1 Flash 最值得採用的,不是一句「幫我整條廣告片」,而是一個可比較、可覆核的製作流程:

  1. 先定商業目標與限制:影片服務認知、產品示範、名單收集還是轉換?哪些產品細節、價錢與聲稱不可改?
  2. 先做分鏡及首尾畫面:把每段要完成的動作、鏡頭、人物、畫面文字與聲音寫清楚。
  3. 以 360p 產生多個草稿:每次只改一個主要變數,例如 Hook、運鏡或場景,方便比較。
  4. 用首尾幀、參考片及延伸修正:不是不斷重抽,而是以控制點收窄結果。
  5. 先在 720p 驗收,再決定是否升頻:確定人物、產品、節奏與內容正確後,才輸出 1080p 或 4K。
  6. 把字幕、Logo、價錢及 CTA 放回可控制的後製流程:關鍵商業文字不宜只依賴生成畫面。
Gemini Omni 1.1 Flash 影片工作流:簡報、360p草稿、控制修改、720p驗收、1080p或4K輸出
先用低成本草稿探索,再以首尾幀、參考及延伸收窄,最後才升頻輸出。

這個方法同樣適用於社交短片、產品概念片及廣告素材。想進一步了解 AI 影片如何接回目標、投放與成效測試,可參考 AD-Linkage 的AI 廣告影片製作及人手審批流程;兩種工具不宜只按畫質作排名,應按入口、控制方式、成本、語言及實際工作流選擇。

6. 仍要人手判斷:語言、權利、畫面準確與複雜動作

Google 的開發者指南列明,現階段只有英文獲完整支援,其餘語言尚未完成評估,結果可能不同。香港團隊即使用中文構思,也應測試英文 Prompt 是否較穩定,再把最終繁體中文文字放入可控的後製工具。

API 還有幾項明確限制:不能上載音訊作參考、不能編輯聲音、影片參考會忽略音訊、上載影片的延伸只可加在片尾,亦不支援在片段中間插入延伸。官方亦建議影片編輯指令保持簡潔,過度描述可能帶來非預期改動。

至於角色一致性、畫面文字與複雜多人動作,Omni 1.1 的控制能力確有增加,但「可控制」不等於「每次準確」。發布前仍要逐格檢查:

  • 產品包裝、顏色、比例、按鈕及使用方法是否真實;
  • 品牌名、價錢、優惠、網址及繁體中文字是否正確;
  • 真人外貌、聲音、圖片、影片及音樂是否已獲適當授權;
  • 複雜動作、手部、物理互動與鏡頭連續性是否合理;
  • 廣告功效、比較、限時及成果聲稱是否有證據支持。

所有生成影片會加入 SynthID,有助驗證內容由 Google AI 產生,但 SynthID 並不是商業使用授權,也不代表影片已通過品牌、法規或廣告平台審批。

香港團隊的實務判斷

  • 適合先試:分鏡概念、社交短片草稿、產品情境、鏡頭過渡與多版本創意測試。
  • 需要加強測試:繁體中文畫面文字、長時間角色一致性、多人互動及複雜產品操作。
  • 不可省略:素材權利、人物同意、產品真實性、廣告聲稱、字幕與最終人工審批。

總結:Gemini Omni 1.1 Flash 的真正升級,不是「一按就有 4K」,而是讓 AI 影片多了草稿、首尾幀、參考、延伸與升頻等控制點。對香港創作者及企業而言,最合理的做法是先核實入口,再用 360p 低成本測試,把 AI 放在製作流程中加快探索;品牌方向、權利、準確性與發布決定仍由人負責。

將模型新聞變成真正工作能力

PCPPMAI AI 實戰課程

學習把多模態創作、工具選擇、工作流程設計及人工覆核連接起來,不只追逐單一新模型。

課程已列入持續進修基金可獲發還款項課程名單;實際發還視乎個人資格、CEF 餘額、修畢要求、申請程序及最新條款,並非保證獲批。

常見問題 FAQ

1. Gemini Omni 1.1 Flash 是聊天機械人嗎?

不是。Gemini Omni 1.1 Flash 是生成及編輯影片的模型,可透過 Gemini App、Google Flow、Google AI Studio、Gemini API 或企業平台等入口使用;各入口的功能及資格不同。

2. Gemini Omni 1.1 Flash 可以原生生成 4K 影片嗎?

不可以這樣理解。Google 文件列明,1080p 及 4K 是升頻輸出;720p 是預設解像度。升頻提高輸出尺寸,但不會自動修正內容錯誤。

3. 香港用戶可以直接使用 Gemini Omni 1.1 Flash API 嗎?

不能直接假設可以。Google 最新的 Google AI Studio/Gemini API 支援地區清單未列香港;Flow、Gemini App 及企業平台則有不同推出與地區安排,應以實際帳戶及官方最新頁面核實。

4. Gemini Omni 1.1 Flash 收費幾多?

Gemini API 沒有免費層。Google 公布的標準 720p 影片輸出有效價格約為每秒 US$0.10;輸入、文字輸出、不同平台配額及訂閱費用應以官方價格頁為準。

5. Omni 1.1 生成的影片可否直接用作廣告?

不建議未經審批直接投放。品牌文字、產品細節、人物及素材權利、複雜動作、字幕、CTA 與廣告聲稱都要人手檢查;SynthID 只協助來源識別,不等於商業授權或合規批准。

官方資料來源

資料核對日期:2026 年 8 月 29 日。模型功能、價格、入口、地區及服務條款可能更新,使用前請再以 Google 官方頁面為準。

相關內容