Direct Answer
Gemini Omni 1.1 Flash 是 Google 於 2026 年 8 月 27 日推出的生成式影片模型正式版,模型代號為 gemini-omni-1.1-flash。重點不是一般文字聊天,而是把 AI 影片由「一次生成」推向較可控制的製作流程:可把場景延伸至累計 40 秒、指定首尾幀、用 360p 快速起稿、把成品升頻至 1080p 或 4K,並加入短片參考。
香港用戶要留意,Google 最新的 Google AI Studio/Gemini API 支援地區清單未列香港,不能單憑「全球推出」便假設本地帳戶可直接使用所有入口;實際功能仍須按平台、帳戶、訂閱及推出進度核實。
懶人包(TL;DR)
- Gemini Omni 1.1 Flash 是影片生成及編輯模型,不是另一個通用聊天機械人。
- 新版核心是「控制」:場景延伸、首尾幀插值、360p 草稿、1080p/4K 升頻及影片參考。
- 場景可每次延伸 10 秒,累計最長 40 秒;單次輸出為 3 至 10 秒、24 FPS,並可生成原生音訊。
- Gemini API 沒有免費層;Google 公布的 720p 有效影片輸出價約為每秒 US$0.10。
- 香港是否可用要逐個入口核實;即使功能可開啟,品牌文字、人物權利、複雜動作及廣告聲稱仍要人手審批。
Google 在 2026 年 8 月 27 日把 Gemini Omni Flash 推進至正式可用(GA)的 gemini-omni-1.1-flash。這次更新最值得留意的,不只是輸出解像度提高,而是創作者開始可以用一組較清楚的控制點,把 AI 影片放入「草稿—比較—修改—輸出」流程。
Google 官方發布同日亦交代了 Flow、Gemini App、Google AI Studio 及企業平台等入口,但不同入口的權限並不完全相同。
1. Gemini Omni 1.1 Flash 是甚麼?先分清「影片模型」與「Gemini 聊天」
Gemini Omni 1.1 Flash 是一個面向影片生成、影片編輯與連續修改的多模態模型。Google 的開發者文件把模型定位為高速度影片生成及編輯工具,支援文字生成影片、圖片生成影片、影片編輯、首尾幀插值及場景延伸;影片亦可帶有模型生成的音訊。
所以,「Gemini Omni」不等於整個 Gemini 應用程式,也不應理解成一個新的通用聊天模型。較準確的說法是:Gemini App、Google Flow、Google AI Studio 或企業平台可以成為入口,而 Omni 1.1 Flash 是背後負責生成及編輯影片的模型。
這個分別對企業尤其重要。使用者如果只想在介面內製作一段短片,關心的是帳戶是否見到功能、配額及輸出權限;開發者如果要把影片生成接入產品,則要關心模型 ID、API 地區、收費、資料處理方式與錯誤處理。兩者不能混為一談。
開發者更新:舊預覽模型代號是 gemini-omni-flash-preview。Google 的 Gemini API 更新紀錄表示,該預覽端點將於 2026 年 9 月 30 日進入棄用狀態;現有整合應評估轉用正式版。
2. 五項核心升級:由「生成一段片」變成較可控制的製作流程
第一,場景延伸(scene extension)。Omni 1.1 Flash 可分析最多 10 秒的先前內容,再以 10 秒為一個增量延伸影片,累計最長 40 秒。這不等於一次生成一條 40 秒完整影片,而是逐段延伸,讓創作者每一段都可以重新判斷故事方向。Google 的 Omni 1.1 發布說明列出了場景延伸、首尾幀、360p 草稿、升頻及影片參考等更新。
第二,首尾幀控制(first and last frame interpolation)。創作者可指定開始與結束畫面,模型負責生成中間的連續運動。這對運鏡、場景轉換、循環片段及產品由一個狀態過渡到另一個狀態特別實用。
第三,360p 快速草稿。Google 表示,360p 相對標準 720p 可快最多 60%,成本約為三分之一;「最多 60%」是按系統吞吐量比較,不代表每次生成都固定快 60%。最合理的用途是先測構圖、節奏與創意方向,確認後才輸出高解像版本。
第四,1080p 與 4K 輸出。這兩個解像度由升頻(upscaling)產生,不是原生 4K 生成。升頻可以改善交付尺寸,但不能自動修正角色、文字、產品細節或動作邏輯。
第五,影片參考與多輪編輯。官方文件支援最多三段影片參考,每段最長 3 秒;參考片的音訊會被忽略。這適合借用人物外觀、物件或動作線索,但不應理解成模型會完整複製一段參考影片的所有細節。

3. Gemini Omni 1.1 Flash 規格、價錢與入口一表看清
以下資料以 Google 於 2026 年 8 月 27 日公布的模型規格、開發者指南及價格頁為準。價格、配額、地區及帳戶資格都可能更新,正式使用前應再核對官方頁面。
| 項目 | 官方資料(截至 2026-08-27) | 實務解讀 |
|---|---|---|
| 正式模型 ID | gemini-omni-1.1-flash(GA) |
開發整合不要再以舊 preview 名稱作長期設定 |
| 單次影片輸出 | 3–10 秒、24 FPS | 較適合以短段落組合,而非一次完成長片 |
| 場景延伸 | 每次 10 秒,累計最長 40 秒;可參考最多 10 秒前文 | 40 秒是逐段延伸的累計上限 |
| 解像度 | 360p、720p(預設)、1080p、4K | 1080p 及 4K 均為升頻輸出,不是原生生成 |
| 音訊 | 影片可帶原生音訊輸出 | 語音編輯與上載音訊參考目前不支援 |
| 影片參考 | 最多 3 段,每段最長 3 秒;參考音訊被忽略 | 用作外觀或動作線索,仍需檢查一致性 |
| API 價格 | 無免費層;720p 有效影片輸出約 US$0.10/秒 | 10 秒 720p 約 US$1,只計影片輸出估算;其餘輸入/輸出另按官方表計算 |
| 開發者入口 | Gemini API/Google AI Studio、Gemini Enterprise Agent Platform | Developer API 與企業平台的地區及權限可不同 |
| 創作者入口 | Google Flow;Gemini App 提供場景延伸 | Google 指 Plus、Pro、Ultra 訂閱者全球推出,但仍須以帳戶實際顯示為準 |
| 來源識別 | 所有生成影片加入不可見 SynthID | 有助來源驗證,但不取代版權、同意及內容審批 |
對一般創作者,最有用的數字未必是「4K」,而是 360p 草稿成本約為 720p 的三分之一。AI 影片通常要生成多個版本才找到合適方向;把早期探索放在低解像度,可避免每次試錯都付出完整輸出成本。
4. 香港用戶可否使用?「全球推出」不等於所有入口已直接開放
這一點必須說清楚。Google 的最新 Google AI Studio/Gemini API 支援地區清單列出新加坡、台灣等地,但截至頁面最新版本並沒有列出香港。官方亦建議,不在清單內的地區可研究 Gemini Enterprise Agent Platform。換句話說,香港團隊不應直接假設可以用 Developer API key 在本地環境接入 gemini-omni-1.1-flash。
另一方面,Google 的 Omni 1.1 發布文章表示,功能會向 Google AI Plus、Pro 及 Ultra 訂閱者在 Google Flow 全球推出,而 Gemini App 亦會向上述訂閱者提供場景延伸。這個「全球」描述的是產品推出範圍,不等於每個香港帳戶、每項功能、每個工作或學校帳戶,以及每個 API 入口都同時可用。
- 先確認要用的是 Gemini App、Google Flow、Google AI Studio、Developer API,還是企業平台;
- 在實際帳戶查看 Omni 1.1、場景延伸、首尾幀及輸出解像度是否出現;
- 核對訂閱層級、配額、商業使用條款、資料處理及可用地區;
- 如果要接入正式產品,先以小型測試驗證計費、延遲、錯誤處理及內容安全,不要把消費者介面的可用性當成 API 生產保證。

5. 最實際工作流:360p 起稿,再用控制點逐步收窄
Omni 1.1 Flash 最值得採用的,不是一句「幫我整條廣告片」,而是一個可比較、可覆核的製作流程:
- 先定商業目標與限制:影片服務認知、產品示範、名單收集還是轉換?哪些產品細節、價錢與聲稱不可改?
- 先做分鏡及首尾畫面:把每段要完成的動作、鏡頭、人物、畫面文字與聲音寫清楚。
- 以 360p 產生多個草稿:每次只改一個主要變數,例如 Hook、運鏡或場景,方便比較。
- 用首尾幀、參考片及延伸修正:不是不斷重抽,而是以控制點收窄結果。
- 先在 720p 驗收,再決定是否升頻:確定人物、產品、節奏與內容正確後,才輸出 1080p 或 4K。
- 把字幕、Logo、價錢及 CTA 放回可控制的後製流程:關鍵商業文字不宜只依賴生成畫面。

這個方法同樣適用於社交短片、產品概念片及廣告素材。想進一步了解 AI 影片如何接回目標、投放與成效測試,可參考 AD-Linkage 的AI 廣告影片製作及人手審批流程;兩種工具不宜只按畫質作排名,應按入口、控制方式、成本、語言及實際工作流選擇。
6. 仍要人手判斷:語言、權利、畫面準確與複雜動作
Google 的開發者指南列明,現階段只有英文獲完整支援,其餘語言尚未完成評估,結果可能不同。香港團隊即使用中文構思,也應測試英文 Prompt 是否較穩定,再把最終繁體中文文字放入可控的後製工具。
API 還有幾項明確限制:不能上載音訊作參考、不能編輯聲音、影片參考會忽略音訊、上載影片的延伸只可加在片尾,亦不支援在片段中間插入延伸。官方亦建議影片編輯指令保持簡潔,過度描述可能帶來非預期改動。
至於角色一致性、畫面文字與複雜多人動作,Omni 1.1 的控制能力確有增加,但「可控制」不等於「每次準確」。發布前仍要逐格檢查:
- 產品包裝、顏色、比例、按鈕及使用方法是否真實;
- 品牌名、價錢、優惠、網址及繁體中文字是否正確;
- 真人外貌、聲音、圖片、影片及音樂是否已獲適當授權;
- 複雜動作、手部、物理互動與鏡頭連續性是否合理;
- 廣告功效、比較、限時及成果聲稱是否有證據支持。
所有生成影片會加入 SynthID,有助驗證內容由 Google AI 產生,但 SynthID 並不是商業使用授權,也不代表影片已通過品牌、法規或廣告平台審批。
香港團隊的實務判斷
- 適合先試:分鏡概念、社交短片草稿、產品情境、鏡頭過渡與多版本創意測試。
- 需要加強測試:繁體中文畫面文字、長時間角色一致性、多人互動及複雜產品操作。
- 不可省略:素材權利、人物同意、產品真實性、廣告聲稱、字幕與最終人工審批。
總結:Gemini Omni 1.1 Flash 的真正升級,不是「一按就有 4K」,而是讓 AI 影片多了草稿、首尾幀、參考、延伸與升頻等控制點。對香港創作者及企業而言,最合理的做法是先核實入口,再用 360p 低成本測試,把 AI 放在製作流程中加快探索;品牌方向、權利、準確性與發布決定仍由人負責。
將模型新聞變成真正工作能力
PCPPMAI AI 實戰課程
學習把多模態創作、工具選擇、工作流程設計及人工覆核連接起來,不只追逐單一新模型。
課程已列入持續進修基金可獲發還款項課程名單;實際發還視乎個人資格、CEF 餘額、修畢要求、申請程序及最新條款,並非保證獲批。
常見問題 FAQ
1. Gemini Omni 1.1 Flash 是聊天機械人嗎?
不是。Gemini Omni 1.1 Flash 是生成及編輯影片的模型,可透過 Gemini App、Google Flow、Google AI Studio、Gemini API 或企業平台等入口使用;各入口的功能及資格不同。
2. Gemini Omni 1.1 Flash 可以原生生成 4K 影片嗎?
不可以這樣理解。Google 文件列明,1080p 及 4K 是升頻輸出;720p 是預設解像度。升頻提高輸出尺寸,但不會自動修正內容錯誤。
3. 香港用戶可以直接使用 Gemini Omni 1.1 Flash API 嗎?
不能直接假設可以。Google 最新的 Google AI Studio/Gemini API 支援地區清單未列香港;Flow、Gemini App 及企業平台則有不同推出與地區安排,應以實際帳戶及官方最新頁面核實。
4. Gemini Omni 1.1 Flash 收費幾多?
Gemini API 沒有免費層。Google 公布的標準 720p 影片輸出有效價格約為每秒 US$0.10;輸入、文字輸出、不同平台配額及訂閱費用應以官方價格頁為準。
5. Omni 1.1 生成的影片可否直接用作廣告?
不建議未經審批直接投放。品牌文字、產品細節、人物及素材權利、複雜動作、字幕、CTA 與廣告聲稱都要人手檢查;SynthID 只協助來源識別,不等於商業授權或合規批准。
官方資料來源
- Google:Gemini Omni 1.1 Flash 發布與新功能
- Google AI for Developers:Gemini Omni Flash 模型規格
- Google AI for Developers:Omni 影片生成、編輯、延伸與限制
- Google AI for Developers:Gemini API 價格
- Google AI for Developers:Google AI Studio/Gemini API 支援地區
- Google:Flow 的 Omni 1.1 創作控制更新
- Google AI for Developers:Gemini API 更新紀錄
資料核對日期:2026 年 8 月 29 日。模型功能、價格、入口、地區及服務條款可能更新,使用前請再以 Google 官方頁面為準。
