Gemini Omni 正式全球開放:影片風格切換完整教學
Gemini Omni 於 2026 年 5 月 28 日正式向全球用戶開放。這是 Google 在 I/O 2026 發表的新一代多模態影片生成模型,核心能力是「用對話改影片」——上傳照片或影片,輸入文字指令,就能套用動畫、電影感、插畫等不同視覺風格。
Gemini Omni 是什麼?
Gemini Omni 是 Google 在 2026 年 5 月 19 日 I/O 大會上正式發表的影片生成模型。它基於多模態架構,能同時理解文字、圖片、影片三種輸入類型,並透過自然語言指令進行風格轉換和內容編輯。
與前代模型相比,Gemini Omni 最大的突破在於指令的上下文記憶:每次編輯指令都能承接上一步的脈絡,角色外觀保持一致,物理邏輯合理,場景細節會記住前一幕發生的事。這解決了過去 AI 影片編輯中「每次都從頭生成」的痛點。
哪些用戶可以使用 Gemini Omni?
| 平台 / 方案 | 是否可用 | 備注 |
|---|---|---|
| Google AI Plus | ✅ 可用 | Gemini app + Google Flow |
| Google AI Pro | ✅ 可用 | Gemini app + Google Flow |
| Google AI Ultra | ✅ 可用 | 最高配額 |
| YouTube Shorts | ✅ 免費 | 免費開放 |
| YouTube Create App | ✅ 免費 | 免費開放 |
| Gemini API | 🔜 即將開放 | 預計幾週後 |
目前最直接的使用方式是透過 Google AI 訂閱方案,或在 YouTube Shorts 的創作功能中試用免費版本。
如何使用 Gemini Omni 做風格切換
步驟一:進入 Gemini app 或 Google Flow
登入 Google 帳號後,前往 gemini.google.com 或 labs.google/flow。Google AI Plus 以上方案可完整使用 Omni 功能。
步驟二:上傳素材
可上傳的素材類型:
- 單張照片(轉換成動態影片)
- 短片(套用風格)
- 多張照片(合成敘事影片)
步驟三:輸入風格指令
直接用中文或英文描述你想要的風格,例如:
- 「把這段影片改成日系動畫風格」
- 「保留人物,把背景換成電影感黃昏場景」
- 「加上復古膠片質感,顏色偏暖」
步驟四:連續對話調整
Gemini Omni 支援多輪對話,你可以繼續說:
- 「顏色再暗一點」
- 「人物表情維持原樣」
- 「加入輕微的鏡頭抖動」
每一步的修改都會保留前面確認的設定,不需要重新描述整個畫面。
Gemini Omni Flash 版本差異
Gemini Omni Flash 是 Omni 的輕量版本,主要特性:
- 生成速度更快(適合快速預覽)
- 消耗點數較少
- 可在免費額度內使用
- 適合批量測試不同風格再選定最終版本
在正式輸出前,用 Flash 版本先試好方向,再切換 Pro 版生成高品質版本,是目前用戶普遍採用的工作流程。
Google 官方額度的限制
Gemini Omni 雖然功能強大,但官方額度有上限。以 Google AI Pro(月費約台幣 650 元)為例,每月影片點數有限,高頻率創作者或需要批量生成的商業用途會遇到瓶頸。
如果你需要跨模型比較或大量批量生成,可以到 aivideospeed.com/pricing 看看——整合了 Google Veo、Kling v2 旗艦版、Seedance 2.0 等多款主流模型,體驗版 NT$299 起,額度不受單一平台限制。
FAQ
Q:Gemini Omni 和 Veo 3.1 有什麼差別?
A:Veo 3.1 是底層影片生成模型,Gemini Omni 是在其基礎上加入了多模態理解和對話式編輯能力的應用層。Gemini Omni 讓你可以用自然語言迭代修改影片,Veo 3.1 則更適合從零開始生成新影片。
Q:Gemini Omni 支援中文指令嗎?
A:支援。可以直接用繁體或簡體中文輸入風格描述,模型對台灣慣用詞彙的理解也在持續優化。
Q:免費用戶能用 Gemini Omni 嗎?
A:YouTube Shorts 和 YouTube Create App 的 Omni 功能目前免費開放。Gemini app 內的完整功能需要 Google AI Plus 以上方案。
Q:影片輸出格式是什麼?
A:目前主要支援 MP4 格式,解析度依訂閱方案不同,Ultra 方案可輸出較高畫質。
Q:API 什麼時候開放?
A:Google 在 5 月底公告「預計幾週後推出」,開發者可在 Google AI Studio 訂閱更新通知。