- Gemini Omni是什麼?為什麼能「用聊的」生成影片?
- Gemini Omni可以做什麼?4大核心功能
- Gemini Omni怎麼用?5步驟操作教學
- Gemini Omni 費用怎麼算?免費和付費差在哪
- Gemini Omni 和 Veo 差在哪、該選哪一個?
- Gemini Omni 的 Prompt 怎麼寫?一套公式加範例
- Gemini Omni影片長度與使用限制
- Gemini Omni常見問題
過去要做一支 AI 影片,得先把整段畫面「一次講完」,改一個細節往往就要整支重生成。Google 推出的 Gemini Omni 換了一種玩法:你先生成一版,再像聊天一樣一句一句下指令,畫面就跟著改,而且前後場景會保持一致。Google 官方把它形容成「影片版的 Nano Banana」。如果你用過 Nano Banana 改圖那種「打一句話、圖就變」的手感,Gemini Omni 等於把同一套直覺搬到會動的畫面上。
這篇會帶你搞懂 Gemini Omni 是什麼、實際能做什麼、怎麼上手、要花多少錢、和 Veo 差在哪,以及目前有哪些限制。
Gemini Omni是什麼?為什麼能「用聊的」生成影片?

圖源:Google DeepMind官方
Gemini Omni 是 Google 最新的多模態 AI 影片生成與編輯模型,背後的模型版本叫 Gemini Omni Flash。它建立在 Gemini 本身對世界的理解與原生多模態能力上,所以不只是「把文字變成影片」,還能讀懂你丟進去的圖片、影片、聲音,再把它們揉成一支連貫的成品。
它最大的特色是對話式生成。傳統文字轉影片工具,你的一段提示詞下去就決定生死;Gemini Omni 則允許你「邊看邊改」:生成第一版之後,你可以接著說「把背景換成夜晚」「鏡頭改成過肩視角」「讓這個角色換成另一個人」,而每一次修改都會延續上一版的畫面,不會整支打掉重來。這也是 Google 拿它跟Nano Banana類比的原因:Nano Banana 讓修圖變成一場對話,Gemini Omni 則把這種「聊著聊著就改好」延伸到影片。
值得先知道的一點:Gemini Omni Flash 將在 Gemini 應用程式中取代原本的 Veo 3.1,成為主要的影片生成與編輯模型。
Gemini Omni可以做什麼?4大核心功能

圖源:Google DeepMind官方
Gemini Omni 的能力可以濃縮成四塊。
混合文字、圖片、影片及音訊生成影片
你不必只靠純文字。Gemini Omni 接受文字、圖片、影片、音訊的任意組合當輸入,再整合成單一支影片。舉例來說,你可以丟一張角色圖、一段參考動作影片、再加一句想要的風格描述,讓它把這些素材合成一個畫面;照片參考最多可以放到 5 張。它也能原生生成聲音,讓畫面和音效一起產出,而不是事後再配音。
透過多輪對話持續編輯影片
這是 Gemini Omni 的招牌能力。生成之後,你可以一輪一輪地下修改指令,例如換角色、調整光線、穩定畫面、抽換背景、加特效,而模型會維持整個場景的一致性,讓你像在跟剪輯師對話一樣,一步步把畫面調到理想狀態。它同時支援影片轉影片編輯,也就是直接丟一支既有影片進去改。
結合世界知識與物理現象
Gemini Omni 不只是「畫得像」,它還理解真實世界的運作邏輯。一方面,它對重力、動能、流體這類物理現象有直覺,動作看起來更自然;另一方面,它承接了 Gemini 對歷史、科學、文化脈絡的知識,能把知識型內容用有條理的方式演出來,例如做一支解釋蛋白質摺疊的黏土風格說明影片。
修改場景、動作、風格及物件
你可以用一句話大幅改動畫面內容:轉換整體美術風格(例如把實拍轉成線稿、3D voxel 或全息投影感)、重新設定畫面裡發生的事、套用某張圖或某支影片的動態與風格,甚至直接把畫面中的某個角色或物件替換掉,而畫面其他部分仍保持連貫。
Gemini Omni怎麼用?5步驟操作教學

圖源:Google DeepMind官方
Gemini Omni 目前可以在 Gemini 應用程式與 Google Flow 裡使用(Google Flow 是 Google 的 AI 創作工作室)。以下用最簡單的流程說明。
步驟一:進入Gemini App或Google Flow
用你的 Google 帳戶登入 Gemini 應用程式,或前往 Google Flow。在這兩個入口使用 Gemini Omni 的完整功能需要付費方案(想免費先試可用 YouTube Shorts/Create),這點下一段費用會細說。
步驟二:選擇Gemini Omni Flash
在影片生成的介面中,把模型切換到 Gemini Omni Flash。在 Google Flow 裡,它會作為可用的影片生成模型出現。
步驟三:輸入指令並上傳參考素材
打上你想要的畫面描述,並視需要上傳參考素材,可以是圖片(最多 5 張)、一段影片,或一段音訊。指令寫得越具體(主體、動作、鏡頭、風格、聲音),成品越接近你的想像。
步驟四:生成第一版影片
送出後,Gemini Omni 會產出第一版約 10 秒的影片。先把它當草稿看,不用一次到位。
步驟五:透過對話修改並下載影片
覺得哪裡不對,就直接用對話講出來,例如「把背景換成海邊」「鏡頭拉遠一點」「這個物件換成紅色」。模型會在保留原場景的前提下修改。滿意後即可下載使用。
Gemini Omni 費用怎麼算?免費和付費差在哪
先講結論:Gemini Omni 有免費管道,但也有付費門檻,差別在你從哪裡用。想在 YouTube 上玩,免費就能碰;想在 Gemini 應用程式或 Google Flow 用完整功能,才需要付費方案。以下拆開講,並附上台灣定價。
Gemini Omni可以免費使用嗎?
可以,但看管道。YouTube Shorts 與 YouTube Create app 有提供免費的 Gemini Omni Flash 體驗,只要年滿 18 歲、不用訂閱就能試對話式生影片,這是目前門檻最低的入口。
不過在 Gemini 應用程式與 Google Flow 裡,完整的影片生成與多輪編輯功能需要訂閱 Google AI 付費方案;純免費的 Google 帳號進到 Gemini,多半只能用到基礎的 Omni Flash,遇到影片生成時容易碰上排隊等待與每日配額偏低的限制。想穩定、完整地使用,最低要從 Google AI Plus 開始。
Google AI Plus、Pro與Ultra方案比較
三個方案都能使用 Gemini Omni Flash,差別主要在用量、Google Flow 點數與其他附加福利。以台灣定價為例:
| 方案 | 月費(台灣) | 影片/Omni 相關重點 |
|---|---|---|
| Google AI Plus | NT$260 | 免費版 2 倍用量、Google Flow 200 點、可用 Gemini Omni Flash |
| Google AI Pro | NT$650 | 免費版 4 倍用量、Google Flow 1,000 點 |
| Google AI Ultra | NT$3,300 起(另有 NT$6,500 更高用量版) | Google Flow 10,000~25,000 點、最高用量 |
想在 Gemini 應用程式或 Google Flow 裡穩定使用完整功能,從最便宜的 Google AI Plus(每月 NT$260)就能上手;新用戶前兩個月常有五折優惠,等於約每月 NT$130。此外,Google AI 方案支援與最多 5 位家庭成員共享,分攤下來每人負擔會更低。
補充兩點:
用量算法:Gemini 應用程式的用量以「運算量」計算,會隨提示詞複雜度、使用的功能與對話長度變動,
每 5 小時重置一次、直到達到每週上限,用完還能另外購買 AI 點數加量。功能差異:部分功能可能因方案級別、平台(網頁/行動)與地區而異,實際方案內容以官方訂閱頁為準。
Gemini Omni 和 Veo 差在哪、該選哪一個?
很多人會把 Gemini Omni 和 Veo 搞混,因為兩者都是 Google 的影片模型。簡單分:
- Gemini Omni Flash 是新的多模態生成+編輯模型,將在 Gemini 應用程式中取代 Veo 3.1。它的強項是多模態輸入、對話式多輪編輯,以及對世界知識與物理的理解,適合「先生成、再一句一句改」以及把多種素材合成一支影片的流程。
- Veo 則是 Google 偏電影感生成路線的專門模型,強調高品質的文字轉影片。
該選哪個?如果你的需求是邊聊邊改、拿現成素材去編輯、要求畫面遵循真實邏輯,Gemini Omni 更順手;如果你想的是「一句話直接生成一段有電影感的畫面」,Veo 的取向仍然存在。對多數在 Gemini 應用程式裡創作的人來說,現在預設接觸到的會是 Gemini Omni。
Gemini Omni 的 Prompt 怎麼寫?一套公式加範例

圖源:Google DeepMind官方
一個能重複套用的 Prompt 結構
主體:畫面裡的人、物、場景。
動作/觸發:要發生什麼事,或「當某事發生時」的條件(例如「當手打開時,掌心浮現一顆星球」)。
鏡頭視角:運鏡與角度,例如「鏡頭慢慢推近」「過肩視角」。
風格/材質:寫實、線稿、黏土定格、3D 全息等。
音訊:要背景音樂、還是「只要真實環境音、不要配樂」。
限制條件:時長(例如 10 秒)、比例(例如 16:9)、以及「不要出現什麼」。
把這六格填滿,成品的可控度會明顯提高。
依情境的範例
商品介紹:白色背景中一瓶保養品緩慢旋轉,柔和棚拍打光,鏡頭微微推近,寫實風格,只要輕柔背景音樂,10 秒,16:9。
知識解說:用黏土定格風格解釋一個科學概念,全部由黏土構成、無人手入鏡,畫面與旁白同步,不要在結尾突然斷音。
物理模擬:一顆彈珠在連續軌道上快速滾動的一鏡到底畫面,只要真實碰撞聲、不要配樂。
風格轉換:拿一段實拍影片,指令「當人物觸碰鏡子時,整個環境轉成 3D voxel 風格」,其餘畫面維持不變。
同一素材多輪修改前後對比
Gemini Omni 的價值在多輪。舉個流程:先用一段小提琴手演奏的影片當輸入 →(第一輪)「把演奏者移到一片麥田場景」→(第二輪)「讓小提琴變透明」→(第三輪)「鏡頭改成從演奏者肩膀後方拍」。每一輪都只改一件事,模型會延續前一版的畫面,你就能清楚看到每一步的前後差異,而不是每次都得到一支全新的、對不上的影片。
Gemini Omni影片長度與使用限制

圖源:Google DeepMind官方
再強的工具也有邊界,先了解才不會踩雷。
Gemini Omni一次可以生成多長的影片?
目前 Gemini Omni 單次生成的是約 10 秒的短影片。想做更長的內容,實務上得靠多段生成再自行銜接。
複雜動作及多人場景可能不穩定
雖然 Gemini Omni 對物理有不錯的理解,但高速、複雜或多人同時互動的場景仍是各家 AI 影片模型共同的難點,容易出現動作不連貫或細節錯位。遇到這種情況,建議把畫面拆簡單一點,或用多輪編輯逐步修。
中文文字、旁白及影音同步限制
Gemini Omni 設計上能把「畫面上的文字」和「正在發生的動作」對起來,也能生成旁白。不過就實務經驗,畫面內的中文文字仍可能出現錯字或變形,旁白與嘴型、動作的同步在複雜情境下也未必完美。牽涉到精準中文字卡的內容,成品最好逐支檢查。
方案額度與生成速度限制
如前面費用段所說,Gemini 應用程式採運算量計費,每 5 小時重置、直到週上限;Google Flow 端則吃點數(Plus 200 點、Pro 1,000 點、Ultra 10,000~25,000 點)。用量與生成速度會因方案級別而不同,量大的人要留意額度消耗。
SynthID及C2PA內容標記
所有透過 Gemini 應用程式、Google Flow 或 YouTube 用 Omni 生成、編輯的內容,都會嵌入 Google 的 SynthID 隱形浮水印與 C2PA 內容憑證。這些標記肉眼看不到,但可以用來辨識內容是否由 Google AI 生成,你甚至可以把檔案丟回 Gemini 詢問是否為 AI 產物。對商用或需要標示 AI 內容的情境,這點要先納入考量。
Gemini Omni常見問題
Gemini Omni在台灣可以使用嗎?
可以。Gemini Omni 已在所有 Gemini 應用程式支援的語言與市場推出,台灣在支援範圍內。使用者需年滿 18 歲,並持有 Google AI Plus、Pro 或 Ultra 其中一種方案。要留意的是,Avatar、影片轉影片編輯等部分功能,可能因所在地區而有限制。
Gemini Omni支援中文指令嗎?
支援。Gemini Omni 在 Gemini 應用程式所有可用語言的市場都能使用,你可以用中文下指令。不過如前所述,畫面中要生成的中文文字仍可能出錯,這和「聽不聽得懂中文指令」是兩回事,實作時分開看待。
Gemini Omni生成的影片有浮水印嗎?
有,但是看不見的。所有產出都會帶 SynthID 隱形浮水印與 C2PA 內容憑證,不會在畫面上留下可見的 logo,而是用於辨識這是不是 Google AI 生成的內容。
Gemini Omni 把 AI 影片從「一次講完、改就重來」帶到「先生成、再對話式微調」的階段,對需要反覆修改的創作者來說是明顯的效率提升。先從一個簡單的 10 秒草稿開始,習慣用一句一句的方式把畫面調到位,會比一開始就想寫出完美提示詞更容易上手。
相關文章

Gemini Storybook 一學就會!AI 繪本製作教學與實測成果分享
Gemini Storybook 是 Google 推出的生成式 AI 工具,主打幫助使用者快速產出圖文並茂的故事繪本。它結合文字生成、圖片生成與語音功能,讓你只需輸入簡單的 prompt,就能產出完整的有聲 AI 繪本,適合用於親子共讀、創意教學或個人創作。 這項工具特別適合不擅長繪圖或寫故事的新手,只需幾個簡單步驟,即可快速產出具有視覺吸引力與敘事性的電子繪本,並支援繁體中文。
最後更新: 2026/06/30

Gemini Nano Banana 教學:AI 指令大全與商品圖生成攻略
想讓商品圖瞬間變得吸睛又高質感嗎?Google 推出的 Gemini Nano Banana 正是電商與創作者的新武器。無論你想生成公仔風商品照、美食擺拍圖,還是模特展示照,只要輸入指令,AI 就能幫你完成專業性圖片。以下將帶你一步步了解 Nano Banana 是什麼、怎麼用、以及最實用的 Nano Banana 指令教學。
最後更新: 2026/06/30

Gemini 2.0 Flash怎麼用?AI改圖、改照片、繪圖全功能一次看
你是否曾經希望,只需幾個指令,就能將照片修成完美風格?或者渴望用AI製作出創意滿滿的繪圖作品?今天的Gemini 2.0 Flash專題要為您介紹的,是由Google推出的最新AI影像處理工具「Gemini 2.0 Flash」,這個版本不僅性能優化,更結合了多輪對話、快速編輯與圖像生成等強大功能。如果您想深入了解如何使用這款全能型AI繪圖與修圖神器,那就絕對不能錯過本篇文章,我們將一次帶您完整掌握Gemini 2.0 Flash的操作重點。
最後更新: 2026/07/09

