Logo
關閉側邊欄
  • 首頁
  • editIcon文字工具gradientUpIcon
  • AI 助手
    熱門
  • AI 圖文工作台升級版
  • imageIcon媒體工具gradientUpIcon
  • additionIcon更多工具gradientDownIcon
註冊並獲得 20,000 個免費 tokens!

Gemini Omni 教學:用講的就能生成、修改影片,費用與限制一次搞清楚

首頁 » 教學文章 » Gemini Omni 教學:用講的就能生成、修改影片,費用與限制一次搞清楚
CalendarIcon

2026/07/31

Google Gemini Omni功能、使用教學、費用與影片限制

文章目錄
  1. Gemini Omni是什麼?為什麼能「用聊的」生成影片?
  2. Gemini Omni可以做什麼?4大核心功能
  3. Gemini Omni怎麼用?5步驟操作教學
  4. Gemini Omni 費用怎麼算?免費和付費差在哪
  5. Gemini Omni 和 Veo 差在哪、該選哪一個?
  6. Gemini Omni 的 Prompt 怎麼寫?一套公式加範例
  7. Gemini Omni影片長度與使用限制
  8. Gemini Omni常見問題

過去要做一支 AI 影片,得先把整段畫面「一次講完」,改一個細節往往就要整支重生成。Google 推出的 Gemini Omni 換了一種玩法:你先生成一版,再像聊天一樣一句一句下指令,畫面就跟著改,而且前後場景會保持一致。Google 官方把它形容成「影片版的 Nano Banana」。如果你用過 Nano Banana 改圖那種「打一句話、圖就變」的手感,Gemini Omni 等於把同一套直覺搬到會動的畫面上。

這篇會帶你搞懂 Gemini Omni 是什麼、實際能做什麼、怎麼上手、要花多少錢、和 Veo 差在哪,以及目前有哪些限制。

Gemini Omni是什麼?為什麼能「用聊的」生成影片?

Gemini Omni是什麼

圖源:Google DeepMind官方

Gemini Omni 是 Google 最新的多模態 AI 影片生成與編輯模型,背後的模型版本叫 Gemini Omni Flash。它建立在 Gemini 本身對世界的理解與原生多模態能力上,所以不只是「把文字變成影片」,還能讀懂你丟進去的圖片、影片、聲音,再把它們揉成一支連貫的成品。

它最大的特色是對話式生成。傳統文字轉影片工具,你的一段提示詞下去就決定生死;Gemini Omni 則允許你「邊看邊改」:生成第一版之後,你可以接著說「把背景換成夜晚」「鏡頭改成過肩視角」「讓這個角色換成另一個人」,而每一次修改都會延續上一版的畫面,不會整支打掉重來。這也是 Google 拿它跟Nano Banana類比的原因:Nano Banana 讓修圖變成一場對話,Gemini Omni 則把這種「聊著聊著就改好」延伸到影片

值得先知道的一點:Gemini Omni Flash 將在 Gemini 應用程式中取代原本的 Veo 3.1,成為主要的影片生成與編輯模型。

Gemini Omni可以做什麼?4大核心功能

Gemini Omni4大核心功能

圖源:Google DeepMind官方

Gemini Omni 的能力可以濃縮成四塊。

混合文字、圖片、影片及音訊生成影片

你不必只靠純文字。Gemini Omni 接受文字、圖片、影片、音訊的任意組合當輸入,再整合成單一支影片。舉例來說,你可以丟一張角色圖、一段參考動作影片、再加一句想要的風格描述,讓它把這些素材合成一個畫面;照片參考最多可以放到 5 張。它也能原生生成聲音,讓畫面和音效一起產出,而不是事後再配音。

透過多輪對話持續編輯影片

這是 Gemini Omni 的招牌能力。生成之後,你可以一輪一輪地下修改指令,例如換角色、調整光線、穩定畫面、抽換背景、加特效,而模型會維持整個場景的一致性,讓你像在跟剪輯師對話一樣,一步步把畫面調到理想狀態。它同時支援影片轉影片編輯,也就是直接丟一支既有影片進去改。

結合世界知識與物理現象

Gemini Omni 不只是「畫得像」,它還理解真實世界的運作邏輯。一方面,它對重力、動能、流體這類物理現象有直覺,動作看起來更自然;另一方面,它承接了 Gemini 對歷史、科學、文化脈絡的知識,能把知識型內容用有條理的方式演出來,例如做一支解釋蛋白質摺疊的黏土風格說明影片。

修改場景、動作、風格及物件

你可以用一句話大幅改動畫面內容:轉換整體美術風格(例如把實拍轉成線稿、3D voxel 或全息投影感)、重新設定畫面裡發生的事、套用某張圖或某支影片的動態與風格,甚至直接把畫面中的某個角色或物件替換掉,而畫面其他部分仍保持連貫。

Gemini Omni怎麼用?5步驟操作教學

5步驟Gemini Omni操作教學

圖源:Google DeepMind官方

Gemini Omni 目前可以在 Gemini 應用程式Google Flow 裡使用(Google Flow 是 Google 的 AI 創作工作室)。以下用最簡單的流程說明。

步驟一:進入Gemini App或Google Flow

用你的 Google 帳戶登入 Gemini 應用程式,或前往 Google Flow。在這兩個入口使用 Gemini Omni 的完整功能需要付費方案(想免費先試可用 YouTube Shorts/Create),這點下一段費用會細說。

步驟二:選擇Gemini Omni Flash

在影片生成的介面中,把模型切換到 Gemini Omni Flash。在 Google Flow 裡,它會作為可用的影片生成模型出現。

步驟三:輸入指令並上傳參考素材

打上你想要的畫面描述,並視需要上傳參考素材,可以是圖片(最多 5 張)、一段影片,或一段音訊。指令寫得越具體(主體、動作、鏡頭、風格、聲音),成品越接近你的想像。

步驟四:生成第一版影片

送出後,Gemini Omni 會產出第一版約 10 秒的影片。先把它當草稿看,不用一次到位。

步驟五:透過對話修改並下載影片

覺得哪裡不對,就直接用對話講出來,例如「把背景換成海邊」「鏡頭拉遠一點」「這個物件換成紅色」。模型會在保留原場景的前提下修改。滿意後即可下載使用。

Gemini Omni 費用怎麼算?免費和付費差在哪

先講結論:Gemini Omni 有免費管道,但也有付費門檻,差別在你從哪裡用。想在 YouTube 上玩,免費就能碰;想在 Gemini 應用程式或 Google Flow 用完整功能,才需要付費方案。以下拆開講,並附上台灣定價。

Gemini Omni可以免費使用嗎?

可以,但看管道。YouTube Shorts 與 YouTube Create app 有提供免費的 Gemini Omni Flash 體驗,只要年滿 18 歲、不用訂閱就能試對話式生影片,這是目前門檻最低的入口。

不過在 Gemini 應用程式與 Google Flow 裡,完整的影片生成與多輪編輯功能需要訂閱 Google AI 付費方案;純免費的 Google 帳號進到 Gemini,多半只能用到基礎的 Omni Flash,遇到影片生成時容易碰上排隊等待與每日配額偏低的限制。想穩定、完整地使用,最低要從 Google AI Plus 開始。

Google AI Plus、Pro與Ultra方案比較

三個方案都能使用 Gemini Omni Flash,差別主要在用量、Google Flow 點數與其他附加福利。以台灣定價為例:

方案月費(台灣)影片/Omni 相關重點
Google AI PlusNT$260免費版 2 倍用量、Google Flow 200 點、可用 Gemini Omni Flash
Google AI ProNT$650免費版 4 倍用量、Google Flow 1,000 點
Google AI UltraNT$3,300 起(另有 NT$6,500 更高用量版)Google Flow 10,000~25,000 點、最高用量

想在 Gemini 應用程式或 Google Flow 裡穩定使用完整功能,從最便宜的 Google AI Plus(每月 NT$260)就能上手;新用戶前兩個月常有五折優惠,等於約每月 NT$130。此外,Google AI 方案支援與最多 5 位家庭成員共享,分攤下來每人負擔會更低。

補充兩點:

  1. 用量算法:Gemini 應用程式的用量以「運算量」計算,會隨提示詞複雜度、使用的功能與對話長度變動,每 5 小時重置一次、直到達到每週上限,用完還能另外購買 AI 點數加量。

  2. 功能差異:部分功能可能因方案級別、平台(網頁/行動)與地區而異,實際方案內容以官方訂閱頁為準。

Gemini Omni 和 Veo 差在哪、該選哪一個?

很多人會把 Gemini Omni 和 Veo 搞混,因為兩者都是 Google 的影片模型。簡單分:

  • Gemini Omni Flash 是新的多模態生成+編輯模型,將在 Gemini 應用程式中取代 Veo 3.1。它的強項是多模態輸入、對話式多輪編輯,以及對世界知識與物理的理解,適合「先生成、再一句一句改」以及把多種素材合成一支影片的流程。

  • Veo 則是 Google 偏電影感生成路線的專門模型,強調高品質的文字轉影片。

該選哪個?如果你的需求是邊聊邊改、拿現成素材去編輯、要求畫面遵循真實邏輯,Gemini Omni 更順手;如果你想的是「一句話直接生成一段有電影感的畫面」,Veo 的取向仍然存在。對多數在 Gemini 應用程式裡創作的人來說,現在預設接觸到的會是 Gemini Omni。

Gemini Omni 的 Prompt 怎麼寫?一套公式加範例

Gemini Omni 的 Prompt一套公式加範例

圖源:Google DeepMind官方

一個能重複套用的 Prompt 結構

  • 主體:畫面裡的人、物、場景。

  • 動作/觸發:要發生什麼事,或「當某事發生時」的條件(例如「當手打開時,掌心浮現一顆星球」)。

  • 鏡頭視角:運鏡與角度,例如「鏡頭慢慢推近」「過肩視角」。

  • 風格/材質:寫實、線稿、黏土定格、3D 全息等。

  • 音訊:要背景音樂、還是「只要真實環境音、不要配樂」。

  • 限制條件:時長(例如 10 秒)、比例(例如 16:9)、以及「不要出現什麼」。

把這六格填滿,成品的可控度會明顯提高。

依情境的範例

  • 商品介紹:白色背景中一瓶保養品緩慢旋轉,柔和棚拍打光,鏡頭微微推近,寫實風格,只要輕柔背景音樂,10 秒,16:9。

  • 知識解說:用黏土定格風格解釋一個科學概念,全部由黏土構成、無人手入鏡,畫面與旁白同步,不要在結尾突然斷音。

  • 物理模擬:一顆彈珠在連續軌道上快速滾動的一鏡到底畫面,只要真實碰撞聲、不要配樂。

  • 風格轉換:拿一段實拍影片,指令「當人物觸碰鏡子時,整個環境轉成 3D voxel 風格」,其餘畫面維持不變。

同一素材多輪修改前後對比

Gemini Omni 的價值在多輪。舉個流程:先用一段小提琴手演奏的影片當輸入 →(第一輪)「把演奏者移到一片麥田場景」→(第二輪)「讓小提琴變透明」→(第三輪)「鏡頭改成從演奏者肩膀後方拍」。每一輪都只改一件事,模型會延續前一版的畫面,你就能清楚看到每一步的前後差異,而不是每次都得到一支全新的、對不上的影片。

Gemini Omni影片長度與使用限制

Gemini Omni影片長度與使用限制

圖源:Google DeepMind官方

再強的工具也有邊界,先了解才不會踩雷。

Gemini Omni一次可以生成多長的影片?

目前 Gemini Omni 單次生成的是約 10 秒的短影片。想做更長的內容,實務上得靠多段生成再自行銜接。

複雜動作及多人場景可能不穩定

雖然 Gemini Omni 對物理有不錯的理解,但高速、複雜或多人同時互動的場景仍是各家 AI 影片模型共同的難點,容易出現動作不連貫或細節錯位。遇到這種情況,建議把畫面拆簡單一點,或用多輪編輯逐步修。

中文文字、旁白及影音同步限制

Gemini Omni 設計上能把「畫面上的文字」和「正在發生的動作」對起來,也能生成旁白。不過就實務經驗,畫面內的中文文字仍可能出現錯字或變形,旁白與嘴型、動作的同步在複雜情境下也未必完美。牽涉到精準中文字卡的內容,成品最好逐支檢查。

方案額度與生成速度限制

如前面費用段所說,Gemini 應用程式採運算量計費,每 5 小時重置、直到週上限;Google Flow 端則吃點數(Plus 200 點、Pro 1,000 點、Ultra 10,000~25,000 點)。用量與生成速度會因方案級別而不同,量大的人要留意額度消耗。

SynthID及C2PA內容標記

所有透過 Gemini 應用程式、Google Flow 或 YouTube 用 Omni 生成、編輯的內容,都會嵌入 Google 的 SynthID 隱形浮水印C2PA 內容憑證。這些標記肉眼看不到,但可以用來辨識內容是否由 Google AI 生成,你甚至可以把檔案丟回 Gemini 詢問是否為 AI 產物。對商用或需要標示 AI 內容的情境,這點要先納入考量。

Gemini Omni常見問題

Gemini Omni在台灣可以使用嗎?

可以。Gemini Omni 已在所有 Gemini 應用程式支援的語言與市場推出,台灣在支援範圍內。使用者需年滿 18 歲,並持有 Google AI Plus、Pro 或 Ultra 其中一種方案。要留意的是,Avatar、影片轉影片編輯等部分功能,可能因所在地區而有限制。

Gemini Omni支援中文指令嗎?

支援。Gemini Omni 在 Gemini 應用程式所有可用語言的市場都能使用,你可以用中文下指令。不過如前所述,畫面中要生成的中文文字仍可能出錯,這和「聽不聽得懂中文指令」是兩回事,實作時分開看待。

Gemini Omni生成的影片有浮水印嗎?

有,但是看不見的。所有產出都會帶 SynthID 隱形浮水印與 C2PA 內容憑證,不會在畫面上留下可見的 logo,而是用於辨識這是不是 Google AI 生成的內容。

Gemini Omni 把 AI 影片從「一次講完、改就重來」帶到「先生成、再對話式微調」的階段,對需要反覆修改的創作者來說是明顯的效率提升。先從一個簡單的 10 秒草稿開始,習慣用一句一句的方式把畫面調到位,會比一開始就想寫出完美提示詞更容易上手。

立即使用GenApe AI,提升生產力和創造力!

與AI合作,加速你的工作流程!

立即前往

相關文章

defaultImage

Gemini Storybook 一學就會!AI 繪本製作教學與實測成果分享

Gemini Storybook 是 Google 推出的生成式 AI 工具,主打幫助使用者快速產出圖文並茂的故事繪本。它結合文字生成、圖片生成與語音功能,讓你只需輸入簡單的 prompt,就能產出完整的有聲 AI 繪本,適合用於親子共讀、創意教學或個人創作。 這項工具特別適合不擅長繪圖或寫故事的新手,只需幾個簡單步驟,即可快速產出具有視覺吸引力與敘事性的電子繪本,並支援繁體中文。

最後更新: 2026/06/30

defaultImage

Gemini Nano Banana 教學:AI 指令大全與商品圖生成攻略

想讓商品圖瞬間變得吸睛又高質感嗎?Google 推出的 Gemini Nano Banana 正是電商與創作者的新武器。無論你想生成公仔風商品照、美食擺拍圖,還是模特展示照,只要輸入指令,AI 就能幫你完成專業性圖片。以下將帶你一步步了解 Nano Banana 是什麼、怎麼用、以及最實用的 Nano Banana 指令教學。

最後更新: 2026/06/30

defaultImage

Gemini 2.0 Flash怎麼用?AI改圖、改照片、繪圖全功能一次看

你是否曾經希望,只需幾個指令,就能將照片修成完美風格?或者渴望用AI製作出創意滿滿的繪圖作品?今天的Gemini 2.0 Flash專題要為您介紹的,是由Google推出的最新AI影像處理工具「Gemini 2.0 Flash」,這個版本不僅性能優化,更結合了多輪對話、快速編輯與圖像生成等強大功能。如果您想深入了解如何使用這款全能型AI繪圖與修圖神器,那就絕對不能錯過本篇文章,我們將一次帶您完整掌握Gemini 2.0 Flash的操作重點。

最後更新: 2026/07/09

Assistant
LineButton