GenApeLogo
關閉側邊欄
  • 首頁
  • editIcon文字工具gradientUpIcon
  • AI 助手
    熱門
  • AI 圖文工作台升級版
  • imageIcon媒體工具gradientUpIcon
  • additionIcon更多工具gradientDownIcon
部落格
  • 註冊並獲得 145 個免費 Credits!

    Gemini Omni 教學:用講的就能生成、修改影片,費用與限制一次搞清楚

    首頁 » 教學文章 » Gemini Omni 教學:用講的就能生成、修改影片,費用與限制一次搞清楚
    CalendarIcon

    2026/08/05

    Google Gemini Omni功能、使用教學、費用與影片限制

    文章目錄
    1. Gemini Omni是什麼?為什麼能「用聊的」生成影片?
    2. Gemini Omni可以做什麼?4大核心功能
    3. Gemini Omni怎麼用?5步驟操作教學
    4. Gemini Omni 費用怎麼算?免費和付費差在哪
    5. Gemini Omni 和 Veo 差在哪、該選哪一個?
    6. Gemini Omni 的 Prompt 怎麼寫?一套公式加範例
    7. Gemini Omni影片長度與使用限制
    8. Gemini Omni常見問題

    過去要做一支 AI 影片,得先把整段畫面「一次講完」,改一個細節往往就要整支重生成。Google 推出的 Gemini Omni 換了一種玩法:你先生成一版,再像聊天一樣一句一句下指令,畫面就跟著改,而且前後場景會保持一致。Google 官方把它形容成「影片版的 Nano Banana」。如果你用過 Nano Banana 改圖那種「打一句話、圖就變」的手感,Gemini Omni 等於把同一套直覺搬到會動的畫面上。

    這篇會帶你搞懂 Gemini Omni 是什麼、實際能做什麼、怎麼上手、要花多少錢、和 Veo 差在哪,以及目前有哪些限制。

    Gemini Omni是什麼?為什麼能「用聊的」生成影片?

    Gemini Omni是什麼

    圖源:Google DeepMind官方

    Gemini Omni 是 Google 最新的多模態 AI 影片生成與編輯模型,背後的模型版本叫 Gemini Omni Flash。它建立在 Gemini 本身對世界的理解與原生多模態能力上,所以不只是「把文字變成影片」,還能讀懂你丟進去的圖片、影片、聲音,再把它們揉成一支連貫的成品。

    它最大的特色是對話式生成。傳統文字轉影片工具,你的一段提示詞下去就決定生死;Gemini Omni 則允許你「邊看邊改」:生成第一版之後,你可以接著說「把背景換成夜晚」「鏡頭改成過肩視角」「讓這個角色換成另一個人」,而每一次修改都會延續上一版的畫面,不會整支打掉重來。這也是 Google 拿它跟Nano Banana類比的原因:Nano Banana 讓修圖變成一場對話,Gemini Omni 則把這種「聊著聊著就改好」延伸到影片。

    值得先知道的一點:Gemini Omni Flash 將在 Gemini 應用程式中取代原本的 Veo 3.1,成為主要的影片生成與編輯模型。

    Gemini Omni可以做什麼?4大核心功能

    Gemini Omni4大核心功能

    圖源:Google DeepMind官方

    Gemini Omni 的能力可以濃縮成四塊。

    混合文字、圖片、影片及音訊生成影片

    你不必只靠純文字。Gemini Omni 接受文字、圖片、影片、音訊的任意組合當輸入,再整合成單一支影片。舉例來說,你可以丟一張角色圖、一段參考動作影片、再加一句想要的風格描述,讓它把這些素材合成一個畫面;照片參考最多可以放到 5 張。它也能原生生成聲音,讓畫面和音效一起產出,而不是事後再配音。

    透過多輪對話持續編輯影片

    這是 Gemini Omni 的招牌能力。生成之後,你可以一輪一輪地下修改指令,例如換角色、調整光線、穩定畫面、抽換背景、加特效,而模型會維持整個場景的一致性,讓你像在跟剪輯師對話一樣,一步步把畫面調到理想狀態。它同時支援影片轉影片編輯,也就是直接丟一支既有影片進去改。

    結合世界知識與物理現象

    Gemini Omni 不只是「畫得像」,它還理解真實世界的運作邏輯。一方面,它對重力、動能、流體這類物理現象有直覺,動作看起來更自然;另一方面,它承接了 Gemini 對歷史、科學、文化脈絡的知識,能把知識型內容用有條理的方式演出來,例如做一支解釋蛋白質摺疊的黏土風格說明影片。

    修改場景、動作、風格及物件

    你可以用一句話大幅改動畫面內容:轉換整體美術風格(例如把實拍轉成線稿、3D voxel 或全息投影感)、重新設定畫面裡發生的事、套用某張圖或某支影片的動態與風格,甚至直接把畫面中的某個角色或物件替換掉,而畫面其他部分仍保持連貫。

    Gemini Omni怎麼用?5步驟操作教學

    5步驟Gemini Omni操作教學

    圖源:Google DeepMind官方

    Gemini Omni 目前可以在 Gemini 應用程式與 Google Flow 裡使用(Google Flow 是 Google 的 AI 創作工作室)。以下用最簡單的流程說明。

    步驟一:進入Gemini App或Google Flow

    用你的 Google 帳戶登入 Gemini 應用程式,或前往 Google Flow。在這兩個入口使用 Gemini Omni 的完整功能需要付費方案(想免費先試可用 YouTube Shorts/Create),這點下一段費用會細說。

    步驟二:選擇Gemini Omni Flash

    在影片生成的介面中,把模型切換到 Gemini Omni Flash。在 Google Flow 裡,它會作為可用的影片生成模型出現。

    步驟三:輸入指令並上傳參考素材

    打上你想要的畫面描述,並視需要上傳參考素材,可以是圖片(最多 5 張)、一段影片,或一段音訊。指令寫得越具體(主體、動作、鏡頭、風格、聲音),成品越接近你的想像。

    步驟四:生成第一版影片

    送出後,Gemini Omni 會產出第一版約 10 秒的影片。先把它當草稿看,不用一次到位。

    步驟五:透過對話修改並下載影片

    覺得哪裡不對,就直接用對話講出來,例如「把背景換成海邊」「鏡頭拉遠一點」「這個物件換成紅色」。模型會在保留原場景的前提下修改。滿意後即可下載使用。

    Gemini Omni 費用怎麼算?免費和付費差在哪

    先講結論:Gemini Omni 有免費管道,但也有付費門檻,差別在你從哪裡用。想在 YouTube 上玩,免費就能碰;想在 Gemini 應用程式或 Google Flow 用完整功能,才需要付費方案。以下拆開講,並附上台灣定價。

    Gemini Omni可以免費使用嗎?

    可以,但看管道。YouTube Shorts 與 YouTube Create app 有提供免費的 Gemini Omni Flash 體驗,只要年滿 18 歲、不用訂閱就能試對話式生影片,這是目前門檻最低的入口。

    不過在 Gemini 應用程式與 Google Flow 裡,完整的影片生成與多輪編輯功能需要訂閱 Google AI 付費方案;純免費的 Google 帳號進到 Gemini,多半只能用到基礎的 Omni Flash,遇到影片生成時容易碰上排隊等待與每日配額偏低的限制。想穩定、完整地使用,最低要從 Google AI Plus 開始。

    Google AI Plus、Pro與Ultra方案比較

    三個方案都能使用 Gemini Omni Flash,差別主要在用量、Google Flow 點數與其他附加福利。以台灣定價為例:

    方案月費(台灣)影片/Omni 相關重點
    Google AI PlusNT$260免費版 2 倍用量、Google Flow 200 點、可用 Gemini Omni Flash
    Google AI ProNT$650免費版 4 倍用量、Google Flow 1,000 點
    Google AI UltraNT$3,300 起(另有 NT$6,500 更高用量版)Google Flow 10,000~25,000 點、最高用量

    想在 Gemini 應用程式或 Google Flow 裡穩定使用完整功能,從最便宜的 Google AI Plus(每月 NT$260)就能上手;新用戶前兩個月常有五折優惠,等於約每月 NT$130。此外,Google AI 方案支援與最多 5 位家庭成員共享,分攤下來每人負擔會更低。

    補充兩點:

    1. 用量算法:Gemini 應用程式的用量以「運算量」計算,會隨提示詞複雜度、使用的功能與對話長度變動,每 5 小時重置一次、直到達到每週上限,用完還能另外購買 AI 點數加量。

    2. 功能差異:部分功能可能因方案級別、平台(網頁/行動)與地區而異,實際方案內容以官方訂閱頁為準。

    Gemini Omni 和 Veo 差在哪、該選哪一個?

    很多人會把 Gemini Omni 和 Veo 搞混,因為兩者都是 Google 的影片模型。簡單分:

    • Gemini Omni Flash 是新的多模態生成+編輯模型,將在 Gemini 應用程式中取代 Veo 3.1。它的強項是多模態輸入、對話式多輪編輯,以及對世界知識與物理的理解,適合「先生成、再一句一句改」以及把多種素材合成一支影片的流程。

    • Veo 則是 Google 偏電影感生成路線的專門模型,強調高品質的文字轉影片。

    該選哪個?如果你的需求是邊聊邊改、拿現成素材去編輯、要求畫面遵循真實邏輯,Gemini Omni 更順手;如果你想的是「一句話直接生成一段有電影感的畫面」,Veo 的取向仍然存在。對多數在 Gemini 應用程式裡創作的人來說,現在預設接觸到的會是 Gemini Omni。

    Gemini Omni 的 Prompt 怎麼寫?一套公式加範例

    Gemini Omni 的 Prompt一套公式加範例

    圖源:Google DeepMind官方

    一個能重複套用的 Prompt 結構

    • 主體:畫面裡的人、物、場景。

    • 動作/觸發:要發生什麼事,或「當某事發生時」的條件(例如「當手打開時,掌心浮現一顆星球」)。

    • 鏡頭視角:運鏡與角度,例如「鏡頭慢慢推近」「過肩視角」。

    • 風格/材質:寫實、線稿、黏土定格、3D 全息等。

    • 音訊:要背景音樂、還是「只要真實環境音、不要配樂」。

    • 限制條件:時長(例如 10 秒)、比例(例如 16:9)、以及「不要出現什麼」。

    把這六格填滿,成品的可控度會明顯提高。

    依情境的範例

    • 商品介紹:白色背景中一瓶保養品緩慢旋轉,柔和棚拍打光,鏡頭微微推近,寫實風格,只要輕柔背景音樂,10 秒,16:9。

    • 知識解說:用黏土定格風格解釋一個科學概念,全部由黏土構成、無人手入鏡,畫面與旁白同步,不要在結尾突然斷音。

    • 物理模擬:一顆彈珠在連續軌道上快速滾動的一鏡到底畫面,只要真實碰撞聲、不要配樂。

    • 風格轉換:拿一段實拍影片,指令「當人物觸碰鏡子時,整個環境轉成 3D voxel 風格」,其餘畫面維持不變。

    同一素材多輪修改前後對比

    Gemini Omni 的價值在多輪。舉個流程:先用一段小提琴手演奏的影片當輸入 →(第一輪)「把演奏者移到一片麥田場景」→(第二輪)「讓小提琴變透明」→(第三輪)「鏡頭改成從演奏者肩膀後方拍」。每一輪都只改一件事,模型會延續前一版的畫面,你就能清楚看到每一步的前後差異,而不是每次都得到一支全新的、對不上的影片。

    Gemini Omni影片長度與使用限制

    Gemini Omni影片長度與使用限制

    圖源:Google DeepMind官方

    再強的工具也有邊界,先了解才不會踩雷。

    Gemini Omni一次可以生成多長的影片?

    目前 Gemini Omni 單次生成的是約 10 秒的短影片。想做更長的內容,實務上得靠多段生成再自行銜接。

    複雜動作及多人場景可能不穩定

    雖然 Gemini Omni 對物理有不錯的理解,但高速、複雜或多人同時互動的場景仍是各家 AI 影片模型共同的難點,容易出現動作不連貫或細節錯位。遇到這種情況,建議把畫面拆簡單一點,或用多輪編輯逐步修。

    中文文字、旁白及影音同步限制

    Gemini Omni 設計上能把「畫面上的文字」和「正在發生的動作」對起來,也能生成旁白。不過就實務經驗,畫面內的中文文字仍可能出現錯字或變形,旁白與嘴型、動作的同步在複雜情境下也未必完美。牽涉到精準中文字卡的內容,成品最好逐支檢查。

    方案額度與生成速度限制

    如前面費用段所說,Gemini 應用程式採運算量計費,每 5 小時重置、直到週上限;Google Flow 端則吃點數(Plus 200 點、Pro 1,000 點、Ultra 10,000~25,000 點)。用量與生成速度會因方案級別而不同,量大的人要留意額度消耗。

    SynthID及C2PA內容標記

    所有透過 Gemini 應用程式、Google Flow 或 YouTube 用 Omni 生成、編輯的內容,都會嵌入 Google 的 SynthID 隱形浮水印與 C2PA 內容憑證。這些標記肉眼看不到,但可以用來辨識內容是否由 Google AI 生成,你甚至可以把檔案丟回 Gemini 詢問是否為 AI 產物。對商用或需要標示 AI 內容的情境,這點要先納入考量。

    Gemini Omni常見問題

    Gemini Omni在台灣可以使用嗎?

    可以。Gemini Omni 已在所有 Gemini 應用程式支援的語言與市場推出,台灣在支援範圍內。使用者需年滿 18 歲,並持有 Google AI Plus、Pro 或 Ultra 其中一種方案。要留意的是,Avatar、影片轉影片編輯等部分功能,可能因所在地區而有限制。

    Gemini Omni支援中文指令嗎?

    支援。Gemini Omni 在 Gemini 應用程式所有可用語言的市場都能使用,你可以用中文下指令。不過如前所述,畫面中要生成的中文文字仍可能出錯,這和「聽不聽得懂中文指令」是兩回事,實作時分開看待。

    Gemini Omni生成的影片有浮水印嗎?

    有,但是看不見的。所有產出都會帶 SynthID 隱形浮水印與 C2PA 內容憑證,不會在畫面上留下可見的 logo,而是用於辨識這是不是 Google AI 生成的內容。

    Gemini Omni 把 AI 影片從「一次講完、改就重來」帶到「先生成、再對話式微調」的階段,對需要反覆修改的創作者來說是明顯的效率提升。先從一個簡單的 10 秒草稿開始,習慣用一句一句的方式把畫面調到位,會比一開始就想寫出完美提示詞更容易上手。

    立即使用GenApe AI,提升生產力和創造力!

    與AI合作,加速你的工作流程!

    立即前往

    相關文章

    defaultImage

    Gemini Storybook 一學就會!AI 繪本製作教學與實測成果分享

    Gemini Storybook 是 Google 推出的生成式 AI 工具,主打幫助使用者快速產出圖文並茂的故事繪本。它結合文字生成、圖片生成與語音功能,讓你只需輸入簡單的 prompt,就能產出完整的有聲 AI 繪本,適合用於親子共讀、創意教學或個人創作。 這項工具特別適合不擅長繪圖或寫故事的新手,只需幾個簡單步驟,即可快速產出具有視覺吸引力與敘事性的電子繪本,並支援繁體中文。

    最後更新: 2026/06/30

    defaultImage

    Gemini Nano Banana 教學:AI 指令大全與商品圖生成攻略

    想讓商品圖瞬間變得吸睛又高質感嗎?Google 推出的 Gemini Nano Banana 正是電商與創作者的新武器。無論你想生成公仔風商品照、美食擺拍圖,還是模特展示照,只要輸入指令,AI 就能幫你完成專業性圖片。以下將帶你一步步了解 Nano Banana 是什麼、怎麼用、以及最實用的 Nano Banana 指令教學。

    最後更新: 2026/06/30

    defaultImage

    Gemini 2.0 Flash怎麼用?AI改圖、改照片、繪圖全功能一次看

    你是否曾經希望,只需幾個指令,就能將照片修成完美風格?或者渴望用AI製作出創意滿滿的繪圖作品?今天的Gemini 2.0 Flash專題要為您介紹的,是由Google推出的最新AI影像處理工具「Gemini 2.0 Flash」,這個版本不僅性能優化,更結合了多輪對話、快速編輯與圖像生成等強大功能。如果您想深入了解如何使用這款全能型AI繪圖與修圖神器,那就絕對不能錯過本篇文章,我們將一次帶您完整掌握Gemini 2.0 Flash的操作重點。

    最後更新: 2026/07/09

    Assistant
    LineButton