Gemini Omni Flash 登頂!Google 最強 AI 影片生成模型如何改變短影音創作
Google 推出 Gemini Omni Flash,搶佔 AI 影片生成王座
在眾多 2026 年 8 月的 AI 新聞中,最值得短影音與內容創作者關注的,莫過於 Google 推出的全新影片生成模型「Gemini Omni Flash」。根據最新排行榜資料,這款模型目前在 Arena 的文字轉影片排行榜上以 1527 Elo 分數穩居第一,領先第二名達 45 分之多,同時也在 Artificial Analysis 的影片競技場拿下冠軍。能同時在兩大權威評測榜單上都拿下第一名,目前還沒有其他影片模型做到這一點,這也讓 Gemini Omni Flash 一舉成為業界討論焦點。
從時間軸來看,Google 早在今年 5 月 19 日就先透過 Gemini App、Flow 與 YouTube Shorts 讓一般消費者搶先體驗,並在 6 月 30 日進一步開放 AI Studio 與 Gemini API 給開發者串接使用。這種「先消費端、後開發端」的推出節奏,顯示 Google 這次不只是要秀技術實力,更是想快速把功能鋪進大眾日常使用的短影音場景,搶佔 YouTube Shorts 這類平台的創作者紅利。
定價與規格:主打「秒級」創作成本
對創作者而言,最實際的問題永遠是「用得起嗎」。目前 Gemini Omni Flash 的計費方式是每百萬輸入 token 收費 1.5 美元、每百萬影片輸出 token 收費 17.5 美元,換算下來大約是每秒完成影片 0.1 美元,而且支援對話式編輯,只要用文字描述想調整的地方就能修改畫面。這種「邊聊邊改」的工作流程,對於需要大量迭代測試腳本、分鏡的短影音團隊來說相當實用,不必每次都整段重新生成。
不過天下沒有完美的工具,Omni Flash 目前最大的限制是長度,每次只能生成 10 秒的短片,如果需要更長的鏡頭,Google 仍建議使用 Veo 3.1,這款模型可在 Gemini App、AI Studio 與 Vertex AI 中使用,並支援原生音訊與 1080p 畫質輸出。換句話說,Google 目前採取的是「雙模型分工」策略:Omni Flash 主打速度快、成本低、適合大量短素材;Veo 3.1 則負責畫質與時長要求較高的正式產出。
對短影音創作者與行銷團隊的實際影響
如果你是自媒體經營者、社群小編或是短影音代操團隊,這次更新其實有幾個值得留意的方向。首先,10 秒的長度限制看似「短版」,但恰好貼合 YouTube Shorts、Reels、抖音等平台黃金開頭幾秒的節奏,非常適合拿來快速產出開場鉤子、轉場素材或是產品特寫鏡頭,再搭配剪輯軟體串接成完整作品。
其次,對話式編輯功能大幅降低了「重新下 prompt 從頭生成」的時間成本。過去許多 AI 影片工具的痛點就是每次修改都要整段重跑,浪費算力也浪費時間;如果 Omni Flash 真能做到用自然語言微調畫面細節,對於需要 A/B 測試多個版本縮圖或開場的行銷團隊來說,會是明顯的效率提升。
最後,雙榜第一的成績也代表 Google 在影片生成的技術路線上,可能已經找到比單純堆疊解析度與時長更有效的評分策略——例如更貼近真實鏡頭運動、更穩定的角色一致性。這對接下來 OpenAI、Runway、可靈等對手要如何回應,值得後續持續觀察。
結語:短影音的 AI 工具戰爭才剛開始
Gemini Omni Flash 的登場,再次證明 AI 影片生成的競爭已經從「能不能生成」進入「誰的生成又快又便宜又好改」的階段。對於長期關注 AI、影像製作與短影音領域的創作者而言,現在正是評估將 AI 影片工具正式導入日常工作流程的好時機——但同時也別忘了,10 秒限制、授權條款與素材版權等細節,仍是導入前必須逐一確認的實務問題。