Gemini Omni 1.1 Flash 完整解析:AI 影片延長到 40 秒、首尾影格、4K 與價格表
原片講者:Google DeepMind

AI 影片這一兩年進步飛快,但有一個天花板一直很難突破:一次只能生短短幾秒。想把畫面接下去,常常一接就對不上——人物換了張臉、光線跳掉、動作接不順。2026 年 8 月 27 日,Google DeepMind 正式推出 Gemini Omni 1.1 Flash,把這個限制往上抬了一大截:單一場景可以延長到 40 秒,而且接得起來。
這篇文章會完整拆解 Gemini Omni 1.1 Flash 有哪些新功能、規格細節、完整價格表、和前一代差在哪,以及實際使用時要注意的限制。
Gemini Omni 1.1 Flash 是什麼?
Gemini Omni 是 Google 的多模態生成影片模型系列,而 1.1 Flash 是這個系列針對開發者、主打「可控性」的正式版(GA)更新。它不只是「打一句話生一段影片」,而是加入了一整套讓你能像在剪接室裡工作的控制項:延長場景、指定首尾影格、控制解析度、快速出草稿。
簡單說,它想解決的痛點是:把 AI 影片從「抽卡碰運氣」變成「可以一步步做下去」。
四個核心新功能
1. 場景延長(Scene Extension)到 40 秒
這是這次最大的亮點。你可以用 每次 +10 秒 的方式,把一段影片往後延長,最多累積到 40 秒。
關鍵在於「怎麼接」:1.1 Flash 會參考前面 最多 10 秒 的畫面,再往後生成新的內容,藉此把人物長相、光線、鏡頭運動、劇情邏輯都延續下去。這比前一代只看「最後 1 格」聰明太多了——前一代因為資訊太少,一延長就容易走鐘。
要注意的是,40 秒不是「一次算出來」的,而是拿現有片段一段一段往後續(multi-turn)。而且延長只能接在片尾,不能往前接、也不能插在中間。
2. 首尾影格控制(First / Last Frame)
你可以同時給模型「起始格」和「結束格」兩張圖,讓它自己補出中間連續的運鏡與變化。這對想控制構圖、做轉場、或讓鏡頭從 A 畫面平順走到 B 畫面的人非常實用——你負責定錨點,模型負責補動態。
除了首尾影格,它也支援參考素材:最多可放 3 段參考影片(每段 ≤3 秒) 或多張參考圖,主要用來鎖定角色長相與物件一致性。
3. 解析度控制與 4K(放大)
1.1 Flash 提供四種解析度:360p、720p(預設)、1080p、4K。畫面比例支援 16:9 與 9:16。
這裡有一個一定要講清楚的重點:1080p 與 4K 都是「放大(upscale)」輸出,不是原生。也就是說,底層算的解析度較低,再往上放大到 4K。畫面會更適合正式產出用途,但別把它當成原生 4K 的細節量來期待。
4. 360p 草稿模式:快、又便宜
如果你只是要試構圖、試運鏡、抓感覺,可以先用 360p 出草稿——官方說它比 720p 快約 60%,而且成本只要約三分之一。滿意了再用高解析度正式跑。這對需要大量迭代的人來說,能省下可觀的時間與費用。
規格總覽
| 項目 | 規格 |
|---|---|
| 場景延長 | 每次 +10 秒,最多累積 40 秒 |
| 延長參考 | 參考前面最多 10 秒 畫面(前一代僅參考最後 1 格) |
| 首尾影格 | 可指定 first / last frame,中間自動補 |
| 參考素材 | 最多 3 段影片(每段 ≤3 秒)或多張參考圖 |
| 解析度 | 360p、720p(預設)、1080p(放大)、4K(放大) |
| 畫面比例 | 16:9、9:16 |
| 上傳延長限制 | 上傳的影片需 ≤10 秒(延長模型自產影片則走多輪) |
| 區域限制 | 編輯/延長功能在 EEA、瑞士、英國暫不提供 |
完整價格表
Gemini Omni 1.1 Flash 是 付費方案專屬(沒有免費額度),影片按秒計費,解析度越高越貴:
| 解析度 | 每秒價格(美元) | 用途 |
|---|---|---|
| 360p | $0.03 | 草稿、快速預覽 |
| 720p(預設) | $0.10 | 一般正式輸出 |
| 1080p(放大) | $0.15 | 較高畫質產出 |
| 4K(放大) | $0.30 | 正式製作 |
底層其實是以 token 計費:影片輸出為 每 100 萬 tokens $17.50,而 720p 影片約為 每秒 5,792 tokens,換算下來大約就是每秒 $0.10。此外,輸入(文字/圖片/影片/音訊)為每 100 萬 tokens $1.50,文字輸出為每 100 萬 tokens $9.00。

實務上的成本感受:用 720p 生一段 40 秒的完整場景,約為 40 × $0.10 = $4 美元 上下;若先用 360p 大量試草稿,同樣 40 秒只要約 $1.2,便宜非常多。
和前一代差在哪?
| 能力 | 前一代 Gemini Omni Flash | 1.1 Flash |
|---|---|---|
| 場景延長 | 有限、參考最後 1 格 | 參考前 10 秒,最多延長到 40 秒 |
| 首尾影格 | 無明確控制 | 可指定 first / last frame |
| 解析度控制 | 較少 | 360p / 720p / 1080p / 4K 四檔 |
| 草稿模式 | 無 | 360p,快 60%、成本 1/3 |
一句話總結:1.1 Flash 的升級重點不是「畫質變多好看」,而是把控制權交回創作者手上——你能決定長度、決定首尾、決定要先便宜試還是直接高畫質產出。
在哪裡可以用?
- Google AI Studio:最快上手、可直接測試。
- Gemini API / Gemini Enterprise Agent Platform:開發者串接、量產用。
- Google Flow:提供給 Google AI Plus、Pro、Ultra 訂閱者。
- Gemini app:場景延長功能開放給 Plus / Pro / Ultra 訂閱者。
Google 也點名了 Adobe、Figma Weave、Runway、GMI Cloud 等產品/平台已在導入這顆模型。
老實說的幾個限制
再好的工具都有邊界,這幾點值得先知道:
- 4K 是放大的,不是原生——別期待原生 4K 的細節密度。
- 延長只能接片尾,不能往前接、也不能插在中間。
- 上傳影片需 ≤10 秒 才能拿來延長(自產影片走多輪不受此限)。
- 區域限制:編輯/延長功能目前在歐洲經濟區(EEA)、瑞士、英國不提供。
- 沒有免費額度,從第一秒就開始計費——建議先用 360p 草稿控制成本。
小結
Gemini Omni 1.1 Flash 真正的價值,不在於「又一個能生影片的模型」,而在於它把場景延長(到 40 秒)、首尾影格控制、解析度分級與便宜草稿模式這幾件事湊齊,讓 AI 影片從幾秒鐘的片段,往「可以做一段有頭有尾的分鏡」邁進一步。
如果你本來就卡在「AI 影片太短、接不起來」,這一版很值得試;而聰明的用法,是先用 360p 大量試錯、把分鏡確定好,再用 720p 或以上正式產出,兼顧品質與成本。
原片來源:https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/