谷歌宣佈推出 Gemini Omni 1.1 Flash 視頻生成 AI 模型,最高可輸出 4K 分辨率視頻。相較 Omni 1.1 的標準 720p,新模型在速度與成本上做了明顯取捨,並向專業成片場景延伸。

image.png

從分鏡預覽到 4K 成片的全流程

亮點之一是場景擴展:用戶可基於已有視頻從結尾無縫續生成後續畫面,按每次 10 秒步長逐步擴展,單條累計最長 40 秒。指定首尾幀功能則只需給定起止畫面,即可實現平滑轉場與運鏡;視頻參考支持引入最長 3 秒片段,精準維持上下文與角色一致性。

成本結構分層清晰:360p 預覽每秒 0.03 美元、速度較標準提升最高 60% 且成本僅三分之一,適合分鏡迭代;720p、1080p、4K 分別爲每秒 0.1、0.15、0.3 美元。谷歌正把視頻生成從"能跑預覽"推向"可交付成片",讓 AI 視頻在原型與終稿之間有了連續的生產鏈路。