大規模モデルのマルチモーダル分野における競争は、より高精細で長時間の動画生成に向かって急速に進化しています。現地時間の8月27日、グーグルは新たなGemini Omni1.1Flash動画生成AIモデルを正式に発表しました。このモデルは、最高で4K超高精細解像度の出力をサポートしており、シーン拡張、カメラワーク制御、生成効率においても全面的なアップグレードが行われています。
開発者やプロのクリエイター向けのパフォーマンス向上ツールとして、Gemini Omni1.1Flashは複数の目覚ましい特徴を備えています。シーン拡張に関しては、既存の動画の終わりから直接スムーズに続きの画像を生成することが可能で、各拡張ステップは10秒ずつで、最大40秒まで拡張可能です。カメラワーク制御では、指定されたフレームの開始と終了を指定することで、滑らかで自然なトランジション効果や専門的なカメラワークを簡単に実現できます。また、新モデルは最大3秒の参照ビデオセグメントの導入をサポートしており、新しいシーンを作成する際に画面上下文とキャラクターの一貫性を正確に維持できます。

画質と実行効率のバランスにおいて、このモデルはさまざまな解像度オプションを提供し、異なるシナリオに応じたニーズに対応します。その中でも、360pプレビューモードは標準の720p解像度よりも最大60%の生成速度が向上し、コストは元の三分之一にとどまり、高速なプロトタイプ検証、スケッチの反復および高速レンダリングに非常に適しています。一方、最高解像度では、詳細が明確で、細部が完璧な1080pまたは4Kの最終的な映像を直接出力可能です。
VIP会員