Google DeepMindが2026年8月27日に公開したGemini Omni 1.1 Flashは、テキスト・画像・動画入力から動画とテキストを出力するマルチモーダルな動画生成・編集モデル。最大10秒の直前映像を解析してシーンを10秒刻みで最大40秒までつなぐScene Extension、開始・終了フレーム指定(first/last-frame control)、最大3秒の参照動画3本、360p高速ドラフト(720p比で最大60%高速・約1/3コスト)、最大4Kアップスケール出力に対応。入力131,072トークン・出力57,920トークンのコンテキスト、SynthID透かしを内蔵。API価格は入力$1.50/1M、テキスト出力$9.00/1M、動画出力約$0.10/秒(720p)。
パラメータ
非公開
コンテキスト長
131K
ライセンス
プロプライエタリ
リリース日
2026-08-27
API料金
入力料金(1Mトークンあたり)
$1.5
出力料金(1Mトークンあたり)
$9
課金モード: standard
強み
- •最大40秒までつながるScene Extensionで高い映像連続性
- •開始・終了フレームと参照クリップで演出可能
- •360pドラフトで720p比約1/3の試作コスト
- •テキスト・画像・動画入力とSynthID透かし
弱み
- •Preview段階でシステム指示・温度・ネガティブプロンプト非対応
- •延伸は末尾のみ追加(挿入・先頭追加不可)、音声編集非対応
- •完全な言語対応は英語のみ
活用例
- •演出可能な短尺広告・SNS動画
- •クリエイティブツール(Firefly, Figma Weave)での絵コンテ→動画試作
- •教育・不動産紹介動画