🧠Research🔥🔥

Google、動画生成モデル Gemini Omni 1.1 Flash を公開──10秒の文脈参照と最大40秒の延長に対応

直前の10秒間の文脈を解析して最大40秒まで動画を延長できるほか、360pドラフト生成によりコストを1/3に圧縮した。
リリース: 2026-08-28 · 読了 3

記事の要約

1. 核心(What)

  • 米Googleが2026年8月27日に動画の生成・編集に対応するマルチモーダルAIモデル「Gemini Omni 1.1 Flash」を発表した。
  • モデル名は「gemini-omni-1.1-flash」であり、Gemini APIおよびGoogle AI Studio経由で提供される。
  • 直前の最大10秒分の文脈を解析して動画を10秒単位、累計最大40秒まで延長する機能や、360pの軽量ドラフト生成(720p標準比で速度最大60%向上、コスト1/3)を実装した。
  • Adobe Fireflyへの統合や、電子透かし「SynthID」の自動付与に対応している。

2. 影響(Why)

  • 開発プロセスのコストと効率の最適化: 360pの軽量ドラフト生成により、ストーリーボードの検討や試作段階の推論コストを従来標準の1/3に抑えられるため、動画制作のイテレーションを高速化できる。
  • 国内動画制作 SaaS への実装判断: [国内 動画生成 SaaS 業種] のような中規模事業者は、最大40秒までのシーン延長や開始・終了フレームの指定機能を既存のワークフローに組み込むことで、手動での編集コストを削減できる。

3. 根拠・詳細(How)

  • 文脈参照とフレーム制御のアーキテクチャ: 直前の最大10秒分をマルチモーダル入力として解析することで視覚的一貫性を保持し、開始・終了フレーム指定による連続生成を実装している。
  • ドラフト生成と電子透かしの仕組み: 360p解像度のプレビュー生成によって標準720p比で生成速度を最大60%高速化し、出力動画には機械的検出が可能な電子透かし「SynthID」を自動付与する設計になっている。

4. 展望・課題(Next)

  • エンタープライズ領域への展開: Google Flow や Gemini Enterprise Agent Platform の Agent Platform API を通じた企業向け導入が進む見込みである。