計算ノードの中心に浮かぶ青い推論コアの抽象ビジュアル
NAW / MODELS 01

IMAGE: AI生成ビジュアル

MODELS / Models

Google、Gemini Omni 1.1 Flashを発表 — シーン延長・前後フレーム指定・4K出力を強化、制作向けに本番対応

Googleが8月27日に発表した動画生成モデルGemini Omni 1.1 Flash。10秒コンテキストのシーン延長、始点・終点フレーム間の補間、360pドラフト(720p比で最大60%高速・3分の1コスト)、4K/1080pの高解像度出力、最大3秒の参照動画入力をGemini APIで提供。AI StudioとEnterprise Agent Platformで利用可能。

Googleは2026年8月27日(米時間)、動画生成モデル Gemini Omni 1.1 Flash を発表した。公式ブログ「Build with Gemini Omni 1.1 Flash」(著者: Anish Nangia, Alisa Fortin, Google DeepMind / Google Blog)が一次情報で、datePublished: 2026-08-27T16:00:00+00:00 として公開された。前身のGemini Omni Flashが持つ「現実世界の推論を伴う生成」を継承しつつ、制作ワークフローでの利用を想定した制御性と出力品質を強化したアップデートと位置づけられる。

Gemini Omni 1.1 Flash ヒーローイメージ 出典: Build with Gemini Omni 1.1 Flash — Google Blog

何が発表されたか

  • モデル名と位置づけ: Gemini Omni 1.1 Flash。Gemini Omniの「production-ready」な更新版として、Gemini API経由で Google AI StudioGemini Enterprise Agent Platform から利用可能。
  • 提供形態: Gemini APIのInteractionsベースの呼び出しで提供。公式のコード例では model="gemini-omni-1.1-flash"previous_interaction_id を指定してシーンを継続するパターンが示された。
  • 公開日: 2026年8月27日。Google BlogとDeepMind Blogで同日告知(og:descriptionは「Gemini Omni 1.1 Flash brings a new suite of creative controls and generative video capabilities to developers.」)。

新機能 — 制御性と制作効率の強化

  • シーン延長(Scene extension):
    • 既存の生成動画の末尾からシームレスに続きを生成。モデルが参照する事前コンテキストが従来の「最後の1秒」から 最大10秒 に拡大し、視覚的一貫性と物語の整合性が向上したとされる。
    • 10秒刻みで延長、累計で最大40秒 まで生成可能。プロンプト例として「カメラがパンして新たな人物が現れる」「遺跡の奥へ引きのカメラで拡大する書庫」など、物語を分岐・継続するユースケースが紹介された。
  • 始点・終点フレーム指定(First and last frames):
    • ショットの開始フレームと終了フレームを指定し、その間をモデルが補間して連続した動画を生成。複雑なカメラオービット、ズーム遷移、シームレスなループ生成に適するとされる。公式は「ドラマーからサックス奏者とバレエダンサーへ鞭パンで遷移」「テレビ画面の中へズームインして同一シーンが現れる」といったワンカット事例を示した。
  • 360pドラフト生成:
    • 軽量な 360p解像度 でプレビューを生成。Googleの説明では標準の720pと比較して 最大60%高速約3分の1のコスト で生成できるとされる(表記: Up to 60% faster generation based on system throughput of 360p vs. 720p resolution)。ラピッドプロトタイピング、絵コンテの反復、開発プラットフォームでの高速レンダリング向け。
    • APIでは response_format: { resolution: "360p" } を指定する例が示された。
  • 1080p / 4Kへの高解像度出力:
    • 制作納品を想定した 1080pおよび4K 出力に対応。公式は「polished, high-resolution 1080p or 4K outputs that are ready for professional production」と表現する。
  • 参照動画入力(Video references):
    • 最大3秒 の参照動画を入力として、キャラクターの一貫性や視覚的コンテキストを維持した生成が可能。例として「3本のダンス参照動画とキャラクター画像(dog.png / octo.png / bear.png)を組み合わせ、1カットで異なるダンスを踊らせる」デモが紹介された。マルチモーダル入力の一部として提供される。
  • その他の制作支援コンセプト:
    • 始点・終点フレームとプリセット/プロンプトで遷移を作るアプリ、不動産内覧向けにカメラが部屋を弧を描いて移動するアプリ、360pで3〜4バリエーションを並べて比較する「Draft Room」など、開発者が組み込めるワークフロー例が提示された。

Gemini Omni 1.1 Flash 価格表 出典: Build with Gemini Omni 1.1 Flash — Google Blog — 記事内に掲載の価格表

使い方と導入事例

  • API呼び出し例(公式):

    from google import genai
    
    client = genai.Client()
    
    interaction = client.interactions.create(
        model="gemini-omni-1.1-flash",
        previous_interaction_id=previous_video_interaction.id,
        input=[
            {"type": "text", "text": "Continue the scene."}
        ],
        response_format={
            "resolution": "360p",
        },
    )
  • 顧客事例:

    • Adobe: Adobe FireflyにGemini Omni Flashを統合し、動画編集機能として活用するデモ動画を公開。
    • Figma Weave: Creative DirectorのItay Schiff氏が「Weaveで最も強力な動画モデルの一つ。拡張・参照素材の強化・4K対応により“生成を超えて演出”できる」とコメント。
    • GMI Cloud: VP of MarketingのLouisa Guo氏が「細部が精査に耐える正確さ。教育的・説明的コンテンツで信頼性が重要」と評価。

位置づけと留意点

  • ベンチマーク画像について: 一次情報の公式ブログに、他モデルとの性能比較を示すEvaluation Results / Benchmarkのチャート・表の掲載は確認できなかった。動画生成の品質は主観評価や事例で示される性質が強く、本稿では数値比較の断定は行わない。
  • 料金・制限: 価格表画像が記事内に掲載されているが、本文での数値の文字起こしは行わず、正式な料金・レート制限・利用可能リージョンは Gemini APIドキュメントでの確認が必要。
  • 既存モデルとの関係: Gemini Omni(2026年5月発表の動画生成基盤)のマイナーアップデートとして、既存のGemini APIワークフローに統合しやすい設計とされる。コンテキスト長や解像度の選択肢が増えたことで、試作から納品までの反復コストを抑える狙いが明確になっている。

出典