Gemini Omni 1.1 Flash icon

Gemini Omni 1.1 Flash

Gemini Omni 1.1 Flashは、AI動画ワークフローを構築する開発者向けのGoogle DeepMindモデル。シーン拡張、キーフレーム制御、高速360pプレビュー、4K出力で、動画生成と編集をより細かく制御できます。

Gemini Omni 1.1 Flash

概要

Gemini Omni 1.1 Flash は、生成動画ワークフロー、クリエイティブツール、メディア編集ソフトウェアを構築する開発者向けの Google DeepMind モデル更新です。発表では、シーン拡張、フレーム間遷移、より高速なプレビュー、より高解像度の出力によって、動画生成の制御性が高まるとされています。

この製品は本番対応済みとして位置付けられており、Google AI Studio、Gemini API、Gemini Enterprise Agent Platform を通じて利用できます。主な役割は、最終レンダリング前の反復作業をより簡単にし、AI 動画生成と編集をより細かく制御できるようにすることです。

機能

シーン拡張

視覚的な一貫性と物語の流れを改善しながら、次の区間を生成して既存の動画を続けられます。このモデルは最後の 1 秒だけでなく最大 10 秒の過去コンテキストを使用でき、10 秒単位で合計 40 秒まで延長できます。

最初と最後のフレーム制御

ショットの開始点と終了点を定義して、モデルがそのキーフレーム間の連続した映像を生成できるようにします。これは、より滑らかなカメラ移動、トランジション、ループクリップに役立ちます。

高速な 360p 下書き

高解像度のレンダリングを行う前に、軽量な 360p プレビューでアイデアを試せます。ソースでは、標準の 720p 生成と比べて最大 60% 高速で、コストは 3 分の 1 になるとされています。

1080p と 4K のアップスケーリング

1080p や 4K を含む、より高解像度の動画出力を最終納品向けに生成できます。発表では、ラフな下書きから洗練された映像へ同じワークフロー内で移行できる点が示されています。

開発者向けアクセス

Google AI Studio の Gemini API 経由でモデルを使用でき、Gemini Enterprise Agent Platform 経由のアクセスにも言及されています。リリースノートでは、Omni 1.1 Flash は開発者向けに本番対応済みと説明されています。

ユースケース

  • 進行中の編集でシーンを延長する

    視覚的および物語的な連続性を保ちながら、進行中の動画クリップを継続するツールを構築できます。これは、次のショットが前のショットに密接に続く必要があるストーリー重視の生成に適しています。

  • キーフレーム付きの遷移を作成する

    ショット内の開始フレームと終了フレームなど、2 つの重要な瞬間の間で制御された遷移を生成できます。これは、カメラ移動、変形するシーン、シームレスなループに役立ちます。

  • コンセプトをより速く下書き・レビューする

    高解像度出力にコストをかける前に、360p の下書きで動画コンセプトをすばやく試作できます。これは、初期段階の絵コンテ検証や社内での迅速なレビューに適しています。

  • 高解像度の最終レンダリングを準備する

    ラフカットが承認された後、1080p または 4K で納品用の最終アセットを作成できます。発表では、これらの出力が洗練された本番対応の動画ワークフローに結び付けられています。

  • ソフトウェア製品に動画生成を埋め込む

    消費者向けの編集インターフェースではなく、API 主導の制御を必要とする開発者向け製品に動画生成を組み込めます。投稿では、このリリースが開発者とプロダクトチーム向けであることが明確に示されています。

Pros and Cons

Pros

  • シーン拡張とキーフレームベースの遷移により、生成動画の制御性を高められます。
  • 低解像度の 360p プレビューで、最終レンダリング前により高速な反復が可能です。
  • 1080p と 4K を含む高品質な出力オプションを提供します。
  • Google AI Studio と Gemini Enterprise Agent Platform からアクセスでき、Gemini API のサポートも発表で明示されています。

Cons

  • ソース資料には完全な価格ページが含まれていないため、収集できた証拠だけではコストやプランの詳細は不明です。
  • 発表は動画生成と編集に焦点を当てているため、より広範なモデル機能や非動画ワークフローについては詳しく記載されていません。

FAQ

開発者はどこで Gemini Omni 1.1 Flash にアクセスできますか?

この発表によると、Gemini Omni 1.1 Flash は Google AI Studio と Gemini Enterprise Agent Platform で利用でき、Google AI Studio の Gemini API 経由でも本番利用できます。利用可能なすべてのアクセス経路やワークスペース要件までは記載されていません。

どのようなワークフロー向けに設計されていますか?

この投稿では、シーン拡張、開始フレームと終了フレームの制御、360p プレビュー生成、4K へのアップスケーリングが強調されています。これらの制御は、一般的なテキストや画像のタスクではなく、動画生成、編集、より速い反復作業向けです。

シーンはどのくらい長く延長できますか?

ソースによると、動画は 10 秒単位で、合計 40 秒まで延長できます。また、シーンを拡張する際には最大 10 秒の過去コンテキストを分析できるとされています。

ソース資料で価格は公開されていますか?

発表では、360p プレビューはモデルの標準 720p 解像度より高速かつ低コストであると説明されています。また、最終出力は 4K までアップスケールできるとされています。完全な価格表やクレジット体系は提示されていません。

この製品は誰向けですか?

このページでは、生成動画ワークフロー、クリエイティブツール、メディア編集ソフトウェアを構築する開発者向けの更新として位置付けられています。また、プロフェッショナル用途向けに本番対応済みとも説明されています。

Quick Facts

カテゴリ
開発者向けツール
製品
Gemini Omni 1.1 Flash
ソースドメイン
blog.google
主な用途
生成動画の作成と編集
提供状況
Google AI Studio、Gemini API、Gemini Enterprise Agent Platform
注目の出力オプション
360p プレビュー、1080p、4K
Gemini Omni 1.1 Flash - AI Tool, Features, Use Cases & Alternatives | UStack