logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

Gemini Omni Flash Reference to Video:参照画像から同期音声付き動画を生成 | RunComfy

google/gemini-omni-flash/reference-to-video

Gemini Omni Flash Reference to Video は、1 枚以上の参照画像とプロンプトからネイティブ同期音声付きの短いクリップを生成します。16:9 または 9:16、3~10 秒の動画で被写体とスタイルを維持します。

希望する動き、シーン展開、テンポ、音声を記述します。カメラワークや音を指定でき(例:「カメラをゆっくり寄せる」「そよ風と鳥のさえずり」「セリフなし」)、「文字を表示しない」などの除外指示も追加できます。各アップロード画像を被写体、スタイル、構図のどれに使うか、プロンプト内で明示してください。
Image 1
動画の被写体、スタイル、レイアウト、視覚的な方向性をガイドする 1 つ以上の参照画像。サポートされている形式には、jpg、jpeg、png、webp が含まれます。
生成された動画のアスペクト比。
生成された動画の長さ (秒単位)。
Idle
The rate is $0.14 per second of generated video.

Gemini Omni Flash Reference to Video の紹介

Google の Gemini Omni Flash Reference to Video は、1 枚以上の参照画像とプロンプトから 3~10 秒のクリップを生成します。画像で被写体、スタイル、構図を固定し、テキストで動き、展開、テンポ、同期音声を指定できます。手作業のキーフレーム設定や個別の音作りを 1 回の参照画像ベース生成にまとめられるため、人物の一貫性が重要なマーケティング、映像制作、ゲーム、SNS コンテンツに適しています。RunComfy ではブラウザと HTTP API の両方から利用でき、モデルのホスティングやスケーリングは不要です。
おすすめの用途:人物の一貫性を保つ短編 | 参照画像を生かした映画風ショット | 商品・ブランドのプロモーション

Google / Gemini Omni Flash Reference to Video#


このモデルは、1 つまたは複数の参照画像を書面によるプロンプトとともに読み取り、参照された被写体、外観、構成を維持しながらモーションとサウンドを追加する短い映画クリップを生成します。これは Google の Gemini Omni Flash ファミリに属しており、テキスト動画生成や画像からの動画生成もカバーしています。この RunComfy ページは、参照画像からの動画生成を実行します。


写真はアイデンティティと視覚的な方向性を固定するため、同じキャラクターや製品がショット間を移動するのではなく、最初のフレームから最後のフレームまで認識可能な状態を維持できます。


ハイライト#


  • リファレンス主導の生成: 1 つまたは複数の画像をフィードすると、モデルはショットを構築するときにその被写体、スタイル、レイアウトに従います。
  • プロンプト主導の方向性: テキストはモーション、シーン展開、ペース、音声を制御するため、リファレンスをどのように生かしていくかを決定できます。
  • ネイティブ同期音声: 音声、環境音、音楽が画像に合わせて生成され、別の音声 パスを必要とせずにすぐに共有できるクリップが得られます。
  • 被写体の一貫性が高い: 参照画像は、クリップ全体にわたってキャラクター、オブジェクト、またはブランドを安定して見せるのに役立ちます。
  • 柔軟なフレーミングと長さ: 16:9 横長または 9:16 縦長を、3~10 秒の範囲で 1 秒単位に選択します。
  • ファミリーの一部: Gemini Omni Flash のラインナップは、いくつかの動画 タスクにまたがっています。このページは参照画像からの動画生成に焦点を当てています。

パラメータ#


入力は、参照画像から動画を生成するタスクの RunComfy OpenAPI Input スキーマと一致します。


パラメータ必須型デフォルト範囲 / 選択肢説明
prompt*はい (*)string—説明テキスト動き、展開、テンポ、音声を指定
image_urls*はい (*)array(画像 URI)—jpg, jpeg, png, webp被写体、スタイル、構図を指定する 1 枚以上の参照画像
aspect_ratioいいえstring16:916:9, 9:16生成動画のアスペクト比
durationいいえinteger83~10(秒)生成動画の長さ(1 秒単位)

価格設定#


料金は、生成されたクリップの長さに基づいて計算されます。


  • 動画: 生成された動画は 1 秒あたり $0.14。

関連モデル

pikaframes

Pikaframesで開始画像から終了画像までの変化を滑らかにアニメーション化します。

flux-3/image-to-video

開始画像を任意のネイティブ音声付き動画にアニメーション化

sora-2/image-to-video

テキストや画像からリアルな映像と音声を一体化し、創造的な動画を生成。

hailuo-02/pro/text-to-video

必須のテキストプロンプトから、プロンプト拡張に対応した Hailuo 02 Pro の 6 秒動画を生成します。

seedance-2.5/reference-to-video/720p

Seedance 2.5 Reference to Video: 参照画像、ビデオ、オーディオを映画のような AI ビデオに変換します

seedance-2.0/pro

正確なリップシンクとカメラ制御を備えた映画的な2K動画を生成します。

よくある質問

Gemini Omni Flash Reference to Video は何をしますか?

Gemini Omni Flash Reference to Video は 1 つ以上の参照画像とテキスト プロンプトを取得し、同期音声を含む短いクリップを生成します。参照画像は被写体、スタイル、レイアウトをガイドし、プロンプトは動き、ペース、シーン展開、サウンドを指示するため、写真が外観を設定し、テキストがそれに命を吹き込みます。

Gemini Omni Flash Reference to Video はどのような用途に適していますか?

これは、短いクリップ全体でキャラクター、製品、またはブランドの外観の一貫性を維持したり、リファレンスに基づいた映画のようなショットを作成したり、既存のビジュアルからプロモーションを作成したりする場合に効果的です。マーケティング担当者、映画製作者、ゲーム チーム、ソーシャル クリエーターは、アイデンティティとビジュアル ディレクションをソース画像に近づける必要がある場合に Gemini Omni Flash Reference to Video をよく使用します。

Gemini Omni Flash Reference to Video では参照画像を何枚利用できますか?

1 つ以上の参照イメージを指定できます。サポートされる形式には、jpg、jpeg、png、webp などがあります。 Gemini Omni Flash Reference to Video を使用すると、キャラクター、衣装、環境など、プロンプト内で各画像がどのような影響を与えるかについて言及し、結果をどのように形成するかを制御できます。正確な入力制限については、現在の RunComfy パラメータ画面を確認してください。

Gemini Omni Flash Reference to Video は音声をどのように処理しますか?

モデルは動画に合わせて、セリフ、環境音、必要に応じた音楽を生成します。Gemini Omni Flash Reference to Video のプロンプトでセリフの調子や背景音を指定でき、静かなクリップにしたい場合は「セリフなし」と指示できます。

Gemini Omni Flash Reference to Video はテキストから動画への生成とどう違うのですか?

参照画像を指定すると、テキストのみのプロンプトよりも被写体のアイデンティティ、スタイル、レイアウトをより厳密に制御できます。 Gemini Omni Flash Reference to Video を使用すると、画像がショットの見た目を固定し、プロンプトがショットの動きを指示します。これは、クリップに含めたい特定のキャラクターやシーンがすでにある場合に役立ちます。

Gemini Omni Flash Reference to Video はどのようなアスペクト比と長さを対応していますか?

Gemini Omni Flash Reference to Video は、3 ~ 10 秒のクリップ長を持つ、16:9 横長フレームと 9:16 縦長フレームをサポートします。使用可能な設定は時間の経過とともに変更される可能性があるため、正確なオプションについては、現在の RunComfy パラメータ画面を確認してください。

開発者は RunComfy API を通じて Gemini Omni Flash Reference to Video を利用できますか?

はい。 RunComfy のモデル画面で Gemini Omni Flash Reference to Video を試し、自動化と実稼働用に同じパラメーターを使用して RunComfy HTTP API 経由で同じモデルを呼び出すことができます。これにより、モデルを自分でホストしたりスケールしたりすることなく、テストから統合に移行できます。

RunComfy で Gemini Omni Flash Reference to Video を使用して生成料金はいくらですか?

Gemini Omni Flash Reference to Video の料金は、生成動画の長さに応じて 1 秒あたり $0.14 です。料金は RunComfy アカウントの USD 残高またはクレジットから差し引かれます。通常、新規ユーザーには試用クレジットが付与されます。最新料金はこのページの生成セクションでご確認ください。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • Seedance 2.5 Reference to Video 1080p
  • Seedance 2.5 1080p Text to video
  • Seedance 2.5 1080p
  • MiniMax H3 Open
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • すべてのモデルを見る →
画像モデル
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • Qwen Image 3.0
  • seedream 4.0
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

Gemini Omni Flash Reference to Video の使用例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...