logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

Gemini Omni Flash Image to Video:静止画を同期音声付き動画に変換 | RunComfy

google/gemini-omni-flash/image-to-video

Gemini Omni Flash Image to Video は、アップロードした画像をネイティブ同期音声付きの短いクリップにします。プロンプトで動きを指定でき、16:9 または 9:16、3~10 秒に対応します。

入力画像をどのように動かすか、または変化させるかを記述します。プロンプトでは、カメラワーク、テンポ、音声を指定できます(例:「カメラをゆっくり寄せる」「そよ風と鳥のさえずり」「セリフなし」)。「文字を表示しない」などの除外指示も追加できます。
アニメーション化する入力画像。サポートされている形式には、jpg、jpeg、png、webp が含まれます。
生成された動画のアスペクト比。
生成された動画の長さ (秒単位)。
Idle
The rate is $0.14 per second of generated video.

Gemini Omni Flash Image to Video の紹介

Google の Gemini Omni Flash Image to Video は、1 枚の静止画を、動きと音声が同期した 3~10 秒のクリップへ展開します。Gemini の現実世界に関する理解を活用し、自然で一貫した動きを生成します。アニメーション、キーフレーム、サウンドデザインを別々に行う代わりに、1 回のプロンプト操作で仕上げられるため、マーケティング、映像制作、ゲーム、SNS コンテンツに適しています。RunComfy ではブラウザと HTTP API の両方から利用でき、モデルのホスティングやスケーリングは不要です。
おすすめの用途:静止画から作る SNS クリップ | 映像と音のコンセプト検証 | 参照画像を生かした映画風ショット

Google / Gemini Omni Flash Image to Video#


このモデルは、1 枚の写真と書かれた指示を取得し、その画像をアニメーション化して、サウンドが組み込まれた短い映画のようなクリップを作成します。これは、Google の Gemini Omni Flash ファミリ内にあり、テキスト動画生成、動画編集、動画への参照にも対応しています。この RunComfy ページは、画像から動画へのタスクを実行します。


モデルは物理世界がどのように動作するかを推論するため、動きはショットの再生中にドリフトしたり歪んだりすることなく、最初のフレーム以降一貫した状態を保ちます。


ハイライト#


  • 単一画像アニメーション: 1 枚の静止画から開始して、モデルに被写体とシーンの物理を意識した自然な動きを推測させます。
  • ネイティブ同期音声: 音声、環境音、音楽が画像に合わせて生成されるため、別の音声 パスを必要とせずにクリップを共有することができます。
  • プロンプト指示されたモーション: カメラの動き、ペース、雰囲気をわかりやすい言葉で説明して、フレームがどのように生き生きと表現されるかを形作ります。
  • 現実の知識に基づいている: 出力は Gemini の現実世界の理解に基づいており、アニメーション シーンが真実味を持ち、話題に沿ったものに保たれます。
  • 柔軟なフレーミング: 16:9 横長または 9:16 縦長を 3 ~ 10 秒の整数長で選択します。
  • ファミリーの一部: Gemini Omni Flash ラインナップは、いくつかの動画 タスクをカバーします。このページでは、画像を動きに変換することに焦点を当てています。

パラメータ#


入力は、画像から動画へのタスクの RunComfy OpenAPI Input スキーマと一致します。


パラメータ必須型デフォルト範囲 / 選択肢説明
prompt*はい (*)string—説明テキスト入力画像をどのように動かすか、または変化させるかを指定
image_url*はい (*)string(画像 URI)—jpg, jpeg, png, webpアニメーション化する静止画
aspect_ratioいいえstring16:916:9, 9:16生成動画のアスペクト比
durationいいえinteger83~10(秒)生成動画の長さ(1 秒単位)

価格設定#


料金は、生成されたクリップの長さに基づいて計算されます。


  • 動画: 生成された動画は 1 秒あたり $0.14。

関連モデル

lucy-edit/fast

動画のURLとテキスト指示を使い、既存の動画を編集します。

wan-3.0/text-to-video

Wan 3.0 Text To Video は音声付きのプロンプトから映画のようなクリップを作成します

wan-2-5/text-to-video

必須プロンプトから5秒または10秒の動画を生成します。任意のWAV/MP3音声、ネガティブプロンプト、13種類の出力サイズを設定できます。

seedance-2.5/text-to-video/720p

Seedance 2.5: より強力な一貫性と長いクリップを備えた映画のような AI ビデオ

minimax-h3/image-to-video

最初のフレームの画像を最長 15 秒の 768p または 2K ビデオにアニメーション化します。

live-avatar

静止画のポートレートを、表情豊かで自然な動画へ高精度に変換します。

よくある質問

Gemini Omni Flash Image to Video は何をしますか?

Gemini Omni Flash Image to Video は、1 つの静止画像とテキスト プロンプトを取得し、その画像を同期した音声付きの短いクリップにアニメーション化します。被写体やシーンの自然な動きを推測するため、別のアニメーションや音声のステップを必要とせずに、1 つのフレームをサウンド付きの動きのあるショットに変えることができます。

Gemini Omni Flash Image to Video はどのような用途に適していますか?

静止写真を短いソーシャル クリップに変換したり、参照画像からカメラの動きやペースをテストしたり、音声ビジュアル コンセプトのプロトタイプを迅速に作成したりするのに適しています。クリエイター、マーケティング担当者、映画やゲームのチームは、本制作に入る前に、Gemini Omni Flash Image to Video を使用してモーションや雰囲気を調査することがよくあります。

Gemini Omni Flash Image to Video は音声をどのように処理しますか?

モデルはアニメーションに合わせて、セリフ、環境音、必要に応じた音楽を生成します。Gemini Omni Flash Image to Video のプロンプトでセリフの調子や背景音を指定でき、静かなクリップにしたい場合は「セリフなし」と指示できます。

Gemini Omni Flash Image to Video はテキストから動画への生成とどう違うのですか?

アップロードされた画像から開始すると、テキストのみのプロンプトよりも冒頭の構図と被写体の見た目をより厳密に制御できます。 Gemini Omni Flash Image to Video を使用すると、静止画が外観を固定し、プロンプトがシーンの動きを指示します。これは、特定のフレームをすでに念頭に置いている場合に便利です。

Gemini Omni Flash Image to Video はどのようなアスペクト比と長さを対応していますか?

Gemini Omni Flash Image to Video は、3 ~ 10 秒のクリップ長を持つ、16:9 横長フレームと 9:16 縦長フレームをサポートします。使用可能な設定は時間の経過とともに変更される可能性があるため、正確なオプションについては、現在の RunComfy パラメータ画面を確認してください。

Gemini Omni Flash Image to Video を使用する前に知っておくべき入力制限は何ですか?

1 つの入力画像と、動きを説明するテキスト プロンプトを提供します。サポートされている画像形式には、jpg、jpeg、png、webp などがあります。パネルにリストされていない制限については、RunComfy パラメーター フィールドを確認してください。一部の制約はプロバイダーの設定によって異なる場合があります。

開発者は RunComfy API を通じて Gemini Omni Flash Image to Video を利用できますか?

はい。 RunComfy のモデル画面で Gemini Omni Flash Image to Video を試し、自動化と実稼働用に同じパラメーターを使用して RunComfy HTTP API 経由で同じモデルを呼び出すことができます。これにより、モデルを自分でホストしたりスケールしたりすることなく、テストから統合に移行できます。

RunComfy で Gemini Omni Flash Image to Video を使用して生成料金はいくらですか?

Gemini Omni Flash Image to Video の料金は、生成動画の長さに応じて 1 秒あたり $0.14 です。料金は RunComfy アカウントの USD 残高またはクレジットから差し引かれます。通常、新規ユーザーには試用クレジットが付与されます。最新料金はこのページの生成セクションでご確認ください。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • Seedance 2.5 Reference to Video 1080p
  • Seedance 2.5 1080p Text to video
  • Seedance 2.5 1080p
  • MiniMax H3 Open
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • すべてのモデルを見る →
画像モデル
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • Qwen Image 3.0
  • seedream 4.0
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

Gemini Omni Flash Image to Video の使用例

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...