画像、ビデオ、およびオーディオ キューからビデオへの参照をオープンウェイトします。




flux-3/text-to-video
FLUX 3 Video は、720p または 1080p でオプションのネイティブ オーディオを使用して、最大 20 秒のテキストからビデオへのクリップを作成します。
seedance-2.5/text-to-video/720p
Seedance 2.5は、テキストと参照メディアから、ネイティブ音声、優れた参照整合性、延長後もクリアな映像を備えた動画を生成します。広告、映画プリビズ、ブランドストーリーに最適です。
seedream-5.0-pro/text-to-image
Seedream 5.0 Proはテキストとリファレンスから画像を生成・編集し、精密なレイアウト、レイヤー分離、正確な多言語タイポグラフィによってブランド、商品、マーケティングのデザイン制作を支えます。
happyhorse-1.1/text-to-video
Happy Horse 1.1は、テキスト・画像・参照画像からの動画生成と編集を1つでこなし、音声も同時生成できるAlibabaのマルチモーダル動画モデルです。このページでは、720P/1080P・3~15秒のテキストから動画生成モードを利用できます。
オプションの最終フレームとネイティブ ステレオ オーディオを使用して、画像からビデオへのオープンウェイトを実現します。
480p/768p およびネイティブ ステレオ オーディオによるオープンウェイトのテキストからビデオへの変換。
FLUX 3 Draft Extend: 720p での高速低コストのクリップ継続ドラフト
Seedance 2.5一貫性を高め、より長いクリップに対応するシネマティックAI動画
Seedance 2.5 First & Last Frame:開始画像と終了画像をスムーズなシネマティック動画でつなぐ
Seedance 2.5:静止画像をシネマティックな AI 動画へ
Seedance 2.5 Reference to Video:参照素材からシネマティックなAI動画を生成
FLUX 3 Image は、参照画像によるガイドと読みやすい文字描画に対応したマルチモーダル画像モデルです
FLUX 3 Video はテキスト プロンプトをネイティブ オーディオを備えた映画のようなクリップに変換します
開始画像を任意のネイティブ音声付き動画にアニメーション化
開始フレームと終了フレームの間に、任意のネイティブ音声付き動画を生成
レイアウトとレイヤーを制御できる、テキストからの画像生成および画像編集モデル
レイアウト、レイヤー分離、多言語テキストを制御できる、リファレンス画像ベースの編集モデル
Seedream 5.0 Lite は参照ビジュアルを、レイアウト精度とスタイル一貫性を保ったデザインに変換し、クリエイティブ制作を加速します。
Seedream 5.0 Lite テキストから画像:レイアウトとタイポグラフィを精密に制御できるプロンプト→ビジュアルエンジン
480p/768p およびネイティブ ステレオ オーディオによるオープンウェイトのテキストからビデオへの変換。
オプションの最終フレームとネイティブ ステレオ オーディオを使用して、画像からビデオへのオープンウェイトを実現します。
最初のフレームの画像を最長 15 秒の 768p または 2K ビデオにアニメーション化します。
画像、ビデオ、オーディオのリファレンスから 768p または 2K ビデオを生成
FLUX Kontext Maxでプロンプトに沿って画像を編集し、シードを設定して9種類のアスペクト比から選択します。
必須の画像と編集指示を使い、FLUX Kontext Pro でシードと 9 種類の画面比率を設定して画像を編集します。
テキストだけで直感的に画像編集、複数レイヤー制御とスタイル記憶対応
文章から高精度な画像を素早く生成。直感操作でデザイン制作を革新。
固定1K解像度で、プロンプトから画像を高速・低コストに編集します。
固定1K解像度で、テキストから画像を高速・低コストに生成します。
Nano Banana 2 による高速・高品質なテキストから画像への生成。アスペクト比、安全性許容度、出力フォーマットを細かくコントロールできます。
Nano Banana 2 Edit によるプロンプト主導の画像編集。複数画像入力に対応し、アスペクト比・解像度・安全性許容度・出力を細かくコントロールできます。
WAN 2.7テキスト画像生成:高精度なプロンプト理解、柔軟なサイズ、1回で最大5枚を生成
WAN 2.7 Proのテキスト画像生成モデル。標準版と同じ操作項目と日英プロンプトに対応し、印刷物や大型ビジュアル向けの高精細な静止画を1回に最大5枚生成できます。
WAN 2.7画像編集は、1~4枚の参照画像を使った指示ベースの編集に対応。日英の指示、任意のプロンプト拡張、出力サイズのプリセットを利用できます。
WAN 2.7 Pro画像編集は、1~4枚の参照画像とプロンプト拡張に対応する高品質な指示ベース編集モデル。操作項目は標準版と共通です。
既存動画をプロンプトに沿って 7 秒延長し、720p で出力します。音声生成のオン・オフも選べます。
既存動画をプロンプトに沿って 7 秒延長し、720p で出力します。音声生成のオン・オフも選べます。
画像を瞬時に映画のようなAI動画へ変換。Veo 3.1で創造力を形に。
Veo 3.1 Fastで画像を瞬時に映像化。滑らかな動きと美しい表現で映像制作を強力サポート。
1枚の画像から映画的な4K動画を生成。出力1秒あたり$0.42。
参照素材から映画的な4K動画を生成。出力1秒あたり$0.42。
テキストから映画的な4K動画を生成。出力1秒あたり$0.42。
1枚の画像から3~15秒の映画的なプロ品質動画を生成。1秒あたり$0.112から。
デザインワークフローのための正確な詳細と柔軟なスタイル制御を備えたテキストから洗練されたビジュアルを作成します。
プロンプトから、中国語と英語の文字を正確に描き、構図の整ったリアルな画像を生成します。
構図や形状を保ちながら、被写体の一貫性も維持できる高精度な画像編集モデルです。
LoRA を使って構造と人物の一貫性を保ちながら、画像を精密に編集できるモデルです。
レイアウトとレイヤーを制御できる、テキストからの画像生成および画像編集モデル
レイアウト、レイヤー分離、多言語テキストを制御できる、リファレンス画像ベースの編集モデル
テキストから画像を生成し、最大3つのLoRAアダプター、画像サイズ、適用強度、シードを調整できます。
Seedream 4.5 Edit 画像編集で、一貫性のあるフォトリアルな画像作成とブランドの精密な一貫性を実現します。
Dreamina 4.0で画像から画像へ。4K対応の高精度AI編集でデザイン制作をスムーズに。
静止画を滑らかな映像に変換。Dreamina 3.0が2K品質のリアリズムで創作を実現。
静止画像をリアルな2K映像へ変換。精密で自然な動きをAIが自動生成。
テキストを瞬時に高品質なビジュアルへ変換。想像力を形にするAI画像生成・編集プラットフォーム。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。
