テキストプロンプトから、1 回のリクエストで 1〜10 枚の画像を生成します。
| パラメータ | 型 | 既定値・制限 | 説明 |
|---|---|---|---|
| prompt | string | 2,000 文字未満 | 生成したい画像の中心となる説明です。被写体、スタイル、光、雰囲気、構図を具体的に記述します。 |
| negative_prompt | string | 最大 500 文字 | 画像に含めたくない要素や特徴を指定します。 |
| パラメータ | 型 | 既定値・制限 | 説明 |
|---|---|---|---|
| image_url | image_uri | 任意。JPEG/JPG/アルファなし PNG/BMP/WEBP、各辺 384~5,000 px、最大 10 MB | スタイル、同一性、編集内容を導く参照画像です。 |
| パラメータ | 型 | 既定値・制限 | 説明 |
|---|---|---|---|
| image_size | string | 既定値: 1024*1024 (1:1)、固定 8 サイズ | 10241024 (1:1)、8001200 (2:3)、1200800 (3:2)、9601280 (3:4)、1280960 (4:3)、7201280 (9:16)、1280720 (16:9)、1344576 (21:9) から選択します。 |
| max_images | integer | 既定値: 1、範囲: 1~5 | 生成枚数の上限です。モデルが返す枚数は設定値より少ない場合があります。 |
| seed | integer | 既定値: 0、範囲: 0~2147483647 | 固定シードを使うと結果を再現しやすくなります。 |
Wan 2.6 Text to Image は、標準的な HTTP リクエストで RunComfy API に組み込めます。プロンプト、任意の参照画像、出力サイズを送信し、クリエイティブ工程や CI/CD パイプラインで生成を自動化できます。
注記: Wan 2.6 Text to Image API エンドポイント
動きやストーリーを生成する場合は Wan 2.6 Text to Video を使用してください: https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video
既存画像を動画化する場合は Wan 2.6 Image to Video を使用してください: https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video
テキストプロンプトから、1 回のリクエストで 1〜10 枚の画像を生成します。
必須の画像とテキスト指示を使って編集し、プロンプト拡張、2 種類の出力解像度、シード、出力形式を設定できます。
Imagen 4 Fastでプロンプトから画像を生成し、ネガティブプロンプト、アスペクト比、シードを設定します。
必須プロンプトから画像を生成します。任意のネガティブプロンプト、15種類の出力サイズ、Magic Prompt拡張、シードを設定できます。
画像を編集可能な RGBA レイヤーに変換して、オブジェクトを正確に分離し、シームレスなデザインを制御します。
連続性のあるストーリービジュアルを簡単に生成できる、シーケンス対応AIクリエイティブツール。
Wan 2.6 Text to Image は、テキストプロンプトから高品質な静止画を生成します。任意の参照画像を使って、スタイル、被写体の同一性、具体的な編集内容を細かく制御できます。プロンプトへの忠実さ、リアルな質感、安定した構図を重視したモデルです。
Wan 2.6 Text to Image は、テキスト画像生成と参照画像による制御を 1 つのワークフローにまとめています。参照なしの単発生成よりも、ビジュアルの同一性、ブランド要素、意図した修正を重視する制作に適しています。
1024×1024(1:1)、800×1200(2:3)、1200×800(3:2)、960×1280(3:4)、1280×960(4:3)、720×1280(9:16)、1280×720(16:9)、1344×576(21:9)から選択できます。この画面では、それ以外のサイズや任意の寸法は指定できません。
プロンプトは 2,000 文字未満、ネガティブプロンプトは最大 500 文字です。任意の参照画像は JPEG、JPG、アルファチャンネルなし PNG、BMP、WEBP に対応し、各辺 384~5,000 ピクセル、最大 10 MB である必要があります。
RunComfy のモデル画面で試した後、API キーを使って Wan 2.6 Text to Image の API エンドポイントから同じ処理を呼び出せます。HTTP でプロンプト、任意の参照画像、出力サイズを送信します。このページの表示価格は 1 枚 $0.015 です。呼び出す前にアカウントのクレジットを確認してください。
任意の参照画像で被写体の特徴やスタイルを示し、プロンプトで目的のシーンを説明します。同じ参照画像と明確な指示を使うと一貫性を高められますが、生成のたびに完全に同じ結果になるとは限りません。
いいえ。このモデルが生成するのは静止画のみです。動画には Wan 2.6 Text to Video または Wan 2.6 Image to Video を使用してください。音声同期やリップシンクは、このテキスト画像生成エンドポイントの機能ではありません。
このモデルには Alibaba Cloud Model Studio の利用条件が適用されます。商用利用の可否は、その条件、地域、契約内容によって異なります。モデルページによると、無料ユーザーには商用ライセンスが付与されません。公開前に必ず最新の条件を確認してください。
max_images で 1~5 枚の上限を設定できますが、実際の出力枚数は少なくなる場合があります。0~2147483647 の固定 seed を使うと再現しやすくなりますが、すべての画像がピクセル単位で同一になる保証はありません。
はい。縦長コンテンツには 720×1280(9:16)、800×1200(2:3)、960×1280(3:4)を選べます。正方形や横長の素材には 1:1、4:3、3:2、16:9、21:9 を利用できます。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。





