logo
RunComfy
  • ComfyUI
  • トレーナー新着
  • モデル
  • API
  • 価格
discord logo
モデル
探索
すべてのモデル
ライブラリ
生成履歴
モデルAPI
APIドキュメント
APIキー
アカウント
使用量

Wan 2.6 Text to Image:参照画像に対応した高精度なテキスト画像生成 | RunComfy

wan-ai/wan-2-6/text-to-image

テキストプロンプトと参照画像から、スタイルや被写体の同一性を細かく制御した高品質な画像を生成。ブランドビジュアル、広告、EC 商品画像に最適です。

プロンプトは 2,000 文字未満で入力してください。
任意の参照画像です。対応形式:JPEG、JPG、PNG(アルファチャンネルなし)、BMP、WEBP。各辺 384~5,000 px、最大 10 MB。
生成画像に含めたくない要素を指定します。
生成する画像数の上限です。実際の枚数はモデルの推論結果によって決まり、設定値より少ない場合があります。たとえば 5 に設定しても、内容によっては 3 枚だけ生成されることがあります。
Idle
The rate is $0.017 per image.

Wan 2.6 Text to Image の概要

Wan AI の Wan 2.6 Text to Image は、プロンプトを 1 枚 $0.015 で実制作に使える画像へ変換します。任意の参照画像を加えることで、スタイル、被写体の同一性、ブランド要素を細かくコントロールできます。素材サイトでの画像探しや複雑なマスク処理、手作業のレタッチを減らし、参照画像に基づく一貫したアートディレクションを実現します。マーケティング責任者、クリエイティブディレクター、EC ブランドチームに適したモデルです。RunComfy ではブラウザと HTTP API の両方から利用でき、モデルのホスティングやスケーリングは不要です。
おすすめの用途:コンバージョン重視の広告クリエイティブ | 商品のヒーロー画像 | ストーリーボードのキーフレーム

モデル概要#


  • 提供元: Alibaba Cloud
  • タスク: text-to-image
  • 対応画像サイズ: 1024×1024、800×1200、1200×800、960×1280、1280×960、720×1280、1280×720、1344×576 px
  • 概要: Wan 2.6 Text to Image は、自然言語のプロンプトから高精細な画像を生成し、任意の参照画像でスタイルや被写体の同一性、編集方針を指定できます。プロンプトへの忠実さ、リアルな質感、安定した構図を重視したモデルです。

主な機能#


参照画像による同一性とスタイルの制御#

  • 参照画像を視覚的な指針として使い、プロンプトで仕上がりを具体的に指定できます。
  • キャラクターやブランド要素を複数回の生成で一貫させやすくなります。

高精細でプロンプトに忠実な描画#

  • 被写体、スタイル、照明、雰囲気、構図について、英語または中国語の詳しい指示を解釈します。
  • EC、マーケティング、編集用途に適した自然なレイアウトとリアルな質感を表現します。

テキストと画像を組み合わせた制作#

  • テキストと参照画像を併用し、バリエーション作成や意図した修正を行えます。
  • ネガティブプロンプトで不要な物体、色、アーティファクトを除外できます。

入力パラメータ#


プロンプト#

パラメータ型既定値・制限説明
promptstring2,000 文字未満生成したい画像の中心となる説明です。被写体、スタイル、光、雰囲気、構図を具体的に記述します。
negative_promptstring最大 500 文字画像に含めたくない要素や特徴を指定します。

参照画像#

パラメータ型既定値・制限説明
image_urlimage_uri任意。JPEG/JPG/アルファなし PNG/BMP/WEBP、各辺 384~5,000 px、最大 10 MBスタイル、同一性、編集内容を導く参照画像です。

出力と再現性#

パラメータ型既定値・制限説明
image_sizestring既定値: 1024*1024 (1:1)、固定 8 サイズ10241024 (1:1)、8001200 (2:3)、1200800 (3:2)、9601280 (3:4)、1280960 (4:3)、7201280 (9:16)、1280720 (16:9)、1344576 (21:9) から選択します。
max_imagesinteger既定値: 1、範囲: 1~5生成枚数の上限です。モデルが返す枚数は設定値より少ない場合があります。
seedinteger既定値: 0、範囲: 0~2147483647固定シードを使うと結果を再現しやすくなります。

他のモデルとの比較#


  • Flux 2 との違い: Wan 2.6 Text to Image は、テキスト生成と参照画像による制御を 1 つのワークフローに統合しています。被写体の同一性や編集しやすさを重視する場合に適しています。Flux 2 Dev は現在 RunComfy で無料です。
  • Z-Image-Turbo との違い: Wan 2.6 Text to Image は、最高速度よりも、複雑なプロンプトにおける参照画像への忠実さと論理的な構図を優先します。
  • Nano Banana Pro との違い: Wan 2.6 Text to Image は、参照画像による制御と安定した編集を組み合わせ、同一性を重視するキャンペーン制作に向いています。
  • 最適な用途: スタイル、被写体の同一性、安定した編集工程が重要なブランドビジュアル、広告、EC 画像。

API 連携#


Wan 2.6 Text to Image は、標準的な HTTP リクエストで RunComfy API に組み込めます。プロンプト、任意の参照画像、出力サイズを送信し、クリエイティブ工程や CI/CD パイプラインで生成を自動化できます。


注記: Wan 2.6 Text to Image API エンドポイント


公式情報とライセンス#


  • Alibaba Cloud: Wan 2.6 シリーズ
  • Alibaba Cloud Model Studio: モデル一覧
  • Wan: 公式サイト
  • ライセンス: Alibaba Cloud Model Studio が提供するプロプライエタリモデルです。商用利用には Alibaba Cloud の規約が適用され、地域や導入形態によっては別途契約が必要です。無料ユーザーには商用ライセンスが付与されません。

関連機能#


動きやストーリーを生成する場合は Wan 2.6 Text to Video を使用してください: https://www.runcomfy.com/models/wan-ai/wan-2-6/text-to-video


既存画像を動画化する場合は Wan 2.6 Image to Video を使用してください: https://www.runcomfy.com/models/wan-ai/wan-2-6/image-to-video


関連モデル

grok-2/image

テキストプロンプトから、1 回のリクエストで 1〜10 枚の画像を生成します。

chrono-edit/lora

必須の画像とテキスト指示を使って編集し、プロンプト拡張、2 種類の出力解像度、シード、出力形式を設定できます。

imagen-4/fast/text-to-image

Imagen 4 Fastでプロンプトから画像を生成し、ネガティブプロンプト、アスペクト比、シードを設定します。

wan-2-2/flash/text-to-image

必須プロンプトから画像を生成します。任意のネガティブプロンプト、15種類の出力サイズ、Magic Prompt拡張、シードを設定できます。

qwen-image-layered

画像を編集可能な RGBA レイヤーに変換して、オブジェクトを正確に分離し、シームレスなデザインを制御します。

seedream-4-0/sequential

連続性のあるストーリービジュアルを簡単に生成できる、シーケンス対応AIクリエイティブツール。

よくある質問

Wan 2.6 Text to Image の主な機能は何ですか?

Wan 2.6 Text to Image は、テキストプロンプトから高品質な静止画を生成します。任意の参照画像を使って、スタイル、被写体の同一性、具体的な編集内容を細かく制御できます。プロンプトへの忠実さ、リアルな質感、安定した構図を重視したモデルです。

Wan 2.6 Text to Image は Flux 2 や Nano Banana Pro とどう違いますか?

Wan 2.6 Text to Image は、テキスト画像生成と参照画像による制御を 1 つのワークフローにまとめています。参照なしの単発生成よりも、ビジュアルの同一性、ブランド要素、意図した修正を重視する制作に適しています。

Wan 2.6 Text to Image が対応する解像度とアスペクト比は?

1024×1024(1:1)、800×1200(2:3)、1200×800(3:2)、960×1280(3:4)、1280×960(4:3)、720×1280(9:16)、1280×720(16:9)、1344×576(21:9)から選択できます。この画面では、それ以外のサイズや任意の寸法は指定できません。

Wan 2.6 Text to Image の入力制限は?

プロンプトは 2,000 文字未満、ネガティブプロンプトは最大 500 文字です。任意の参照画像は JPEG、JPG、アルファチャンネルなし PNG、BMP、WEBP に対応し、各辺 384~5,000 ピクセル、最大 10 MB である必要があります。

RunComfy でのテストから本番 API 利用へ移行するには?

RunComfy のモデル画面で試した後、API キーを使って Wan 2.6 Text to Image の API エンドポイントから同じ処理を呼び出せます。HTTP でプロンプト、任意の参照画像、出力サイズを送信します。このページの表示価格は 1 枚 $0.015 です。呼び出す前にアカウントのクレジットを確認してください。

Wan 2.6 Text to Image でビジュアルの同一性を保つには?

任意の参照画像で被写体の特徴やスタイルを示し、プロンプトで目的のシーンを説明します。同じ参照画像と明確な指示を使うと一貫性を高められますが、生成のたびに完全に同じ結果になるとは限りません。

Wan 2.6 Text to Image は音声や動画も生成しますか?

いいえ。このモデルが生成するのは静止画のみです。動画には Wan 2.6 Text to Video または Wan 2.6 Image to Video を使用してください。音声同期やリップシンクは、このテキスト画像生成エンドポイントの機能ではありません。

Wan 2.6 Text to Image の出力は商用利用できますか?

このモデルには Alibaba Cloud Model Studio の利用条件が適用されます。商用利用の可否は、その条件、地域、契約内容によって異なります。モデルページによると、無料ユーザーには商用ライセンスが付与されません。公開前に必ず最新の条件を確認してください。

Wan 2.6 Text to Image で一貫した画像を複数生成できますか?

max_images で 1~5 枚の上限を設定できますが、実際の出力枚数は少なくなる場合があります。0~2147483647 の固定 seed を使うと再現しやすくなりますが、すべての画像がピクセル単位で同一になる保証はありません。

Wan 2.6 Text to Image はモバイルや SNS 向けの形式に対応していますか?

はい。縦長コンテンツには 720×1280(9:16)、800×1200(2:3)、960×1280(3:4)を選べます。正方形や横長の素材には 1:1、4:3、3:2、16:9、21:9 を利用できます。

フォローする
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
サポート
  • Discord
  • メール
  • システムステータス
  • アフィリエイト
ビデオモデル
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • すべてのモデルを見る →
画像モデル
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • すべてのモデルを見る →
法的情報
  • 利用規約
  • プライバシーポリシー
  • Cookieポリシー
RunComfy
著作権 2026 RunComfy. All Rights Reserved.

RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。

Wan 2.6 Text to Image の生成例