レイアウト、レイヤー分離、多言語テキストを制御できる、リファレンス画像ベースの編集モデル
Qwen Image 2512 は RunComfy で利用できる画像生成モデルです。prompt と任意の negative_prompt から、高品質な静止画を 1 枚生成します。クリエイティブデザイン、マーケティング素材、文字入りポスター、フォトリアルなシーンに適しています。
出力形式: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9
| Parameter | 必須 | Type | Default | Range / Options | 説明 |
|---|---|---|---|---|---|
| prompt* | はい (*) | string | — | — | 画像生成に使用するプロンプトです。 |
| negative_prompt | いいえ | string | "" | — | 画像に含めたくない要素を指定する任意の語句です。 |
| image_size | いいえ | ImageSize | Enum or object | landscape_4_3 | Enum: square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9. |
| num_inference_steps | いいえ | integer | 28 | — | 推論ステップ数です。増やすと細部が向上する場合がありますが、生成時間も長くなります。 |
| guidance_scale | いいえ | float | 5 | — | プロンプトへの追従度です。中程度の値は精度と創造性のバランスを取りやすくなります。 |
| seed | いいえ | integer | — | — | 同じ設定で結果を再現するための固定シードです。 |
| output_format | いいえ | OutputFormatEnum | "png" | jpeg, png, webp | 生成画像のファイル形式です。 |
レイアウト、レイヤー分離、多言語テキストを制御できる、リファレンス画像ベースの編集モデル
テキスト指示を即座に反映し、精密な画像生成と編集を実現する高性能AIツール。
必須のプロンプトに従って1〜10枚の元画像を編集し、必要に応じて最大3件のLoRAを適用します。6種類の出力サイズ、推論ステップ、ガイダンススケール、1〜4枚の結果、シード、Default・JPEG・PNGの出力形式を設定できます。
テキストから直感的に美しい画像を生成。デザインやアイデアをすぐに形にできる革新的ツール。
直感操作で意味も視覚も自在に編集。創造力を活かせる画像AIツール
テキストプロンプトから画像を生成し、6種類のサイズ、シード、JPEGまたはPNG出力を設定できます。
RunComfy のモデルページで確認したモデル設定を、そのまま RunComfy API で利用できます。API キーを作成し、生成パラメータをコードから指定して、利用量と費用を管理します。本番運用では Qwen Image 2512 の Apache 2.0 の条件も確認してください。
中国語と英語の文字を高い精度で描き、複数行の段落や両言語を組み合わせたポスターにも対応します。レイアウトを理解しているため、複雑なデザインでも文字揃えを保ち、歪みを抑えやすくなっています。
肌の色調、髪、表情やポーズを細かく描きながら、画像内の文字も鮮明で読みやすく保てます。そのため、リアルな人物と正確な文字の両方が必要な雑誌表紙、広告、インフォグラフィックに適しています。
フォトリアル表現や 4K 出力を主眼とするモデルもある中、Qwen Image 2512 は文字の正確さと自然な質感のバランスを重視し、生成も高速です。ベンチマークでは、中国語と英語を含むレイアウトの整合性が同等のオープンソースモデルを上回るとされています。
多言語のインフォグラフィック、ポスター、広告素材を高品質で制作したい代理店、教育機関、出版社に適しています。試作にも量産にも使える、リアルな画質と柔軟な生成性能を備えています。
RunComfyは最高の ComfyUI プラットフォームです。次のものを提供しています: ComfyUIオンライン 環境とサービス、および ComfyUIワークフロー 魅力的なビジュアルが特徴です。 RunComfyはまた提供します AI Models, アーティストが最新のAIツールを活用して素晴らしいアートを作成できるようにする。





