logo
RunComfy
  • ComfyUI
  • EntraîneurNouveau
  • Modèles
  • API
  • Tarification
discord logo
MODÈLES
Explorer
Tous les modèles
BIBLIOTHÈQUE
Générations
APIS DE MODÈLES
Documentation API
Clés API
COMPTE
Utilisation

LongCat Image : Texte à image avec six préréglages de taille | RunComfy

meituan/longcat-image/text-to-image

Générez une image à partir de texte avec six préréglages de taille exacte ainsi que des contrôles d'étape d'inférence, de guidage, de graine et JPEG, PNG ou WebP.

Description textuelle de l'image à générer.
Sélectionne l’un des six préréglages de taille exacte. Ce schéma ne fournit pas de champ de largeur ou de hauteur personnalisé.
Nombre d'étapes d'inférence, de 1 à 50.
Contrôle la force avec laquelle la génération suit l'invite, de 1 à 20.
Graine aléatoire entière utilisée pour des comparaisons répétables.
Format de sortie. Les valeurs exactes sont `jpeg`, `png` et `webp`.
Idle
The rate is $0.13 per image.

Introduction à la conversion texte-image LongCat Image

LongCat Image génère une image à partir d'une invite de texte requise. Cette page est strictement texte-image : elle n'a pas d'entrée `image_url` ou d'édition d'image. Il propose six préréglages exacts `image_size`, `num_inference_steps` de 1 à 50, `guidance_scale` de 1 à 20, un entier `seed` et `output_format` valeurs `jpeg`, `png` et `webp`.

Présentation de LongCat Image Text-to-Image#


LongCat Image génère une image à partir d'un prompt requis. Cette page n'accepte pas image_url, une image de référence, un masque ou une autre entrée d'édition.


Entrées et contrôles#


ParamètreObligatoirePar défaut/plageCe qu'il contrôle
promptOuiprompt d’exempleDescription textuelle de l'image à générer.
image_sizeNonPar défaut landscape_4_3Valeurs exactes : square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3, landscape_16_9. Aucun champ de largeur ou de hauteur personnalisé n’est exposé.
num_inference_stepsNonPar défaut 28; 1–50Nombre d'étapes d'inférence.
guidance_scaleNonPar défaut 4.5; 1–20Intensité avec laquelle le résultat suit le prompt.
seedNonPar défaut 0Graine entière pour des itérations comparables ou répétables. Aucun minimum ou maximum n’est documenté.
output_formatNonPar défaut pngValeurs exactes : jpeg, png, webp.

Flux de travail recommandé#


  1. Décrivez le sujet, le décor, la composition, la lumière, la couleur et le style dans prompt.
  2. Choisissez un préréglage image_size exact pour la disposition cible.
  3. Commencez par les valeurs par défaut num_inference_steps et guidance_scale ; régler une commande à la fois.
  4. Gardez seed fixe pour définir les comparaisons, puis sélectionnez le output_format requis.

Portée et limites#


  • Il s'agit d'une pure page de texte en image et n'expose pas d'édition d'image ni d'entrées de référence visuelle.
  • image_size n'a que six préréglages ; Custom, la largeur et la hauteur explicites, ainsi qu'une garantie de 4 mégapixels ne sont pas présentes dans le schéma.
  • La page n'expose pas les contrôles du nombre d'images, du vérificateur de sécurité, de l'accélération, des lots, de ControlNet ou de l'adaptateur IP.
  • Le schéma n'établit pas d'architecture de modèle, de couverture du langage d'invite, de parité exacte entre la sortie du navigateur et de l'API, de droits commerciaux ou de supériorité de référence.

API et modèle associé#


  • LongCat Image API
  • LongCat Image Edit

Modèles associés

gpt-4o-image/text-to-image

Générez des images photoréalistes au texte fidèle grâce à un contrôle précis du prompt.

wan-2.7/pro/text-to-image

WAN 2.7 Pro text-to-image produit des images fixes très détaillées pour l’impression et le grand format. Il reprend les commandes de la version Standard, accepte les prompts bilingues et génère jusqu’à cinq images par exécution.

z-image/turbo/text-to-image

Générez une à quatre images depuis un prompt et réglez cadrage, étapes, seed et format.

flux-2/lora/edit

Modifiez jusqu’à trois images avec un maximum de trois LoRA et des réglages précis pour le guidage, les étapes d’inférence, la taille, la graine et le format de sortie.

flux-3/image

FLUX 3 Image est un modèle d’image multimodal guidé par des références et capable d’afficher du texte lisible

ideogram-v3/text-to-image

Générez des images depuis un texte avec Ideogram 3.0 et contrôlez le format, la vitesse, la palette et le style.

Questions Fréquemment Posées

Puis-je utiliser la sortie LongCat Image à des fins commerciales ?

Le schéma lui-même n'indique pas les conditions de licence pour la sortie générée. Vérifiez les dernières conditions de licence et d'utilisation de LongCat Image, Meituan et RunComfy, et assurez-vous que l'invite et le contenu qui en résulte ne portent pas atteinte aux droits de tiers.

Quelles sont les limites techniques de cette page texte-image ?

prompt est requis. image_size a exactement six préréglages : square_hd, square, portrait_4_3, portrait_16_9, landscape_4_3 et landscape_16_9. num_inference_steps va de 1 à 50, guidance_scale de 1 à 20 et la sortie est jpeg, png ou webp. Il n'y a pas d'entrée d'image, de champ de taille personnalisée, de garantie de 4 mégapixels, de limite de tokens du prompt, de champ ControlNet ou d'adaptateur IP.

Comment passer de l'interface RunComfy à l'API ?

Testez d'abord les paramètres documentés, puis utilisez l'LongCat Image API avec les mêmes champs : prompt, image_size, num_inference_steps, guidance_scale, seed et output_format. Suivez la documentation actuelle de l'API pour l'authentification, la gestion des statuts, les limites de débit et la facturation.

Quelles nouvelles fonctionnalités rendent le LongCat Image meilleur que les modèles précédents ?

Le schéma actuel ne fournit aucun détail d’architecture ni données de référence comparatives. Il confirme un flux de travail texte-image avec six préréglages de taille et des contrôles pour les étapes d'inférence, le guidage, la graine et le format de sortie ; cela ne prouve pas la supériorité sur les modèles antérieurs.

Comment sont gérés les crédits d’utilisation ?

RunComfy gère la production via son système de crédit actuel. Consultez le panneau de génération ou la dernière documentation de facturation pour connaître les exigences actuelles. Le schéma ne définit pas de devise appelée usd, ne garantit pas de crédits gratuits ni ne précise que le coût change avec la complexité.

Que dois-je faire si le rendu est lent ou si une tâche est en file d'attente ?

Attendez l'état actuel de la tâche et consultez la documentation du service RunComfy ou l'assistance si les retards persistent. Le schéma du modèle ne promet pas de mise à l'échelle automatique, pas de démarrages à froid, de mises à niveau de GPU dédiées ou de niveaux de performances réservés.

L’API produira-t-elle toujours exactement le même résultat que l’interface Web ?

Les deux surfaces doivent utiliser les champs documentés pour ce modèle, mais le schéma ne garantit pas un graphique d'inférence identique ou une sortie identique en octets. Conservez seed et tous les paramètres exposés identiques, puis validez les résultats dans l'environnement cible.

Suivez-nous
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • Email
  • État du système
  • affilié
Modèles vidéo
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Voir tous les modèles →
Modèles d'images
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Voir tous les modèles →
Légal
  • Conditions d'utilisation
  • Politique de confidentialité
  • Politique relative aux cookies
RunComfy
Droits d'auteur 2026 RunComfy. Tous droits réservés.

RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.

Exemples de résultats LongCat Image