Transformez un portrait et une piste audio en une vidéo d'avatar parlant, avec un prompt facultatif pour guider les mouvements ou la manière de parler.
Wan 3.0 Text To Video lit une description en langage simple et renvoie un court clip cinématique. Vous décrivez le sujet, l'action, la caméra et la lumière ; le modèle compose le plan, pilote le mouvement et peut ajouter l'audio correspondant en un seul passage.
Cette page couvre le point de terminaison texte uniquement de la famille Wan 3.0. Il n'y a pas d'image à télécharger, c'est donc un moyen rapide d'explorer une idée, de bloquer une scène ou de produire un court plan fini à partir de mots uniquement.
| Paramètre | Obligatoire | Tapez | Par défaut | Gamme / Options | Descriptif |
|---|---|---|---|---|---|
| invite* | Oui (*) | chaîne | - | - | Scène, sujet, action, caméra, éclairage et mouvement. |
| résolution | Non | chaîne | 720p | 480p, 720p, 1080p | Niveau de résolution de sortie. |
| aspect_ratio | Non | chaîne | 16:9 | 16:9, 9:16, 1:1, 4:3, 3:4, adaptive | Rapport hauteur/largeur de sortie. |
| durée | Non | entier | 5 | 2-30 | Durée de sortie en secondes. |
| thinking_mode | Non | booléen | faux | vrai / faux | Interprétation plus approfondie pour les invites complexes. |
| enable_audio | Non | booléen | vrai | vrai / faux | Incluez une piste audio synchronisée. |
| graine | Non | entier | aléatoire | 0-2147483647 | Semez pour des résultats reproductibles. |
Le prix dépend de la résolution choisie : 0,06 $ par seconde à 480p, 0,12 $ par seconde à 720p et 0,25 $ par seconde à 1080p. L'activation ou la désactivation de l'audio ne modifie pas le débit.
Transformez un portrait et une piste audio en une vidéo d'avatar parlant, avec un prompt facultatif pour guider les mouvements ou la manière de parler.
Transformez vos images statiques en vidéos 1080p fluides et réalistes avec une précision créative.
Transformation de séquences par IA avec mouvements stables et contrôle créatif.
Synchronisez une piste audio avec une vidéo et choisissez si la vidéo doit être répétée.
Transforme des images de référence en vidéo fluide 720P ou 1080P à partir d’un seul prompt.
Créez une vidéo à partir d’une image, d’un fichier audio et d’un prompt, avec un contrôle distinct du texte et de l’audio.
Wan 3.0 Text To Video génère un court clip cinématique directement à partir d'une invite écrite, sans aucune image de référence requise. Il est utile pour la prévisualisation de concepts, les prises de vue publicitaires et promotionnelles et les vidéos sociales, vous permettant de visualiser une idée en quelques minutes à partir de mots uniquement.
Le point de terminaison texte-vidéo démarre uniquement à partir d’une invite, de sorte que le modèle compose la scène entière, tandis que le point de terminaison image-vidéo anime une première image spécifique que vous fournissez. Choisissez Wan 3.0 Text To Video lorsque vous souhaitez que le modèle invente le cadrage, et image vers vidéo lorsque vous avez déjà le plan d'ouverture.
Wan 3.0 Text To Video suit des instructions structurées qui nomment le sujet, l'action, le mouvement de la caméra et l'éclairage, et produit un mouvement cohérent semblable à celui d'un film. Des invites claires et concrètes avec une seule direction de caméra par prise de vue donnent généralement les résultats les plus prévisibles.
Il prend en charge les sorties 480p, 720p et 1080p, une durée de 2 à 30 secondes et des formats d'image incluant 16:9, 9:16, 1:1, 4:3 et 3:4. Utilisez 480p pour les brouillons rapides et 1080p pour la livraison ; vérifiez le panneau RunComfy pour connaître les limites de courant exactes.
Oui. Wan 3.0 Text To Video peut générer une piste audio synchronisée avec la vidéo et vous pouvez désactiver l'audio pour une exportation silencieuse. L'activation ou la désactivation de l'audio n'affecte pas le prix.
Le mode Réflexion permet une interprétation plus délibérée de l'invite, ce qui peut s'avérer utile lorsqu'une scène combine plusieurs actions, sujets ou règles de composition. Il est facultatif et désactivé par défaut, vous pouvez donc l'activer pour les invites complexes et le laisser désactivé pour les invites simples.
Oui. Vous pouvez prototyper Wan 3.0 Text To Video dans l'interface utilisateur du modèle RunComfy, puis appeler le même modèle via RunComfy HTTP API avec les mêmes paramètres. Cela facilite le passage des tests de navigateur à un flux de production automatisé.
Les générations consomment des USD ou des crédits en fonction de la résolution et de la durée : 0,06 $ par seconde à 480p, 0,12 $ par seconde à 720p et 0,25 $ par seconde à 1080p. Les nouveaux utilisateurs reçoivent généralement un montant d’essai gratuit pour tester Wan 3.0 Text To Video en premier.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





