Créez des vidéos IA expressives à partir de textes avec un mouvement fluide et des détails réalistes.
Seedance 2.0 Fast est un modèle text-to-video multimodal optimisé pour la vitesse de ByteDance Seed qui transforme les descriptions de scènes et les références facultatives en courts clips cinématographiques. Sur RunComfy, vous pilotez la génération avec un prompt et des images facultatives (jusqu'à 9), des vidéos (jusqu'à 3) et de l'audio (jusqu'à 3) pour le mode de référence multimodal, et vous pouvez définir le rapport d'aspect, la durée, la résolution, les options générer de l'audio et seed, ainsi que des outils facultatifs (par ex. [{ "type": "web_search" }] pour permettre la recherche en ligne lorsque le modèle en a besoin).
type: web_search afin que le modèle puisse effectuer une recherche sur le Web en cas de besoin ; vérifiez usage.tool_usage.web_search dans la réponse à la requête de tâche pour connaître le nombre de recherches exécutées.Créez des vidéos IA expressives à partir de textes avec un mouvement fluide et des détails réalistes.
Outil IA de création vidéo 1080p, transformant le texte en vidéos expressives et naturelles pour les artistes.
Générez une voix depuis un texte et synchronisez-la avec une vidéo ; choisissez la voix, la langue et la vitesse.
Texte-vidéo cinématographique haut de gamme avec la plus haute fidélité visuelle de la famille Kling V3.0.
Générez une vidéo à partir d'images fixes multi-images clés avec audio en option
Animez une image source obligatoire avec l’un des 48 effets prédéfinis et des réglages de résolution, durée, prompt négatif et optimisation.
Seedance 2.0 Fast est le modèle vidéo multimodal orienté vers la vitesse de ByteDance Seed : vous décrivez la scène dans du texte et pouvez ajouter des images, une vidéo de référence et un audio de référence afin que le modèle aligne le mouvement, l'apparence et le son. Sur RunComfy, il est réglé pour un délai d'exécution plus rapide tout en prenant en charge les courts clips cinématographiques, l'audio natif en option, les résultats avec une synchronisation labiale précise et le contrôle de la caméra lorsque vous dirigez la prise de vue dans votre prompt.
La résolution est 480p ou 720p (par défaut). Le rapport d'aspect est par défaut adaptatif (le modèle sélectionne la correspondance la plus proche ; le résultat de la tâche affiche le rapport de sortie réel). Vous pouvez aussi le fixer à 16:9, 9:16, 4:3, 3:4, 1:1 ou 21:9.
Seul prompt est requis ; les références sont facultatives mais définissent le mode de référence multimodal lorsque vous les ajoutez. Prompt : environ ≤500 caractères chinois ou ≤1000 mots anglais sont recommandés. Images : jusqu'à 9 (jpeg, png, webp, bmp, tiff, gif). Vidéos de référence : jusqu'à 3 (mp4, mov), chacune d’une durée de 2–15 secondes. Audio de référence : jusqu'à 3 (wav, mp3), chacune d’une durée de 2–15 secondes et moins de 15 Mo. Des prompts clairs et des références alignées donnent généralement l'identité, le style et la synchronisation les plus stables.
La durée est un nombre entier 4–15 secondes (par défaut 5). Choisissez n’importe quelle durée entière dans cette plage par tâche.
Avec Générer l'audio (generate_audio) défini sur true (valeur par défaut), le modèle peut produire une vidéo avec audio synchronisé (dialogue, SFX ou musique). Réglez-le sur false pour une vidéo silencieuse. La qualité de la synchronisation labiale dépend de la manière dont vous décrivez explicitement la parole, le cadrage et le timing dans le prompt ; la référence audio peut également guider le rythme ou le ton lorsque vous utilisez des références multimodales.
Choisissez Fast lorsque vous privilégiez des temps d'attente plus courts et des itérations rapides : mêmes champs du Playground (prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio, seed), avec une sortie 480p/720p et l’ensemble des limites de référence multimodale. Choisissez Pro lorsque vous souhaitez bénéficier de la fidélité cinématographique la plus élevée proposée par le fournisseur pour une prise de vue. Effectuez des tests A/B avec le même prompt et les mêmes références pour juger de la qualité par rapport à la vitesse de votre pipeline.
Seedance 2.0 Fast se concentre sur de courts clips cinématographiques avec de riches références multimodales (de nombreuses images plus vidéo et audio en option), une durée 4–15 s, des rapports d'aspect adaptatifs ou fixes et un audio intégré lorsque generate_audio est activé. Les améliorations dépendent du cas d'utilisation ; comparez vos propres prompts, personnages et packs de référence plutôt que de vous fier à un seul benchmark.
Cela dépend du budget, de la latence et du type de mouvement dont vous avez besoin. Sur RunComfy, Seedance 2.0 Fast met l'accent sur le text-to-video multimodal rapide avec jusqu'à neuf images, trois vidéos de référence, trois références audio, des préréglages 480p/720p et une bascule générer de l'audio. Wan 2.5 et Kling 2.6 diffèrent en termes de prix, de limites et de points forts : effectuez des tests en parallèle sur vos briefs et ensembles de référence typiques.
Reprenez le schéma d’entrée du Playground : prompt, image_url, video_url, audio_url, aspect_ratio, duration, resolution, generate_audio et seed. Appliquez les mêmes limites de prompts et de médias dans votre application, puis authentifiez-vous avec votre clé API et vos crédits pour les tâches par lots ou automatisées.
L'utilisation commerciale dépend de la licence de ByteDance pour le modèle et des conditions de service de RunComfy. Lisez la licence officielle du modèle et la documentation RunComfy, ou envoyez un e-mail à hi@runcomfy.com avant d'utiliser les séquences générées dans des campagnes payantes, dans le cadre d'un travail client ou pour une diffusion à grande échelle.
Créateurs et équipes qui ont besoin d'une génération rapide de vidéos multimodales : concepts sociaux et publicitaires, storyboards et prévisualisations, courts métrages de marque et flux de travail à forte itération où la vitesse compte autant qu'un seul visuel phare. Associez le texte à des références lorsque vous avez besoin d'un look, d'un personnage ou d'un mouvement guidé par l’audio reproductible, puis passez à Pro pour une finition finale lorsque la prise de vue le justifie.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





