Modifiez une vidéo source avec une instruction textuelle tout en préservant la cohérence de la scène.
Seedance 2.5 Reference to Video est l'approche de nouvelle génération de ByteDance Seed pour transformer du matériel de référence en un court clip cinématographique. Il utilise vos images, vidéos et audio de référence pour piloter la génération tout en se concentrant sur un montage plus précis, des sujets plus cohérents et une qualité plus stable lorsqu'une prise de vue est étendue ou assemblée.
Facturation au nombre de secondes vidéo comptées (avec vidéos de référence = durée des vidéos de référence + durée de sortie ; sinon sortie seule) :
1) Ajoutez vos références — Téléchargez des images de référence sous Images (jusqu'à 9) ; ils ancrent l'identité, la garde-robe et le style de Seedance 2.5 Reference to Video. Ajoutez une courte référence Vidéos ou Audio pour guider le mouvement ou le son.
2) Décrivez la prise de vue — Écrivez ce qui devrait se passer et comment la caméra se comporte (action du sujet, poussée, panoramique). Le chinois ~≤500 caractères ou l'anglais ~≤1000 mots sont recommandés.
3) Respectez les limites — Les vidéos et l'audio de référence doivent durer de 2 à 15 secondes chacun ; audio inférieur à 15 Mo.
4) Choisissez le rapport hauteur/largeur : utilisez adaptive pour l'exploration ou un rapport fixe (par exemple 9:16 ou 16:9) pour un livrable connu.
5) Définir la durée — Tout nombre entier compris entre 4 et 15 secondes sur le modèle actuel.
6) Choisissez la résolution — 480p pour des brouillons rapides, 720p pour une valeur équilibrée par défaut, 1080p pour des détails élevés ou 4K pour la sortie la plus nette.
7) Générer de l'audio — Laissez activé pour le dialogue, les SFX ou la musique ; désactivez-le lorsque vous n’avez besoin que d’une vidéo silencieuse.
8) Générer et itérer — Échangez les références, affinez l'invite ou ajustez le rapport, la durée et la résolution, puis prévisualisez l'expérience Seedance 2.5.
Modifiez une vidéo source avec une instruction textuelle tout en préservant la cohérence de la scène.
Créez une vidéo animée à partir d’une image de référence et d’une vidéo source, avec choix du format de sortie et du seed.
Crée des clips synchronisés à partir de prompts avec un contrôle précis du son et du style par LoRA.
Créez une image depuis un prompt et réglez LoRA, format, fichier, étapes, prompt négatif et seed.
Générez une vidéo à partir de deux pistes audio et d’une image, puis réglez l’ordre des intervenants.
Transforme des images fixes en clips dynamiques et expressifs avec un son synchronisé.
Oui. Seedance 2.5 Reference to Video est désormais disponible sur RunComfy. Vous pouvez l'utiliser directement dans le navigateur ou via l'API HTTP. Seul un prompt textuel est requis ; les images, vidéos et audios de référence sont facultatifs, mais aident à orienter le style, le mouvement et l'ambiance.
Seedance 2.5 Reference to Video est un modèle multimodal de ByteDance Seed qui transforme des images de référence, de courtes vidéos et de l'audio, ainsi qu'une invite, en un court clip cinématographique. Il cible la création publicitaire, la prévisualisation de films, l'animation de personnages et la narration de marque où la cohérence des références et l'audio natif sont importants.
Vous joignez du matériel de référence (jusqu'à 9 images, 3 courtes vidéos et 3 clips audio) et décrivez la prise de vue dans l'invite. Les références ancrent l’identité, la garde-robe, le style, le mouvement et le son, tandis que l’invite guide l’action et la caméra. Sur le modèle actuel qui alimente cette page, seule l'invite est strictement requise, mais ce sont les références qui rendent les résultats de référence à la vidéo cohérents.
Seedance 2.5 se concentre sur un montage vidéo plus précis, une cohérence de référence plus forte et une qualité plus stable lorsqu'un clip est étendu ou assemblé. Il vise également à suivre de manière plus fiable les instructions négatives et de type horodatage, à améliorer les résultats multilingues et à réduire les artefacts de personnages dupliqués et les filigranes parasites.
Oui. Lorsque la génération audio est activée (valeur par défaut actuelle), le modèle peut produire une vidéo avec parole, SFX et musique synchronisés, qui prend en charge les clips synchronisés sur les lèvres. Vous pouvez le désactiver si vous n'avez besoin que d'une vidéo silencieuse. La qualité de la synchronisation labiale dépend toujours de la clarté du prompt et de la scène que vous décrivez.
La cohérence des références est au cœur de Seedance 2.5. Dans la pratique, des images de référence et une invite claire aident à ancrer l'identité, la garde-robe et le ton dans les montures. Sur le modèle actuel qui alimente cette page, vous pouvez joindre des images, des vidéos et des fichiers audio de référence dans les limites prises en charge pour renforcer la cohérence.
Des prompts d'environ ≤500 caractères en chinois ou ≤1000 mots en anglais sont recommandés. Vous pouvez joindre jusqu'à 20 images de référence, 6 vidéos de référence et 6 clips audio de référence. Seul le prompt est requis ; les références sont facultatives mais recommandées pour des résultats cohérents.
Les options de résolution sont 480p, 720p (par défaut), 1080p et 4K. Le rapport hauteur/largeur peut être adaptive (par défaut, lorsque le modèle choisit le rapport le plus proche) ou fixé à 16:9, 9:16, 4:3, 3:4, 1:1 ou 21:9. La durée est un nombre entier de secondes de 4 à 15 sur le modèle actuel, avec 5 par défaut.
La facturation dépend de la durée de la vidéo générée, sans vidéo de référence à 0,42 $/s et avec vidéo de référence à 0,26 $/s comptée (durée des vidéos de référence + sortie). Consultez la section Génération de cette page pour les prix en direct.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





