Transformez vos images en vidéos cinématiques avec une fluidité professionnelle
Ce modèle image-vers-vidéo économique de la famille O3 de Kuaishou anime une frame de référence tout en préservant le sujet et la scène de l’image source. La version Standard équilibre une bonne qualité visuelle et un tarif accessible à la seconde sur toute la plage de 3 à 15 secondes.
Il s’adresse aux équipes qui souhaitent créer de courtes vidéos à partir de photos, rendus ou concept arts existants, sans tournage, keyframes manuelles ni rotoscopie en postproduction.
| Paramètre | Obligatoire | Type | Valeur par défaut | Plage / Options | Description |
|---|---|---|---|---|---|
| image* | Oui (*) | string | — | URL publique | Frame de début à animer. |
| prompt* | Oui (*) | string | — | Texte libre | Description du mouvement, de la caméra, de la lumière et de l’action. |
| end_image | Non | string | — | URL publique | Frame de fin facultative pour guider une transition entre deux images. |
| duration | Non | integer | 5 | 3 – 15 | Durée de la séquence en secondes. |
| sound | Non | boolean | false | true / false | Génère un son synchronisé (ajoute environ 33% au tarif). |
| shot_type | Non | string | customize | customize, intelligent | Mode de réalisation ; intelligent détermine automatiquement le périmètre, customize suit le prompt. |
Sur RunComfy, le modèle est facturé à la seconde de sortie générée. L’activation du son ajoute environ 33% au tarif de base sur toute la durée de la séquence.
| Mode de sortie | Tarif par seconde |
|---|---|
| Vidéo sans son | $0.084 |
| Vidéo avec son | $0.112 |
Exemples de coûts estimés
| Durée | Sans son | Avec son |
|---|---|---|
| 3 s | ~$0.252 | ~$0.336 |
| 5 s (par défaut) | ~$0.420 | ~$0.560 |
| 10 s | ~$0.840 | ~$1.120 |
| 15 s | ~$1.260 | ~$1.680 |
Transformez vos images en vidéos cinématiques avec une fluidité professionnelle
Animez avec Pikaframes la transition entre une image de début et une image de fin.
Génération cinématographique text-to-video en 4K à 0,42 $ par seconde de sortie.
Modifiez une vidéo existante à partir d’une consigne textuelle et de son URL.
Modèle vidéo IA multi-plans rapide et économique, avec audio natif et guidage par références.
Générez des vidéos réalistes à partir d'images avec audio synchronisé.
Kling Video O3 Standard Image To Video est le modèle image-vers-vidéo économique de la génération O3 de Kuaishou. Il anime une image de référence en séquence de 3 à 15 secondes guidée par votre prompt, avec une image de fin facultative et un son synchronisé en option. Le modèle préserve l’identité du sujet présent dans la première frame tout en ajoutant des mouvements naturels, un déplacement de caméra et une dynamique de scène.
Les deux versions partagent l’esthétique O3, mais Kling Video O3 Standard Image To Video vise un tarif à la seconde inférieur, mieux adapté aux itérations, aux maquettes et aux volumes importants de contenus sociaux ou marketing. D’après les informations disponibles auprès du fournisseur, Pro est destinée aux rendus finaux qui exigent la meilleure fidélité. La structure des prompts, la plage de durées, les options audio et les types de plan se comportent de la même façon, ce qui facilite le passage d’une version à l’autre.
Vous fournissez une image de début et un prompt qui décrit le mouvement, la caméra et l’action. Kling Video O3 Standard Image To Video propose aussi une image de fin facultative pour guider une transition entre deux frames, une durée de 3 à 15 secondes, une option de son synchronisé, un shot_type réglé sur customize ou intelligent et une liste multi_prompt permettant d’enchaîner des segments de scène. Tous ces réglages pilotent le rythme, les temps narratifs et l’audio au sein d’une seule génération.
Les créateurs de contenus pour les réseaux sociaux, équipes publicitaires et marketing, producteurs de vidéos e-commerce et designers produit utilisent Kling Video O3 Standard Image To Video pour transformer des photos de produit, portraits ou concept arts en courtes séquences cinématographiques. Il convient également aux essais avant un rendu final plus coûteux et aux transitions entre images de début et de fin pour les séquences de type storyboard. Les développeurs peuvent l’intégrer à des pipelines qui transforment automatiquement une image et un brief en courte vidéo terminée.
image et prompt sont tous deux obligatoires. Dans Kling Video O3 Standard Image To Video, duration est un entier de 3 à 15 secondes, avec 5 par défaut ; sound est un paramètre booléen désactivé par défaut ; shot_type accepte customize ou intelligent. multi_prompt est une liste facultative destinée à guider les transitions, et end_image une URL facultative. Pour les autres contraintes, comme la résolution ou les formats pris en charge, consultez le panneau de paramètres RunComfy ; elles peuvent varier selon le fournisseur.
Oui. Commencez dans l’interface web RunComfy AI Playground et ajustez l’image de début, le prompt, la durée, l’audio et le type de plan jusqu’à obtenir le résultat souhaité avec Kling Video O3 Standard Image To Video. Appelez ensuite le même modèle via l’API RunComfy avec des paramètres identiques. Vous pouvez ainsi itérer dans le navigateur puis exécuter la production en code, avec le même comportement du modèle sur les deux interfaces.
Les générations consomment des crédits USD de votre solde RunComfy. D’après les informations disponibles auprès du fournisseur, Kling Video O3 Standard Image To Video coûte $0.084 par seconde sans son et $0.112 par seconde avec son. À titre d’exemple, 5 secondes sans son coûtent environ $0.420, 10 secondes avec son environ $1.120 et 15 secondes sans son environ $1.260. Les nouveaux utilisateurs disposent généralement d’un montant d’essai gratuit en USD ; consultez la section Generation de la page pour connaître le tarif actuel.
Kling Video O3 Standard Image To Video répond mieux aux prompts cinématographiques clairs qui décrivent le mouvement, la caméra, l’éclairage et l’environnement. Des indications concrètes comme "slow tracking shot", "golden hour rim light" ou "rain on neon-lit street" cadrent mieux l’esthétique et le mouvement que des termes d’ambiance vagues. Pour une scène complexe, séparez les différents temps avec multi_prompt afin de préserver des transitions nettes dans une seule séquence, et ajoutez end_image lorsque vous souhaitez contrôler précisément l’arc entre deux frames.
RunComfy est la première ComfyUI plateforme, offrant des ComfyUI en ligne environnement et services, ainsi que des workflows ComfyUI proposant des visuels époustouflants. RunComfy propose également AI Models, permettant aux artistes d'utiliser les derniers outils d'IA pour créer des œuvres d'art incroyables.





