Modèles de génération vidéo par IA
Comparez Sora 2, Kling, Veo 3.1, Hailuo et d’autres modèles majeurs de génération vidéo par IA · Modèles disponibles actuellement : 39 · Modèles disponibles à titre informatif uniquement : 10
Comparez les modèles texte-vidéo et image-vidéo pour les clips, le contrôle caméra, les images de début et de fin et d’autres tâches vidéo.
Seedance 2.0 / Capacité — text n’accepte aucun contenu ; frames exige une première image et accepte une dernière image facultative ; reference exige un prompt et au moins une référence image, vidéo ou audio. Une référence multimodale ne peut pas être envoyée avec les champs de première et dernière images. Seedance 2.0 prend en charge trois scènes mutuellement exclusives : texte, images de début/fin et référence multimodale. Les sorties actuellement disponibles sont 720p, 1080p et 4K sur 4–15 secondes ; les requêtes avec vidéo de référence sont limitées à 1080p ou 4K, seules combinaisons actuellement tarifées. 164–3 840 crédits par requête
Seedance 2.0 Fast / Capacité — text n’accepte aucun contenu ; frames exige une première image et accepte une dernière image facultative ; reference exige un prompt et au moins une référence image, vidéo ou audio. Une référence multimodale ne peut pas être envoyée avec les champs de première et dernière images. 480p/720p · 4–15 · 47–450 crédits / requête.
Seedance 1.5 Pro / Capacité — Seedance 1.5 Pro sur Kyeo accepte du texte seul ou jusqu’à 2 images, avec 480p / 720p / 1080p, 4–12 secondes, génération audio, 6 ratios et verrouillage de caméra. Le coût de 7 à 180 crédits dépend de la combinaison ; le nom Pro et un prix supérieur ne prouvent ni qualité, ni stabilité, ni aptitude à la publication sur cette page.
HappyHorse 1.0 / Types de workflow — Les workflows disponibles comprennent la vidéo à partir d’un prompt seul, la vidéo à partir d’une image et la vidéo de référence avec 2 à 9 images. La modification d’une vidéo existante n’est actuellement pas disponible sur cette page.
Wan 2.7 réunit texte-vidéo, image-vidéo avec première image ou première et dernière images, et montage. Il propose 720p et 1080p : comparez ensemble fichiers, durée, format et crédits estimés.
Sans média, le mode texte vers vidéo est sélectionné ; une seule image sélectionne image vers vidéo et une à trois vidéos sélectionnent le montage vidéo. Images et vidéos ne peuvent pas être mélangées. Par défaut : 1080p, 5 secondes, structure des plans désactivée et filtre de contenu activé.
Wan 2.5 Video sur Kyeo : texte et image vers vidéo, 5/10 secondes, 720p/1080p, limites des prompts et crédits de 60 à 200. Kyeo facture précisément selon la résolution et la durée : 60 crédits en 720p pendant 5 secondes, 120 en 720p pendant 10 secondes, 100 en 1080p pendant 5 secondes et 200 en 1080p pendant 10 secondes ; la valeur par défaut de 720p pendant 5 secondes coûte 60 crédits. Comment calculer les 60/100/120/200 crédits de Wan 2.5 — Wan 2.5 Video sur Kyeo : texte et image vers vidéo, 5/10 secondes, 720p/1080p, limites des prompts et crédits de 60 à 200.
Wan 2.2 A14B Turbo n’est pas un workflow unique sur Kyeo : sans fichier, il utilise le texte vers vidéo ; avec une image, l’image vers vidéo ; avec une image et un audio, la route pilotée par la voix. Les trois routes ont des résolutions, crédits et contrôles visibles différents : vérifiez d’abord la combinaison de fichiers.
Wan 2.2 Animate Replace remplace un personnage depuis une vidéo source et une image téléversées dans le workbench, avec sortie en 480p, 580p ou 720p. La facturation utilise les secondes vérifiées de la vidéo source et interdit la saisie d’URL média arbitraires.
Kyeo propose six combinaisons valides : pour Standard, 768P pendant 6/10 secondes et 1080P pendant 6 secondes coûtent 25/40/40 crédits ; pour Pro, 40/80/70. Le 1080P ne prend pas en charge 10 secondes. 1 fichier JPG/PNG/WebP obligatoire, 10 Mo maximum.
Hailuo Pro génère des vidéos de 6 secondes en 1080P à partir d’un texte, d’une image ou d’images de début et de fin. Chaque demande coûte 57 crédits et l’ajout de l’image finale ne change pas le prix.
Hailuo Standard associe texte vers vidéo, animation d’une image de départ et image de fin facultative. Cinq combinaisons sont facturées de 12 à 50 crédits.
Kling 3.0 sur Kyeo : 3 à 15 secondes, un plan ou jusqu’à 5 plans, images début-fin, son et tarifs std/pro/4k par seconde. Cette page convient pour définir des images de début/fin ou découper une idée de 3 à 15 secondes en 5 plans courts maximum. La cohérence du personnage, le mouvement des lèvres, le texte, le son et les raccords doivent être vérifiés sur les résultats réels.
Quelles entrées faut-il pour Kling 3.0 Motion Control ? — 1 image + 1 vidéo — La facturation utilise la durée signée de la vidéo : 20 crédits par seconde en `720p` ou 27 en `1080p`, multipliés par la durée vérifiée de 3 à 30 secondes et arrondis au supérieur. Une durée absente ou invalide bloque la génération.
Kling 2.6 est sur Kyeo un service vidéo à deux workflows : sans image, il appelle le texte vers vidéo ; avec une image, l’image unique vers vidéo. Les deux proposent 5/10 secondes et l’interrupteur `sound`, tandis que le texte propose trois ratios supplémentaires. Les quatre combinaisons tarifaires sont 55, 110, 110 et 220 crédits.
Kling 2.6 Motion Control : une image, une vidéo, limites d’orientation, 3 à 30 secondes et tarifs de 11 crédits/seconde en 720p ou 18 en 1080p. Cette page sert à vérifier si le transfert de mouvement d’un personnage correspond à vos images et vidéos ; le corps, le visage, les mains, l’identité, le fond, le texte et les mouvements rapides doivent être testés avec vos propres fichiers.
Kling V2.5 Turbo Pro propose sur Kyeo à la fois le texte vers vidéo et l’image vers vidéo : sans image, la route texte est utilisée ; avec 1 ou 2 images, la route image début/fin est choisie. Les deux routes proposent 5 ou 10 secondes, pour respectivement 42 ou 84 crédits.
Kling V2.1 Master est l’entrée Kyeo actuelle pour le texte vers vidéo et l’image unique en 1080p. Sans image, la route texte est utilisée ; avec 1 JPEG/PNG, la route image est choisie. Les deux produisent 5 ou 10 secondes pour respectivement 160 ou 320 crédits.
Kling V2.1 Pro est l’entrée Kyeo actuelle pour la vidéo image 1080p entre image de début et de fin, en niveau High Quality. Une image de début est obligatoire et une deuxième peut définir la fin ; 5 ou 10 secondes coûtent respectivement 50 ou 100 crédits.
Kling V2.1 Standard est l’entrée Kyeo actuelle pour la vidéo image 720p à partir d’une seule image. Il faut une image JPEG/PNG et un prompt ; les vidéos de 5 ou 10 secondes coûtent respectivement 25 ou 50 crédits.
Type de workflow: L’interface exige exactement 1 image JPEG ou PNG et 1 fichier audio MPEG, WAV, X-WAV, AAC, MP4 ou OGG. L’image est limitée à 10 MB ; l’audio à 100 MB et 5 minutes. Le débit est calculé à partir de la durée audio signée, à 16 crédits par seconde, puis arrondi au supérieur. Une durée absente, invalide ou supérieure à 5 minutes ne peut pas être envoyée.
Type de workflow: L’interface exige exactement 1 image JPEG ou PNG et 1 fichier audio MPEG, WAV, X-WAV, AAC, MP4 ou OGG. L’image est limitée à 10 MB ; l’audio à 100 MB et 5 minutes. Le débit est calculé à partir de la durée audio signée, à 8 crédits par seconde, puis arrondi au supérieur. Une durée absente, invalide ou supérieure à 5 minutes ne peut pas être envoyée.
Infinitalk utilise sur Kyeo 1 image, 1 audio de 15 secondes maximum et un prompt obligatoire pour produire une vidéo de présentation. La résolution 480p ou 720p et le `seed` sont au choix ; le coût dépend des secondes audio et de la résolution, et non d’un prix fixe par requête.
Runway prend actuellement en charge la génération vidéo depuis un texte ou une seule image. Trois options de base sont proposées : 720p pendant 5 secondes, 720p pendant 10 secondes et 1080p pendant 5 secondes.
Runway — Runway Aleph accepte-t-il une image de référence — 90 crédits fixes / requête. Elle sert à demander l’ajout, la suppression ou le remplacement d’un élément, un nouvel éclairage, un changement de style ou une modification du contenu d’une vidéo existante. Elle sert à demander l’ajout, la suppression ou le remplacement d’un élément, un nouvel éclairage, un changement de style ou une modification du contenu d’une vidéo existante.
Kyeo AI utilise-t-il actuellement Grok Imagine Video 1.5 Preview ? Choix de la route de plateforme — 1–15 secondes ; 480p ou 720p ; jusqu’à 7 images de référence
Topaz Video Upscaler est le flux Kyeo actuel de traitement d’une seule vidéo selon un facteur. Il reçoit une URL vidéo et `1x / 2x / 4x`, avec `2x` par défaut, sans accepter de prompt.
Veo3.1 Quality est le parcours Veo identifié par Veo 3.1 Quality que Kyeo utilise actuellement. Une requête de base en texte ou avec 1 à 2 premières/dernières images coûte 225 crédits fixes ; Extend, 1080p ou 4K peuvent être lancés séparément après réussite. Quality est un nom de flux et ne garantit pas une qualité de livraison fixe.
Veo3.1 Fast sur Kyeo AI prend en charge le texte, les images initiale/finale et les références, avec choix direct 720p/1080p/4K et durées de 4/6/8 secondes. 30 / 38 / 90 crédits selon la résolution.
Veo3.1 Lite sur Kyeo AI prend en charge le texte, les images initiale/finale et les références, avec choix direct 720p/1080p/4K et durées de 4/6/8 secondes. 15 / 23 / 75 crédits selon la résolution.
Kling 3.0 Turbo cible la création de vidéos courtes de 3 à 15 secondes : sans image, il utilise le mode texte ; avec une image conforme, il passe en génération image vers vidéo. La résolution et la durée déterminent directement la préautorisation.
Seedance 2.0 Mini réunit dans un même accès les modes texte, images de début-fin et références multimodales. Une vidéo de référence entre dans la formule de prix avant création : la durée des médias comme celle de la sortie doivent donc être vérifiées de manière fiable.
Seedance 2.5 réunit dans un contrat de scène strict une limite de 30 secondes, davantage de médias et des références adaptées au montage vidéo. La durée automatique n’est pas sous-estimée à 5 secondes : sa préautorisation utilise le plafond de 30 secondes.
MiniMax H3 propose deux niveaux, 768P et 2K, avec génération depuis du texte, des images de début-fin ou des références image/vidéo/audio. La durée des vidéos de référence et le nombre d’images à partir de la sixième entrent dans la préautorisation.
HappyHorse 1.1 choisit automatiquement son workflow selon le nombre d’images : aucune pour le mode texte, une pour l’image vers vidéo depuis une première image, et 2 à 9 pour le mode référence. Les trois modes partagent résolutions, durées et tarifs par seconde.
Le parcours principal d’OmniHuman 1.5 transforme une image de personne, d’animal ou de personnage animé et un audio en vidéo pilotée. La durée de l’audio est vérifiée par une signature d’import et détermine directement la préautorisation.
Video Lip Sync adapte les mouvements de bouche d’une vidéo existante à un audio vocal cible. Le mode léger vise les vidéos frontales à une personne ; le mode de base convient à des scènes individuelles plus complexes et peut activer la détection de scènes.
Wan 3.0 associe les niveaux Standard et Prime à la génération par texte, par première/dernière image et par références multimodales signées. La réservation multiplie le tarif de la variante et de la résolution par la somme des secondes de vidéo d’entrée vérifiées et des secondes de sortie réservées, puis arrondit le total une seule fois. La durée intelligente réserve 30 secondes de sortie et n’est pas disponible avec une vidéo de référence.
État actuel — La génération en plan unique est disponible depuis du texte, une image initiale ou une paire initiale/finale. La référence vidéo, la transformation, le multi-plan et les éléments ne sont pas encore disponibles.
Seedance 1.0 Pro concerne un ancien flux Seedance Pro pour créer des vidéos à partir de texte ou d’images. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Seedance 1.0 Pro Fast concerne un ancien flux Seedance axé sur la création rapide de vidéo depuis une image. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Seedance 1.0 Lite concerne un ancien flux Seedance pour créer de courtes vidéos à partir de texte ou d’images. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Luma Modify Video concerne la modification du contenu et du style d’une vidéo existante à partir d’instructions écrites. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Sora 2 Pro concerne une référence historique de Sora 2 Pro pour la génération vidéo de gamme supérieure. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Sora 2 concerne une référence historique de Sora 2 pour générer des vidéos depuis du texte ou des images. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Sora Watermark Remover concerne un ancien flux de nettoyage visuel d’une vidéo existante. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Gemini Omni Video vise les flux vidéo qui commencent par du texte, une image ou plusieurs références. La génération n’est pas disponible sur ce site ; cette page présente donc le statut, les limites et les alternatives utilisables.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
PixVerse V6 vise les vidéos courtes à partir de texte, d’une ou deux images ou de plusieurs références. La génération est indisponible ; cette page présente donc le contexte vérifié, les limites et les alternatives utilisables.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Wan 2.6 Flash concerne un flux de la famille Wan 2.6 orienté vers une génération vidéo plus rapide. La génération est fermée : aucune tâche ni dépense de crédits. Cette page conserve le contexte vérifié et oriente vers des alternatives actives.
La fiche complète est conservée, mais la génération en ligne n’est pas disponible actuellement.
Flux 3 appartient actuellement à la catégorie vidéo du marché de modèles source publique et est marqué Coming Soon. Sa fiche ne publie que Text to Video et Image to Video. Kyeo ne l’a pas ouvert et ne déduit pas ses capacités d’interface de la famille d’images Flux 2.
Wan Animate 2 est actuellement marqué Coming Soon sur le marché source publique, avec le seul libellé Video to Video. Sa page publique présente l'animation de personnages, mais la génération, les imports, le tarif et les paramètres API restent désactivés ici.