OmniHuman 1.5
Le parcours principal d’OmniHuman 1.5 transforme une image de personne, d’animal ou de personnage animé et un audio en vidéo pilotée. La durée de l’audio est vérifiée par une signature d’import et détermine directement la préautorisation.
En une phrase
Que vaut ce modèle ?
L’image peut adopter n’importe quel format visuel, mais son type réel et ses dimensions signées doivent être validés. L’audio doit utiliser un format pris en charge, peser 10 Mo au plus et durer moins de 60 secondes. Le prompt facultatif suit le plafond plus strict de 300 caractères, sans reprendre une description contradictoire plus large.
Paramètres essentiels
Évaluez rapidement si ce modèle convient à votre activité.
Autres noms
Un même modèle peut porter des noms différents selon les sources. Ils sont regroupés ici pour faciliter la recherche et la comparaison.
Questions fréquentes des utilisateurs
Ces questions pratiques portent sur la tâche, les entrées et le résultat à confirmer avant de choisir.
Guide de choix
Pour choisir entre plusieurs modèles, commencez par ces critères essentiels.
Utilisez ce modèle si vous partez d’une image statique de personne ou de personnage à animer avec un audio.
Pour conserver les gestes et la caméra d’une vidéo existante, comparez Video Lip Sync.
Un essai court aide à vérifier la détection du sujet et la synchronisation avant d’étendre le contenu.
Comparaisons souvent recherchées
Comparez des alternatives courantes sur une même tâche pour clarifier les différences d’entrées, de contrôle et de coût.
Tableau comparatif
Vous hésitez encore ? Ce tableau met en évidence les principales différences entre ce modèle et ses alternatives.
Retour d’usage
Des conseils pratiques fondés sur les sources publiques, les limites actuelles du site et des tâches représentatives.
Une ouverture limitée ne comprend pas toute la suite d’outils
La préautorisation à la seconde d’audio est vérifiable
Fonctions en détail
Pilotage par image et audio
Deux résolutions de sortie
Mode rapide
Usages adaptés
Présentateur virtuel
Dialogue de personnage animé
Courte vidéo d’animal personnifié
Conseils de prompt
Garder le sujet bien visible
Utiliser une voix propre
Rester concis
Pourquoi le choisir ?
À savoir avant de l’utiliser
Paramètres réglables
Évaluez rapidement si ce modèle convient à votre activité.
Coût en crédits
La préautorisation est calculée à 27 crédits par seconde d’audio vérifiée, puis arrondie à l’entier supérieur. L’audio doit durer moins de 60 secondes : une requête valide reste donc sous 1 620 crédits de préautorisation. La tâche est ensuite réglée selon la consommation réelle.
Avant de générer une série d’images ou de vidéos, effectuez un test A/B avec les mêmes médias sur ce modèle et des modèles similaires. Lancez la série après avoir validé le résultat pour éviter de gaspiller des crédits.
Questions fréquentes
Modèles similaires
Vous hésitez encore ? Comparez aussi ces modèles similaires.
Kling AI Avatar Standard
Type de workflow: L’interface exige exactement 1 image JPEG ou PNG et 1 fichier audio MPEG, WAV, X-WAV, AAC, MP4 ou OGG. L’image est limitée à 10 MB ; l’audio à 100 MB et 5 minutes. Le débit est calculé à partir de la durée audio signée, à 8 crédits par seconde, puis arrondi au supérieur. Une durée absente, invalide ou supérieure à 5 minutes ne peut pas être envoyée.
Infinitalk
Infinitalk utilise sur Kyeo 1 image, 1 audio de 15 secondes maximum et un prompt obligatoire pour produire une vidéo de présentation. La résolution 480p ou 720p et le `seed` sont au choix ; le coût dépend des secondes audio et de la résolution, et non d’un prix fixe par requête.
Volcengine Video Lip Sync
Video Lip Sync adapte les mouvements de bouche d’une vidéo existante à un audio vocal cible. Le mode léger vise les vidéos frontales à une personne ; le mode de base convient à des scènes individuelles plus complexes et peut activer la détection de scènes.
Sources
Le contenu de cette page est établi à partir des informations sur le modèle, de ses fonctions et des réglages actuellement disponibles sur Kyeo AI.
Découvrez le parcours ouvert d’OmniHuman 1.5 : une image et un audio pour créer une vidéo 720P/1080P, audio inférieur à 60 secondes et prix à la seconde. La préautorisation est calculée à 27 crédits par seconde d’audio vérifiée, puis arrondie à l’entier supérieur. L’audio doit durer moins de 60 secondes : une requête valide reste donc sous 1 620 crédits de préautorisation. La tâche est ensuite réglée selon la consommation réelle.
Elles servent à vérifier les modes d’entrée, réglages visibles, limites des médias et disponibilité de la version actuellement reliée au site. Les options réelles sont celles de la page et de l’espace de création.