Modelli IA per video
Consulta e confronta modelli video come Sora 2, Kling, Veo 3.1 e Hailuo · 39 modelli attualmente disponibili · 10 modelli disponibili solo a scopo informativo
Confronta modelli da testo a video e da immagine a video per clip, controllo camera, fotogrammi iniziale e finale e altre attività video.
Seedance 2.0 / Capacità — text non accetta materiali; frames richiede il primo fotogramma e consente l'ultimo; reference richiede un prompt e almeno un riferimento tra immagine, video o audio. I riferimenti multimodali non possono essere inviati insieme ai campi del primo e dell'ultimo fotogramma. Seedance 2.0 supporta tre scene mutuamente esclusive: testo, fotogrammi e riferimento multimodale. Le uscite attualmente disponibili sono 720p, 1080p e 4K per 4–15 secondi; le richieste con video di riferimento sono disponibili solo a 1080p o 4K, le combinazioni con prezzo attualmente verificato. 164–3.840 crediti per richiesta
Seedance 2.0 Fast / Capacità — text non accetta materiali; frames richiede il primo fotogramma e consente l'ultimo; reference richiede un prompt e almeno un riferimento tra immagine, video o audio. I riferimenti multimodali non possono essere inviati insieme ai campi del primo e dell'ultimo fotogramma. 480p/720p · 4–15 · 47–450 crediti / richiesta.
Seedance 1.5 Pro / Capacità — Seedance 1.5 Pro su Kyeo supporta testo puro o fino a 2 immagini, con 480p/720p/1080p, 4–12 secondi, generazione audio, 6 rapporti e camera bloccata. I 7–180 crediti dipendono dalla combinazione di parametri; il nome Pro e il costo maggiore non dimostrano qualità, stabilità o idoneità alla pubblicazione verificate in questa pagina.
Seedance 1.0 Pro riguarda un precedente flusso Seedance Pro per creare video da testo o immagini. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Seedance 1.0 Pro Fast riguarda un precedente flusso Seedance incentrato sulla creazione rapida di video da un’immagine. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Seedance 1.0 Lite riguarda un precedente flusso Seedance per creare brevi video da testo o immagini. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
HappyHorse 1.0 / Capacità — I flussi attualmente disponibili comprendono video dal solo prompt, video da una sola immagine e video di riferimento con 2–9 immagini. La modifica di un video esistente non è attualmente disponibile in questa pagina.
Wan 2.7 riunisce testo-video, immagine-video con fotogramma iniziale o iniziale e finale e modifica video. Con 720p e 1080p, confronta insieme materiali, durata, formato e crediti stimati.
Senza media viene selezionato testo-video, esattamente un’immagine seleziona immagine-video e da uno a tre video selezionano il montaggio video; immagini e video non possono essere combinati. Il valore predefinito è 1080p, 5 secondi, struttura delle scene Disattiva e filtro contenuti Attivo.
Wan 2.5 Video su Kyeo: flussi testo e singola immagine, 5/10 secondi, 720p/1080p, limiti dei prompt e prezzi da 60 a 200 crediti. Kyeo addebita con precisione per risoluzione e durata: 720p 5 secondi 60 crediti, 720p 10 secondi 120, 1080p 5 secondi 100, 1080p 10 secondi 200; la richiesta predefinita a 720p e 5 secondi costa 60 crediti. Come si calcolano i 60/100/120/200 crediti di Wan 2.5? — Wan 2.5 Video su Kyeo: flussi testo e singola immagine, 5/10 secondi, 720p/1080p, limiti dei prompt e prezzi da 60 a 200 crediti.
Wan 2.2 A14B Turbo su Kyeo non è un flusso unico: senza materiali usa la generazione da testo, con una immagine passa a immagine-video e solo con una immagine più un audio entra nel percorso guidato dalla voce. I tre flussi hanno risoluzioni, crediti e controlli visibili diversi: verifica prima la combinazione dei materiali.
Wan 2.2 Animate Replace sostituisce un personaggio usando un video sorgente e un'immagine caricati dal workbench, con output 480p, 580p o 720p. Il prezzo usa i secondi verificati del video sorgente e non consente URL multimediali arbitrari.
Kyeo ha sei combinazioni valide: per Standard 768P 6/10 secondi e 1080P 6 secondi costano 25/40/40 crediti; Pro costa rispettivamente 40/80/70. 1080P non supporta 10 secondi. Obbligatorio 1 JPG/PNG/WebP, massimo 10 MB.
Hailuo Pro / Capacità — Questa pagina si basa sui materiali ufficiali MiniMax dedicati a Hailuo 02 e sul contratto di prodotto attualmente verificato dal sito. Descrive solo i flussi testo e immagine disponibili, i limiti verificabili e i prezzi in crediti. Kyeo ha una sola combinazione Pro: richieste testo o immagine fisse a 1080P e 6 secondi, 57 crediti per generazione; aggiungere il fotogramma finale non costa extra.
Hailuo Standard unisce testo-video, animazione dal fotogramma iniziale e fotogramma finale opzionale. Cinque combinazioni costano da 12 a 50 crediti.
Kling 3.0 su Kyeo: 3–15 secondi, singola o multi-scena, fotogrammi iniziale-finale, audio e tariffe std/pro/4k al secondo. È adatto a definire fotogrammi iniziale/finale o a dividere un'idea di 3–15 secondi in fino a 5 scene brevi. Coerenza del personaggio, labiale, testo, audio e raccordi vanno comunque verificati sui risultati reali.
Quali input richiede Kling 3.0 Motion Control? — 1 immagine + 1 video — La fatturazione usa la durata firmata del video: 20 crediti al secondo in `720p` o 27 in `1080p`, moltiplicati per i 3–30 secondi verificati e arrotondati per eccesso. Durata assente o non valida blocca la generazione.
Kling 2.6 su Kyeo è un servizio video a due flussi: senza immagini usa il video da testo, con immagini il video da una singola immagine. Entrambi offrono 5/10 secondi e il selettore `sound`; il testo aggiunge tre proporzioni. Le quattro combinazioni costano 55, 110, 110 e 220 crediti.
Kling 2.6 Motion Control: un’immagine e un video, limiti di orientamento, 3–30 secondi e 11 crediti/secondo in 720p o 18 in 1080p. Può servire a verificare se il trasferimento del movimento di un singolo personaggio è adatto alle tue immagini e video; corpo, volto, mani, identità, sfondo, testo e movimenti rapidi vanno testati con materiali propri.
Kling V2.5 Turbo Pro offre su Kyeo video da testo e da immagine: senza immagini usa il percorso testo, con 1–2 immagini passa al percorso iniziale/finale. Entrambi consentono 5 o 10 secondi e costano rispettivamente 42 o 84 crediti.
Kling V2.1 Master è l'ingresso Kyeo per video 1080p da testo o da una singola immagine. Senza immagine usa la route testuale; con 1 JPEG/PNG usa quella per immagini. In entrambi i casi, 5 secondi costano 160 crediti e 10 secondi 320.
Kling V2.1 Pro è l'ingresso Kyeo High Quality (1080p) per video da fotogramma iniziale e finale. Richiede una prima immagine e permette di indicare la conclusione con una seconda; 5 secondi costano 50 crediti e 10 secondi 100.
Kling V2.1 Standard è l'ingresso Kyeo per video 720p da una singola immagine. Richiede un'immagine JPEG/PNG e un prompt e genera video di 5 o 10 secondi, con un costo rispettivamente di 25 o 50 crediti.
Capacità: L’interfaccia richiede esattamente 1 immagine JPEG o PNG e 1 file audio MPEG, WAV, X-WAV, AAC, MP4 o OGG. L’immagine può pesare fino a 10 MB; l’audio fino a 100 MB e 5 minuti. L’addebito usa la durata audio firmata a 16 crediti al secondo e arrotonda per eccesso. Non è possibile inviare una durata assente, non valida o superiore a 5 minuti.
Capacità: L’interfaccia richiede esattamente 1 immagine JPEG o PNG e 1 file audio MPEG, WAV, X-WAV, AAC, MP4 o OGG. L’immagine può pesare fino a 10 MB; l’audio fino a 100 MB e 5 minuti. L’addebito usa la durata audio firmata a 8 crediti al secondo e arrotonda per eccesso. Non è possibile inviare una durata assente, non valida o superiore a 5 minuti.
In Kyeo, Infinitalk genera un video parlato con una singola immagine, un audio non oltre 15 secondi e un prompt obbligatorio. Puoi scegliere 480p o 720p e compilare `seed`; il costo dipende dai secondi audio e dalla risoluzione, non è un prezzo fisso per richiesta.
Runway supporta attualmente testo-video e video da una singola immagine. La generazione di base offre 720p per 5 secondi, 720p per 10 secondi e 1080p per 5 secondi.
Runway — Runway Aleph supporta immagini di riferimento — 90 crediti fissi per richiesta. Serve per chiedere a un video esistente di aggiungere, rimuovere o sostituire elementi, cambiare illuminazione o trasferire lo stile e il contenuto della scena. Serve per chiedere a un video esistente di aggiungere, rimuovere o sostituire elementi, cambiare illuminazione o trasferire lo stile e il contenuto della scena.
Luma Modify Video riguarda la modifica del contenuto e dello stile visivo di un video esistente tramite istruzioni scritte. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Kyeo AI usa ora Grok Imagine Video 1.5 Preview? Route di piattaforma — 1–15 secondi; 480p o 720p; fino a 7 immagini di riferimento
Sora 2 Pro riguarda un riferimento storico di Sora 2 Pro per la generazione video di fascia superiore. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Sora 2 riguarda un riferimento storico di Sora 2 per generare video da testo o immagini. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Sora Watermark Remover riguarda un flusso storico per ripulire elementi visivi in un video esistente. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Topaz Video Upscaler è il flusso Kyeo attuale per elaborare un singolo video a un fattore scelto. Riceve un URL video e `1x / 2x / 4x`, con `2x` predefinito, e non accetta prompt.
Veo3.1 Quality è il percorso Veo che Kyeo usa con l'identificatore a monte Veo 3.1 Quality. La richiesta base, solo testo oppure con 1–2 immagini di primo/ultimo fotogramma, costa 225 crediti fissi; dopo il successo si possono avviare separatamente Extend, 1080p o 4K. Quality è il nome del flusso e non garantisce una qualità fissa per ogni risultato.
Veo3.1 Fast su Kyeo AI supporta testo, fotogrammi iniziale/finale e immagini di riferimento, con 720p/1080p/4K e durate di 4/6/8 secondi selezionabili. 30 / 38 / 90 crediti per risoluzione.
Veo3.1 Lite su Kyeo AI supporta testo, fotogrammi iniziale/finale e immagini di riferimento, con 720p/1080p/4K e durate di 4/6/8 secondi selezionabili. 15 / 23 / 75 crediti per risoluzione.
Kling 3.0 Turbo genera brevi video di 3–15 secondi: senza immagini utilizza il flusso da testo, mentre con una singola immagine valida passa al video da immagine. Risoluzione e durata determinano direttamente la preautorizzazione iniziale.
Seedance 2.0 Mini riunisce in un solo accesso la generazione da testo, da fotogrammi iniziale e finale e da riferimenti multimodali. Poiché i video di riferimento entrano nella formula dei costi, sia la loro durata sia quella dell'output devono essere verificate in modo affidabile prima della creazione.
Seedance 2.5 riunisce in un contratto di scena rigoroso una durata massima di 30 secondi, un numero elevato di materiali e riferimenti adatti al montaggio video. La durata automatica non viene sottostimata usando 5 secondi, ma viene preautorizzata sul massimo di 30 secondi.
MiniMax H3 offre due fasce, 768P e 2K, e supporta testo, fotogrammi iniziale e finale e riferimenti di immagini, video e audio. La durata dei video di riferimento e il numero di immagini dalla 6ª in poi entrano nella preautorizzazione iniziale.
HappyHorse 1.1 sceglie automaticamente il flusso in base al numero di immagini: nessuna per il testo, 1 per il video dal fotogramma iniziale e 2–9 per i riferimenti multipli. Le tre modalità condividono risoluzioni, durate e tariffe al secondo.
Gemini Omni Video è pensato per flussi video che iniziano da testo, un’immagine o più riferimenti. La generazione non è disponibile su questo sito, quindi la pagina illustra stato, limiti e alternative utilizzabili.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Il percorso principale di OmniHuman 1.5 usa l'immagine di una persona, di un animale o di un soggetto animato e un audio per creare un video guidato. La durata dell'audio viene verificata dalla firma di caricamento e determina direttamente la preautorizzazione iniziale.
Video Lip Sync ricrea il labiale di un video esistente usando un audio parlato di destinazione. La modalità leggera è pensata per video frontali con una sola persona; quella base gestisce scene singole più complesse e può attivare il rilevamento delle scene.
Wan 3.0 unisce i livelli Standard e Prime alla generazione da testo, fotogramma iniziale/finale e riferimenti multimodali firmati. La prenotazione moltiplica la tariffa di variante e risoluzione per la somma dei secondi verificati del video di input e dei secondi di output prenotati, poi arrotonda il totale una sola volta. La durata intelligente prenota 30 secondi di output e non è disponibile con un video di riferimento.
PixVerse V6 è pensato per brevi video da testo, una o due immagini o più riferimenti. La generazione non è disponibile, quindi la pagina presenta il contesto verificato, i limiti e le alternative utilizzabili.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Stato attuale — È disponibile la generazione verificata a inquadratura singola da testo, da un fotogramma iniziale o da una coppia iniziale/finale. Riferimento video, trasformazione, multi-inquadratura ed elementi restano chiusi perché quei rami contrattuali sono ancora ambigui.
Wan 2.6 Flash riguarda un flusso della famiglia Wan 2.6 orientato a una generazione video più rapida. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.
Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.
Flux 3 appartiene alla categoria video nell'attuale mercato modelli fonte pubblica ed è indicato come Coming Soon; la scheda pubblica soltanto Text to Video e Image to Video. Kyeo non ne ha aperto l'uso e non deduce capacità dalla famiglia Flux 2 per immagini.
Wan Animate 2 è attualmente segnato Coming Soon nel mercato fonte pubblica, con la sola etichetta Video to Video. La pagina pubblica presenta l'animazione dei personaggi, ma generazione, caricamenti, prezzo e parametri API non sono attivi qui.