Vai al contenuto principale

Modelli IA per video

Consulta e confronta modelli video come Sora 2, Kling, Veo 3.1 e Hailuo · 39 modelli attualmente disponibili · 10 modelli disponibili solo a scopo informativo

Confronta modelli da testo a video e da immagine a video per clip, controllo camera, fotogrammi iniziale e finale e altre attività video.

Seedance 2.0 / Capacità — text non accetta materiali; frames richiede il primo fotogramma e consente l'ultimo; reference richiede un prompt e almeno un riferimento tra immagine, video o audio. I riferimenti multimodali non possono essere inviati insieme ai campi del primo e dell'ultimo fotogramma. Seedance 2.0 supporta tre scene mutuamente esclusive: testo, fotogrammi e riferimento multimodale. Le uscite attualmente disponibili sono 720p, 1080p e 4K per 4–15 secondi; le richieste con video di riferimento sono disponibili solo a 1080p o 4K, le combinazioni con prezzo attualmente verificato. 164–3.840 crediti per richiesta

Da testo a video
Da immagine a video
Da riferimento a video

Seedance 2.0 Fast / Capacità — text non accetta materiali; frames richiede il primo fotogramma e consente l'ultimo; reference richiede un prompt e almeno un riferimento tra immagine, video o audio. I riferimenti multimodali non possono essere inviati insieme ai campi del primo e dell'ultimo fotogramma. 480p/720p · 4–15 · 47–450 crediti / richiesta.

Da testo a video
Da immagine a video
Da riferimento a video

Seedance 1.5 Pro / Capacità — Seedance 1.5 Pro su Kyeo supporta testo puro o fino a 2 immagini, con 480p/720p/1080p, 4–12 secondi, generazione audio, 6 rapporti e camera bloccata. I 7–180 crediti dipendono dalla combinazione di parametri; il nome Pro e il costo maggiore non dimostrano qualità, stabilità o idoneità alla pubblicazione verificate in questa pagina.

Da testo a video
Da immagine a video
Non disponibile

Seedance 1.0 Pro riguarda un precedente flusso Seedance Pro per creare video da testo o immagini. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Da testo a video
Da immagine a video
Non disponibile

Seedance 1.0 Pro Fast riguarda un precedente flusso Seedance incentrato sulla creazione rapida di video da un’immagine. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Da immagine a video
Non disponibile

Seedance 1.0 Lite riguarda un precedente flusso Seedance per creare brevi video da testo o immagini. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Da testo a video
Da immagine a video

HappyHorse 1.0 / Capacità — I flussi attualmente disponibili comprendono video dal solo prompt, video da una sola immagine e video di riferimento con 2–9 immagini. La modifica di un video esistente non è attualmente disponibile in questa pagina.

Da testo a video
Da immagine a video
Da riferimento a video

Wan 2.7 riunisce testo-video, immagine-video con fotogramma iniziale o iniziale e finale e modifica video. Con 720p e 1080p, confronta insieme materiali, durata, formato e crediti stimati.

Da testo a video
Da immagine a video
Da video a video
70-315

Senza media viene selezionato testo-video, esattamente un’immagine seleziona immagine-video e da uno a tre video selezionano il montaggio video; immagini e video non possono essere combinati. Il valore predefinito è 1080p, 5 secondi, struttura delle scene Disattiva e filtro contenuti Attivo.

Da testo a video
Da immagine a video
Da video a video

Wan 2.5 Video su Kyeo: flussi testo e singola immagine, 5/10 secondi, 720p/1080p, limiti dei prompt e prezzi da 60 a 200 crediti. Kyeo addebita con precisione per risoluzione e durata: 720p 5 secondi 60 crediti, 720p 10 secondi 120, 1080p 5 secondi 100, 1080p 10 secondi 200; la richiesta predefinita a 720p e 5 secondi costa 60 crediti. Come si calcolano i 60/100/120/200 crediti di Wan 2.5? — Wan 2.5 Video su Kyeo: flussi testo e singola immagine, 5/10 secondi, 720p/1080p, limiti dei prompt e prezzi da 60 a 200 crediti.

Da testo a video
Da immagine a video

Wan 2.2 A14B Turbo su Kyeo non è un flusso unico: senza materiali usa la generazione da testo, con una immagine passa a immagine-video e solo con una immagine più un audio entra nel percorso guidato dalla voce. I tre flussi hanno risoluzioni, crediti e controlli visibili diversi: verifica prima la combinazione dei materiali.

Da testo a video
Da immagine a video
Video parlato da immagine

Wan 2.2 Animate Replace sostituisce un personaggio usando un video sorgente e un'immagine caricati dal workbench, con output 480p, 580p o 720p. Il prezzo usa i secondi verificati del video sorgente e non consente URL multimediali arbitrari.

Sostituisci soggetto del video
Mantieni movimento originale

Kyeo ha sei combinazioni valide: per Standard 768P 6/10 secondi e 1080P 6 secondi costano 25/40/40 crediti; Pro costa rispettivamente 40/80/70. 1080P non supporta 10 secondi. Obbligatorio 1 JPG/PNG/WebP, massimo 10 MB.

Da immagine a video

Hailuo Pro / Capacità — Questa pagina si basa sui materiali ufficiali MiniMax dedicati a Hailuo 02 e sul contratto di prodotto attualmente verificato dal sito. Descrive solo i flussi testo e immagine disponibili, i limiti verificabili e i prezzi in crediti. Kyeo ha una sola combinazione Pro: richieste testo o immagine fisse a 1080P e 6 secondi, 57 crediti per generazione; aggiungere il fotogramma finale non costa extra.

Da testo a video
Da immagine a video

Hailuo Standard unisce testo-video, animazione dal fotogramma iniziale e fotogramma finale opzionale. Cinque combinazioni costano da 12 a 50 crediti.

Da testo a video
Da immagine a video
42-405

Kling 3.0 su Kyeo: 3–15 secondi, singola o multi-scena, fotogrammi iniziale-finale, audio e tariffe std/pro/4k al secondo. È adatto a definire fotogrammi iniziale/finale o a dividere un'idea di 3–15 secondi in fino a 5 scene brevi. Coerenza del personaggio, labiale, testo, audio e raccordi vanno comunque verificati sui risultati reali.

Da testo a video
Da immagine a video

Quali input richiede Kling 3.0 Motion Control? — 1 immagine + 1 video — La fatturazione usa la durata firmata del video: 20 crediti al secondo in `720p` o 27 in `1080p`, moltiplicati per i 3–30 secondi verificati e arrotondati per eccesso. Durata assente o non valida blocca la generazione.

Usa video di movimento
Scegli origine dello sfondo
55-220

Kling 2.6 su Kyeo è un servizio video a due flussi: senza immagini usa il video da testo, con immagini il video da una singola immagine. Entrambi offrono 5/10 secondi e il selettore `sound`; il testo aggiunge tre proporzioni. Le quattro combinazioni costano 55, 110, 110 e 220 crediti.

Da testo a video
Da immagine a video

Kling 2.6 Motion Control: un’immagine e un video, limiti di orientamento, 3–30 secondi e 11 crediti/secondo in 720p o 18 in 1080p. Può servire a verificare se il trasferimento del movimento di un singolo personaggio è adatto alle tue immagini e video; corpo, volto, mani, identità, sfondo, testo e movimenti rapidi vanno testati con materiali propri.

Usa video di movimento
Anima il personaggio

Kling V2.5 Turbo Pro offre su Kyeo video da testo e da immagine: senza immagini usa il percorso testo, con 1–2 immagini passa al percorso iniziale/finale. Entrambi consentono 5 o 10 secondi e costano rispettivamente 42 o 84 crediti.

Da testo a video
Da immagine a video

Kling V2.1 Master è l'ingresso Kyeo per video 1080p da testo o da una singola immagine. Senza immagine usa la route testuale; con 1 JPEG/PNG usa quella per immagini. In entrambi i casi, 5 secondi costano 160 crediti e 10 secondi 320.

Da testo a video
Da immagine a video

Kling V2.1 Pro è l'ingresso Kyeo High Quality (1080p) per video da fotogramma iniziale e finale. Richiede una prima immagine e permette di indicare la conclusione con una seconda; 5 secondi costano 50 crediti e 10 secondi 100.

Da immagine a video

Kling V2.1 Standard è l'ingresso Kyeo per video 720p da una singola immagine. Richiede un'immagine JPEG/PNG e un prompt e genera video di 5 o 10 secondi, con un costo rispettivamente di 25 o 50 crediti.

Da immagine a video

Capacità: L’interfaccia richiede esattamente 1 immagine JPEG o PNG e 1 file audio MPEG, WAV, X-WAV, AAC, MP4 o OGG. L’immagine può pesare fino a 10 MB; l’audio fino a 100 MB e 5 minuti. L’addebito usa la durata audio firmata a 16 crediti al secondo e arrotonda per eccesso. Non è possibile inviare una durata assente, non valida o superiore a 5 minuti.

Presentatore virtuale
Fai parlare un'immagine

Capacità: L’interfaccia richiede esattamente 1 immagine JPEG o PNG e 1 file audio MPEG, WAV, X-WAV, AAC, MP4 o OGG. L’immagine può pesare fino a 10 MB; l’audio fino a 100 MB e 5 minuti. L’addebito usa la durata audio firmata a 8 crediti al secondo e arrotonda per eccesso. Non è possibile inviare una durata assente, non valida o superiore a 5 minuti.

Presentatore virtuale
Fai parlare un'immagine

In Kyeo, Infinitalk genera un video parlato con una singola immagine, un audio non oltre 15 secondi e un prompt obbligatorio. Puoi scegliere 480p o 720p e compilare `seed`; il costo dipende dai secondi audio e dalla risoluzione, non è un prezzo fisso per richiesta.

Presentatore virtuale
Fai parlare un'immagine
12-30

Runway supporta attualmente testo-video e video da una singola immagine. La generazione di base offre 720p per 5 secondi, 720p per 10 secondi e 1080p per 5 secondi.

Da testo a video
Da immagine a video

Runway — Runway Aleph supporta immagini di riferimento — 90 crediti fissi per richiesta. Serve per chiedere a un video esistente di aggiungere, rimuovere o sostituire elementi, cambiare illuminazione o trasferire lo stile e il contenuto della scena. Serve per chiedere a un video esistente di aggiungere, rimuovere o sostituire elementi, cambiare illuminazione o trasferire lo stile e il contenuto della scena.

Cambia stile del video
Mantieni movimento originale
Non disponibile

Luma Modify Video riguarda la modifica del contenuto e dello stile visivo di un video esistente tramite istruzioni scritte. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Cambia stile del video
Modifica video esistente

Kyeo AI usa ora Grok Imagine Video 1.5 Preview? Route di piattaforma — 1–15 secondi; 480p o 720p; fino a 7 immagini di riferimento

Da testo a video
Da immagine a video
Non disponibile

Sora 2 Pro riguarda un riferimento storico di Sora 2 Pro per la generazione video di fascia superiore. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Da testo a video
Da immagine a video
Non disponibile

Sora 2 riguarda un riferimento storico di Sora 2 per generare video da testo o immagini. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Da testo a video
Da immagine a video
Non disponibile

Sora Watermark Remover riguarda un flusso storico per ripulire elementi visivi in un video esistente. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Rimuovi filigrana
Elabora link Sora

Topaz Video Upscaler è il flusso Kyeo attuale per elaborare un singolo video a un fattore scelto. Riceve un URL video e `1x / 2x / 4x`, con `2x` predefinito, e non accetta prompt.

Aumenta nitidezza video
Aumenta risoluzione

Veo3.1 Quality è il percorso Veo che Kyeo usa con l'identificatore a monte Veo 3.1 Quality. La richiesta base, solo testo oppure con 1–2 immagini di primo/ultimo fotogramma, costa 225 crediti fissi; dopo il successo si possono avviare separatamente Extend, 1080p o 4K. Quality è il nome del flusso e non garantisce una qualità fissa per ogni risultato.

Da testo a video
Da immagine a video

Veo3.1 Fast su Kyeo AI supporta testo, fotogrammi iniziale/finale e immagini di riferimento, con 720p/1080p/4K e durate di 4/6/8 secondi selezionabili. 30 / 38 / 90 crediti per risoluzione.

Da testo a video
Da immagine a video
Da riferimento a video

Veo3.1 Lite su Kyeo AI supporta testo, fotogrammi iniziale/finale e immagini di riferimento, con 720p/1080p/4K e durate di 4/6/8 secondi selezionabili. 15 / 23 / 75 crediti per risoluzione.

Da testo a video
Da immagine a video
Da riferimento a video

Kling 3.0 Turbo genera brevi video di 3–15 secondi: senza immagini utilizza il flusso da testo, mentre con una singola immagine valida passa al video da immagine. Risoluzione e durata determinano direttamente la preautorizzazione iniziale.

Da testo a video
Da immagine a video

Seedance 2.0 Mini riunisce in un solo accesso la generazione da testo, da fotogrammi iniziale e finale e da riferimenti multimodali. Poiché i video di riferimento entrano nella formula dei costi, sia la loro durata sia quella dell'output devono essere verificate in modo affidabile prima della creazione.

Da testo a video
Da immagine a video
Da riferimento a video
102-4110

Seedance 2.5 riunisce in un contratto di scena rigoroso una durata massima di 30 secondi, un numero elevato di materiali e riferimenti adatti al montaggio video. La durata automatica non viene sottostimata usando 5 secondi, ma viene preautorizzata sul massimo di 30 secondi.

Da testo a video
Da immagine a video
Da riferimento a video
Da video a video

MiniMax H3 offre due fasce, 768P e 2K, e supporta testo, fotogrammi iniziale e finale e riferimenti di immagini, video e audio. La durata dei video di riferimento e il numero di immagini dalla 6ª in poi entrano nella preautorizzazione iniziale.

Da testo a video
Da immagine a video
Da riferimento a video

HappyHorse 1.1 sceglie automaticamente il flusso in base al numero di immagini: nessuna per il testo, 1 per il video dal fotogramma iniziale e 2–9 per i riferimenti multipli. Le tre modalità condividono risoluzioni, durate e tariffe al secondo.

Da testo a video
Da immagine a video
Da riferimento a video
Non disponibile

Gemini Omni Video è pensato per flussi video che iniziano da testo, un’immagine o più riferimenti. La generazione non è disponibile su questo sito, quindi la pagina illustra stato, limiti e alternative utilizzabili.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Il percorso principale di OmniHuman 1.5 usa l'immagine di una persona, di un animale o di un soggetto animato e un audio per creare un video guidato. La durata dell'audio viene verificata dalla firma di caricamento e determina direttamente la preautorizzazione iniziale.

image-audio-to-video

Video Lip Sync ricrea il labiale di un video esistente usando un audio parlato di destinazione. La modalità leggera è pensata per video frontali con una sola persona; quella base gestisce scene singole più complesse e può attivare il rilevamento delle scene.

video-audio-to-video

Wan 3.0 unisce i livelli Standard e Prime alla generazione da testo, fotogramma iniziale/finale e riferimenti multimodali firmati. La prenotazione moltiplica la tariffa di variante e risoluzione per la somma dei secondi verificati del video di input e dei secondi di output prenotati, poi arrotonda il totale una sola volta. La durata intelligente prenota 30 secondi di output e non è disponibile con un video di riferimento.

Da testo a video
Da immagine a video
Da riferimento a video
Da video a video
Non disponibile

PixVerse V6 è pensato per brevi video da testo, una o due immagini o più riferimenti. La generazione non è disponibile, quindi la pagina presenta il contesto verificato, i limiti e le alternative utilizzabili.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

Stato attuale — È disponibile la generazione verificata a inquadratura singola da testo, da un fotogramma iniziale o da una coppia iniziale/finale. Riferimento video, trasformazione, multi-inquadratura ed elementi restano chiusi perché quei rami contrattuali sono ancora ambigui.

Da testo a video
Da immagine a video
Non disponibile

Wan 2.6 Flash riguarda un flusso della famiglia Wan 2.6 orientato a una generazione video più rapida. La generazione è chiusa, quindi non vengono creati attività o addebiti di crediti. La pagina conserva il contesto verificato e propone alternative attive.

Le informazioni complete sul modello sono conservate, ma al momento non è possibile generare online.

In arrivo

Flux 3 appartiene alla categoria video nell'attuale mercato modelli fonte pubblica ed è indicato come Coming Soon; la scheda pubblica soltanto Text to Video e Image to Video. Kyeo non ne ha aperto l'uso e non deduce capacità dalla famiglia Flux 2 per immagini.

Da testo a video
Da immagine a video
In arrivo

Wan Animate 2 è attualmente segnato Coming Soon nel mercato fonte pubblica, con la sola etichetta Video to Video. La pagina pubblica presenta l'animazione dei personaggi, ma generazione, caricamenti, prezzo e parametri API non sono attivi qui.

Da video a video