Zum Hauptinhalt springen
KI-Videomodell
Alibaba
Wan

Wan 2.6

Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden. Standard sind 1080p, 5 Sekunden, Aufnahmestruktur Aus und Inhaltsfilter Ein.

Fähigkeiten
Text / 1 Bild / 1–3 Videos
Punkteverbrauch
70–315 Punkte / Anfrage
Prompt-Limit
1–5,000 / 2–5,000
Upload-Limit
1 JPG/PNG/WebP · 1–3 MP4/MOV · 10 MB
Wan 2.6 — Drei assetgesteuerte Workflows: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.
Wan 2.6 — Gültige Dauer: Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Wan 2.6 — Sechs Kyeo-Punktestufen: 720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar.
Wan 2.6 — Sichtbare Steuerungen und Assets: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein.
In 30 Sekunden erklärt
Wan
70–315 Punkte / Anfrage
Worin ist es stark?
Wan 2.6 — Fähigkeiten: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.
Für wen eignet es sich?
Wan 2.6 — Asset- und Sicherheitsgrenzen: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein.
Häufig gesucht
Wie verwendet man Wan 2.6?Die sechs Preise von Wan 2.6Wie wählt man den Text-Workflow von Wan 2.6?

Kurz erklärt

Wie ist dieses Modell einzuordnen?

Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.

Worin ist es stark?
Wan 2.6 — Fähigkeiten: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.
Für wen eignet es sich?
Wan 2.6 — Asset- und Sicherheitsgrenzen: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein.
Warum auf Kyeo AI verwenden?
Wan 2.6 — Videodauer: Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden. Die Aufnahmestruktur ist standardmäßig Aus, der Inhaltsfilter standardmäßig Ein. Beide Optionen sind sichtbar und werden ausdrücklich übermittelt.

Wichtige Parameter

Damit kannst du schnell einschätzen, ob dieses Modell zu deinem Anwendungsszenario passt.

Modellkategorie
KI-Videomodell
Anbieter
Alibaba
Modellfamilie
Wan
Laufzeit
Asynchroner Auftrag
Prompt-Limit
Text: 1–5.000 Zeichen; Bild/Video: 2–5.000 Zeichen
Upload-Limit
1 JPG/PNG/WebP-Bild (mindestens 256×256, höchstens 10 MB) oder 1–3 MP4/MOV-Videos (höchstens 10 MB je Datei)

Andere Bezeichnungen

Dasselbe Modell kann in verschiedenen Quellen unterschiedlich heißen. Hier sind die Bezeichnungen für Suche und Vergleich zusammengeführt.

Alibaba Wan 2.6
Wan 2.6

Häufige Nutzerfragen

Diese praktischen Fragen betreffen Aufgabe, Eingabebedingungen und Ergebnisanforderungen, die du vor der Auswahl prüfen solltest.

Wie verwendet man Wan 2.6?
Die sechs Preise von Wan 2.6
Wie wählt man den Text-Workflow von Wan 2.6?
Welche Spezifikationen braucht ein Wan-2.6-Einzelbild?
Wie viele Dateien nimmt die Wan-2.6-Video-Route an?
Welche Wan-2.6-Modi unterstützen 15 Sekunden?
Wan 2.6 720p 1080p Punkte
Was passiert bei gleichzeitigen Bild- und Video-Uploads für Wan 2.6?
Wie viele Zeichen muss ein Wan-2.6-Prompt mindestens haben?
Wan 2.6 Aufnahmestruktur
Wan 2.6 Inhaltsfilter

Entscheidungshilfe

Noch unsicher bei der Modellwahl? Prüfe zunächst diese Entscheidungskriterien.

1
Route nach der einzigen Eingabe wählen

Route nach der einzigen Eingabe wählen: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.

2
Dauer nach Workflow filtern

Dauer nach Workflow filtern: Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.

3
Drei Baselines getrennt anlegen

Drei Baselines getrennt anlegen: Standard sind 1080p, 5 Sekunden, Aufnahmestruktur Aus und Inhaltsfilter Ein. Vergleiche Modelle mit demselben Prompt, denselben Medien, derselben Dauer und Auflösung und bewerte die Ergebnisse statt Marketingaussagen vorauszusetzen.

Häufig gesuchte Vergleiche

Vergleiche gängige Alternativen für dieselbe Aufgabe, um Unterschiede bei Eingaben, Steuerung und Kosten zu erkennen.

Unterschied zwischen Wan 2.6 und Kling 2.6
Wan 2.6 vs Kling 2.6: Eingaberouten und Dauer
Unterschied zwischen Wan 2.6 und Hailuo 2.3
Wan 2.6 vs Hailuo 2.3: Assets und Abrechnung
Unterschied zwischen Wan 2.6 und Seedance 1.5 Pro
Wan 2.6 vs Seedance 1.5 Pro: Steuerungen

Modellvergleich

Du bist bei der Wahl unsicher? Die Tabelle zeigt die wichtigsten Unterschiede zwischen diesem Modell und Alternativen auf einen Blick.

Kyeo-Eingabepfade
Wan 2.6
Kyeo-Eingabepfade / Wan 2.6: Text / 1 Bild / 1–3 Videos
Wan 2.7 Video
Text / Start-Endframe oder Verlängerung / getrennte Videobearbeitungsroute
Kling 2.6
Zwei Basisrouten für Text oder Bild
Drei assetgesteuerte Workflows
Wan 2.6
Drei assetgesteuerte Workflows / Wan 2.6: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.
Wan 2.7 Video
2.7-Text-, Bild- oder Videobearbeitungs-Workflow je nach Asset
Kling 2.6
Text- oder Bildroute je nach vorhandenem Bild
Gültige Dauer
Wan 2.6
Gültige Dauer / Wan 2.6: Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Wan 2.7 Video
Text/Bild 5/10/15 Sekunden; Videobearbeitung mit eigenem Kontrakt
Kling 2.6
Text und Bild jeweils 5/10 Sekunden
Sechs Kyeo-Punktestufen
Wan 2.6
Sechs Kyeo-Punktestufen / Wan 2.6: 720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar.
Wan 2.7 Video
Separate Abrechnung nach 2.7-Workflow, Auflösung und Dauer
Seedance 1.5 Pro
Abrechnung nach Auflösung, Dauer und Eingabemodus
Sichtbare Steuerungen und Assets
Wan 2.6
Sichtbare Steuerungen und Assets / Wan 2.6: Auflösung, Videodauer, Aufnahmestruktur, Inhaltsfilter
Wan 2.7 Video
Steuerungen und Asset-Slots ändern sich je nach 2.7-Workflow
Kling 2.6
Eigene Kling-Steuerungen für Dauer, Verhältnis und Ton

Erfahrungen aus der Praxis

Praktische Hinweise auf Grundlage öffentlicher Quellen, aktueller Website-Grenzen und repräsentativer Aufgaben.

Wan 2.6 — Drei assetgesteuerte Workflows

Wan 2.6 / Drei assetgesteuerte Workflows: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.

Wan 2.6 — Abrechnung nach sechs Tabellenwerten

Wan 2.6 / Abrechnung nach sechs Tabellenwerten: 720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar. Vergleiche Modelle mit demselben Prompt, denselben Medien, derselben Dauer und Auflösung und bewerte die Ergebnisse statt Marketingaussagen vorauszusetzen.

Funktionen im Detail

Drei assetgesteuerte Workflows

Drei assetgesteuerte Workflows: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.

Abrechnung nach sechs Tabellenwerten

Abrechnung nach sechs Tabellenwerten: 720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar.

Asset- und Sicherheitsgrenzen

Asset- und Sicherheitsgrenzen: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein. Die Aufnahmestruktur ist standardmäßig Aus, der Inhaltsfilter standardmäßig Ein. Beide Optionen sind sichtbar und werden ausdrücklich übermittelt.

Geeignete Aufgaben

Reine Text-Baseline

Reine Text-Baseline: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden. Standard sind 1080p, 5 Sekunden, Aufnahmestruktur Aus und Inhaltsfilter Ein.

Animationstest mit einem Bild

Animationstest mit einem Bild: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein. Standard sind 1080p, 5 Sekunden, Aufnahmestruktur Aus und Inhaltsfilter Ein.

1–3 MP4/MOV — Videodauer

1–3 MP4/MOV — Videodauer: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein. Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.

Prompt-Tipps

Zuerst den einzigen Asset-Pfad festlegen

Zuerst den einzigen Asset-Pfad festlegen: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.

Pro Test nur einen Ausgabeparameter ändern

Pro Test nur einen Ausgabeparameter ändern: 720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar.

Aufnahmestruktur / Inhaltsfilter

Aufnahmestruktur / Inhaltsfilter: Die Aufnahmestruktur ist standardmäßig Aus, der Inhaltsfilter standardmäßig Ein. Beide Optionen sind sichtbar und werden ausdrücklich übermittelt. Das Modell erzeugt keine Audiospur. Prüfe jedes Ergebnis auf Sicherheit, Rechte, Identität und Veröffentlichungsqualität.

Warum dieses Modell?

Fähigkeiten: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.
Punkteverbrauch: 720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar.
Upload-Limit: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein.
Videodauer: Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.

Vor der Nutzung beachten

Wan 2.6 — Dauer nach Workflow filtern: Text- und Bildeingaben unterstützen 5, 10 oder 15 Sekunden; Videoeingaben unterstützen nur 5 oder 10 Sekunden.
Wan 2.6 — Upload-Limit: Zulässig sind genau ein JPG/PNG/WebP-Bild mit mindestens 256×256 und höchstens 10 MB oder ein bis drei MP4/MOV-Videos mit höchstens 10 MB je Datei. Vor dem Start müssen Typ, Größe, Geometrie und signierte Metadaten jeder Datei geprüft sein.
Wan 2.6 — Route nach der einzigen Eingabe wählen: Ohne Medien wird Text-zu-Video gewählt, genau ein Bild wählt Bild-zu-Video und ein bis drei Videos wählen Videobearbeitung; Bilder und Videos dürfen nicht gemischt werden.
Wan 2.6 — Aufnahmestruktur / Inhaltsfilter: Die Aufnahmestruktur ist standardmäßig Aus, der Inhaltsfilter standardmäßig Ein. Beide Optionen sind sichtbar und werden ausdrücklich übermittelt. Das Modell erzeugt keine Audiospur. Prüfe jedes Ergebnis auf Sicherheit, Rechte, Identität und Veröffentlichungsqualität.

Einstellbare Parameter

Damit kannst du schnell einschätzen, ob dieses Modell zu deinem Anwendungsszenario passt.

Auflösung
resolution
Optional
Parametertyp: select
Standard: 1080p
720p
1080p
Videodauer
duration
Optional
Parametertyp: select
Standard: 5
5 Sekunden
10 Sekunden
15 Sekunden (nur Text/Bild)
Aufnahmestruktur
multi-shots
Optional
Parametertyp: Auswahl
Standard: false
Einzelaufnahme (false)
Mehrfachaufnahme (true)
Inhaltsfilter
content-check
Optional
Parametertyp: Auswahl
Standard: Ein
Aus
Ein

Punkteverbrauch

70–315 Punkte / Anfrage

720p kostet für 5/10/15 Sekunden 70/140/210 Punkte, 1080p kostet 105/210/315 Punkte. Bei einer Videoeingabe sind 15 Sekunden nicht verfügbar.

Tipp zum Punktesparen

Bevor du Bilder oder Videos in Serie generierst, solltest du dieselben Ausgangsmedien in einem A/B-Test mit dem aktuellen Modell und ähnlichen Alternativen vergleichen. Starte die Serie erst, wenn das Ergebnis passt, um keine Punkte zu verschwenden.

Häufig gestellte Fragen

Ähnliche Modelle

Noch unentschieden? Vergleiche auch diese ähnlichen Modelle.

Kling 2.6

Kling 2.6 ist in Kyeo ein Videodienst mit zwei Workflows: Ohne Bild wird Text-zu-Video, mit Bild Einzelbild-zu-Video aufgerufen. Beide bieten 5/10 Sekunden und den `sound`-Umschalter; Text-zu-Video bietet zusätzlich drei Seitenverhältnisse. Die vier Abrechnungskombinationen sind 55, 110, 110 und 220 Punkte.

KI-Videomodell
55–220 Punkte pro Anfrage

Hailuo 2.3

Kyeo bietet sechs gültige Kombinationen: Standard 768P mit 6/10 Sekunden und 1080P mit 6 Sekunden kostet 25/40/40 Punkte; Pro kostet entsprechend 40/80/70 Punkte. 1080P unterstützt keine 10 Sekunden. 1 JPG/PNG/WebP-Datei erforderlich, höchstens 10 MB.

KI-Videomodell
25–80 Punkte pro Anfrage

Seedance 1.5 Pro

Seedance 1.5 Pro / Funktion — Kyeos Seedance 1.5 Pro unterstützt reinen Text oder bis zu 2 Bilder und bietet 480p/720p/1080p, 4–12 Sekunden, Audiogenerierung, 6 Seitenverhältnisse und gesperrte Kamera. 7–180 Punkte ergeben sich aus der Parameterkombination; der Name Pro und höhere Punkte belegen weder geprüfte Bildqualität noch Stabilität oder Veröffentlichungsfähigkeit.

KI-Videomodell
7–180 Punkte / Anfrage

Quellen

Die Seite beruht auf Modellinformationen, Funktionsbeschreibungen und den derzeit auf Kyeo AI verfügbaren Einstellungen.

Hinweis zu den Quellen

Diese Seite wurde anhand der offiziellen Alibaba-Cloud-Ankündigung zur Wan-2.6-Serie und der offiziellen Übersicht zu Videomodellen geprüft. Die öffentlichen Angaben unterscheiden Text-, Bild- und Videoeingaben, nutzbare Dauern, lokale Punkte, geprüfte Mediengrenzen und sichtbare Steuerelemente; Marketingaussagen gelten nicht als Testergebnisse.

Zuletzt geprüft: 2026-08-27
Alibaba Cloud: Start der Wan-2.6-Serie
Offiziell
Originalquelle ansehen
Alibaba Cloud: Überblick über Videogenerierungsmodelle
Offiziell
Originalquelle ansehen