Chuyển đến nội dung chính

Mô hình video AI

Xem và so sánh các mô hình tạo video AI phổ biến như Sora 2, Kling, Veo 3.1 và Hailuo · Hiện có 39 mô hình khả dụng · 10 mô hình chỉ để tham khảo

So sánh mô hình văn bản sang video và hình ảnh sang video cho clip ngắn, điều khiển máy quay, khung hình đầu-cuối và các tác vụ video khác.

Seedance 2.0 / Nhãn năng lực — text không nhận tài liệu; frames yêu cầu khung đầu và có thể thêm khung cuối; reference yêu cầu prompt cùng ít nhất một ảnh, video hoặc audio tham chiếu. Tham chiếu đa phương thức không thể gửi cùng trường khung đầu-cuối. Seedance 2.0 hỗ trợ ba ngữ cảnh loại trừ lẫn nhau: văn bản, khung hình và tham chiếu đa phương thức. Tập đầu ra hiện có thể dùng là 720p, 1080p và 4K trong 4–15 giây; yêu cầu có video tham chiếu chỉ khả dụng ở 1080p hoặc 4K vì đây là các tổ hợp có giá hiện được xác nhận. 164–3.840 credit mỗi yêu cầu

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

Seedance 2.0 Fast / Nhãn năng lực — text không nhận tài liệu; frames yêu cầu khung đầu và có thể thêm khung cuối; reference yêu cầu prompt cùng ít nhất một ảnh, video hoặc audio tham chiếu. Tham chiếu đa phương thức không thể gửi cùng trường khung đầu-cuối. 480p/720p · 4–15 · 47–450 điểm/lần.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

Seedance 1.5 Pro / Nhãn năng lực — Seedance 1.5 Pro trên Kyeo hỗ trợ đầu vào thuần văn bản hoặc tối đa 2 ảnh, cung cấp 480p/720p/1080p, 4–12 giây, tạo audio, 6 tỷ lệ và khóa máy quay. Mức 7–180 điểm do tổ hợp tham số quyết định; tên Pro và mức điểm cao hơn không có nghĩa trang này đã xác minh chất lượng, độ ổn định hay khả năng phát hành.

Văn bản sang video
Hình ảnh sang video

HappyHorse 1.0 / Nhãn năng lực — Các quy trình hiện có gồm video chỉ từ prompt, video từ một ảnh và video tham chiếu dùng từ 2 đến 9 ảnh. Chỉnh sửa một video có sẵn hiện chưa khả dụng trên trang này.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

Wan 2.7 kết hợp văn bản thành video, ảnh thành video với khung đầu hoặc đầu-cuối và chỉnh sửa video. Với 720p và 1080p, hãy so sánh tư liệu, thời lượng, tỷ lệ và số điểm ước tính.

Văn bản sang video
Hình ảnh sang video
Video sang video
70-315

Không có tệp sẽ chọn văn bản thành video, đúng một ảnh sẽ chọn ảnh thành video và một đến ba video sẽ chọn chỉnh sửa video; không thể trộn ảnh với video. Mặc định là 1080p, 5 giây, cấu trúc cảnh Tắt và bộ lọc nội dung Bật.

Văn bản sang video
Hình ảnh sang video
Video sang video

Tìm hiểu workflow text-to-video và image-to-video của Wan 2.5 Video trên Kyeo AI, 5/10 giây, 720p/1080p, khác biệt prompt và mức phí 60–200 điểm. Kyeo tính chính xác theo độ phân giải và thời lượng: 720p 5 giây là 60 điểm, 720p 10 giây là 120 điểm, 1080p 5 giây là 100 điểm, 1080p 10 giây là 200 điểm; mặc định 720p 5 giây là 60 điểm. Wan 2.5 tính 60/100/120/200 điểm thế nào — Tìm hiểu workflow text-to-video và image-to-video của Wan 2.5 Video trên Kyeo AI, 5/10 giây, 720p/1080p, khác biệt prompt và mức phí 60–200 điểm.

Văn bản sang video
Hình ảnh sang video

Wan 2.2 A14B Turbo trên Kyeo không phải một workflow duy nhất: không có tài liệu thì dùng tạo từ văn bản, tải một ảnh thì chuyển sang tạo từ ảnh, còn chỉ khi có cả một ảnh và một audio mới vào chế độ audio-driven. Ba workflow có độ phân giải, điểm và điều khiển hiển thị khác nhau, nên cần xác nhận tổ hợp tài liệu trước khi chọn.

Văn bản sang video
Hình ảnh sang video
Hình ảnh kèm giọng nói sang video

Wan 2.2 Animate Replace dùng một video nguồn và một ảnh thay thế tải lên qua workbench để thay nhân vật, với đầu ra 480p, 580p hoặc 720p. Giá dựa trên số giây video nguồn đã xác minh và người dùng không thể nhập URL tư liệu tùy ý.

Thay chủ thể trong video
Giữ chuyển động gốc

Kyeo có sáu tổ hợp hợp lệ: Standard 768P 6/10 giây và 1080P 6 giây lần lượt là 25/40/40 điểm; Pro tương ứng là 40/80/70 điểm. 1080P không hỗ trợ 10 giây. Bắt buộc 1 tệp JPG/PNG/WebP, tối đa 10 MB.

Hình ảnh sang video

Hailuo Pro / Nhãn khả năng — Trang này dựa trên tài liệu chính thức của MiniMax về Hailuo 02 và hợp đồng sản phẩm hiện được trang web xác minh. Nội dung chỉ mô tả các quy trình văn bản và hình ảnh đang mở, giới hạn có thể kiểm chứng và giá điểm. Kyeo hiện chỉ có một tổ hợp Pro: yêu cầu văn bản hoặc ảnh đều cố định ở 1080P, 6 giây, 57 điểm mỗi lần; thêm ảnh cuối không tính phí riêng.

Văn bản sang video
Hình ảnh sang video

Hailuo Standard kết hợp văn bản thành video, hoạt hóa khung hình đầu và khung hình cuối tùy chọn. Năm tổ hợp có giá từ 12 đến 50 điểm.

Văn bản sang video
Hình ảnh sang video
42-405

Tìm hiểu video Kling 3.0 trên Kyeo AI: 3–15 giây, đơn cảnh và tối đa 5 cảnh, ảnh đầu-cuối, âm thanh và mức phí mỗi giây của std/pro/4k. Phù hợp khi cần chỉ định khung đầu/cuối hoặc chia một ý tưởng 3–15 giây thành tối đa 5 cảnh ngắn. Độ nhất quán nhân vật, khẩu hình, chữ, âm thanh và nối cảnh vẫn phải nghiệm thu theo kết quả thực tế.

Văn bản sang video
Hình ảnh sang video

Kling 3.0 Motion Control cần đầu vào gì? — 1 ảnh + 1 video — Phí dùng thời lượng video đã ký: 20 điểm mỗi giây với `720p` hoặc 27 với `1080p`, nhân thời lượng đã xác minh 3–30 giây rồi làm tròn lên. Thiếu hoặc sai thời lượng sẽ bị từ chối tạo.

Tham chiếu video chuyển động
Tùy chọn nguồn nền
55-220

Kling 2.6 trên Kyeo là dịch vụ video hai workflow: không có ảnh thì gọi text-to-video, có ảnh thì gọi image-to-video một ảnh. Cả hai có 5/10 giây và công tắc `sound`; text-to-video có thêm ba tỷ lệ. Bốn tổ hợp tính phí là 55, 110, 110 và 220 điểm.

Văn bản sang video
Hình ảnh sang video

Kling 2.6 Motion Control: một ảnh và video, giới hạn hướng, 3–30 giây cùng đơn giá 11 điểm/giây ở 720p hoặc 18 ở 1080p. Có thể dùng để kiểm tra việc chuyển động một nhân vật có phù hợp với ảnh và video của bạn không; cơ thể, khuôn mặt, bàn tay, danh tính, nền, chữ và chuyển động nhanh đều cần thử bằng tư liệu riêng.

Tham chiếu video chuyển động
Làm nhân vật chuyển động

Kling V2.5 Turbo Pro trên Kyeo cung cấp đồng thời text-to-video và image-to-video: không có ảnh thì dùng route văn bản, tải 1–2 ảnh thì chuyển sang route ảnh đầu/ảnh cuối. Cả hai có thể chọn 5 hoặc 10 giây, lần lượt tốn 42 hoặc 84 điểm.

Văn bản sang video
Hình ảnh sang video

Kling V2.1 Master là lối vào text-to-video 1080p và image-to-video một ảnh hiện có trên Kyeo. Không tải ảnh thì dùng workflow văn bản, tải 1 ảnh JPEG/PNG thì dùng workflow ảnh; cả hai tạo 5 hoặc 10 giây với mức 160 hoặc 320 điểm.

Văn bản sang video
Hình ảnh sang video

Kling V2.1 Pro là cổng tạo video từ ảnh đầu-cuối High Quality (1080p) hiện có trên Kyeo. Bạn cần 1 ảnh đầu và có thể dùng thêm ảnh thứ hai để chỉ định điểm kết thúc; thời lượng 5 hoặc 10 giây lần lượt trừ 50 hoặc 100 điểm.

Hình ảnh sang video

Kling V2.1 Standard là cổng tạo video từ một ảnh 720p hiện có trên Kyeo. Bạn cần 1 ảnh JPEG/PNG và prompt, có thể tạo video 5 hoặc 10 giây; Kyeo lần lượt trừ 25 hoặc 50 điểm.

Hình ảnh sang video

Nhãn khả năng: Giao diện yêu cầu đúng 1 ảnh JPEG hoặc PNG và 1 tệp âm thanh MPEG, WAV, X-WAV, AAC, MP4 hoặc OGG. Ảnh tối đa 10 MB; âm thanh tối đa 100 MB và 5 phút. Chi phí dùng thời lượng âm thanh đã ký ở mức 16 điểm mỗi giây rồi làm tròn lên. Không thể gửi nếu thiếu thời lượng, thời lượng không hợp lệ hoặc dài hơn 5 phút.

Người ảo thuyết trình
Làm hình ảnh cất lời

Nhãn khả năng: Giao diện yêu cầu đúng 1 ảnh JPEG hoặc PNG và 1 tệp âm thanh MPEG, WAV, X-WAV, AAC, MP4 hoặc OGG. Ảnh tối đa 10 MB; âm thanh tối đa 100 MB và 5 phút. Chi phí dùng thời lượng âm thanh đã ký ở mức 8 điểm mỗi giây rồi làm tròn lên. Không thể gửi nếu thiếu thời lượng, thời lượng không hợp lệ hoặc dài hơn 5 phút.

Người ảo thuyết trình
Làm hình ảnh cất lời

Infinitalk trên Kyeo dùng 1 ảnh, 1 tệp âm thanh không quá 15 giây và prompt bắt buộc để tạo video đọc lời. Có thể chọn 480p hoặc 720p, cũng có thể điền `seed`; chi phí tính theo số giây âm thanh và độ phân giải, không phải giá cố định mỗi lần.

Người ảo thuyết trình
Làm hình ảnh cất lời
12-30

Runway hiện hỗ trợ tạo video từ văn bản và từ một ảnh. Tạo cơ bản có ba lựa chọn: 720p trong 5 giây, 720p trong 10 giây và 1080p trong 5 giây.

Văn bản sang video
Hình ảnh sang video

Runway Aleph — Runway Aleph có hỗ trợ ảnh tham chiếu không — Cố định 90 điểm / lần. Dùng để yêu cầu thêm, xóa, thay thế, đổi ánh sáng, đổi phong cách hoặc thay đổi nội dung hình ảnh của video có sẵn. Dùng để yêu cầu thêm, xóa, thay thế, đổi ánh sáng, đổi phong cách hoặc thay đổi nội dung hình ảnh của video có sẵn.

Đổi phong cách video
Giữ chuyển động gốc

Kyeo AI hiện dùng Grok Imagine Video 1.5 Preview phải không? Lựa chọn route nền tảng — 1–15 giây; 480p hoặc 720p; tối đa 7 ảnh tham chiếu

Văn bản sang video
Hình ảnh sang video

Topaz Video Upscaler là workflow xử lý hệ số cho một video hiện được Kyeo cung cấp. Workflow nhận một video URL và `1x / 2x / 4x`, mặc định `2x`, không nhận prompt.

Làm rõ video
Tăng độ phân giải

Veo3.1 Quality là route Veo hiện dùng nhận diện nguồn công khai Veo 3.1 Quality trên Kyeo. Yêu cầu cơ bản bằng văn bản hoặc 1–2 ảnh khung đầu/cuối cố định 225 điểm; sau khi thành công có thể gửi riêng Extend, 1080p hoặc 4K. Quality là tên workflow, không có nghĩa mọi kết quả đều đạt chất lượng giao cố định.

Văn bản sang video
Hình ảnh sang video

Veo3.1 Fast trên Kyeo AI hỗ trợ văn bản, khung đầu/cuối và ảnh tham chiếu, với lựa chọn trực tiếp 720p/1080p/4K cùng thời lượng 4/6/8 giây. 30 / 38 / 90 tín dụng theo độ phân giải.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

Veo3.1 Lite trên Kyeo AI hỗ trợ văn bản, khung đầu/cuối và ảnh tham chiếu, với lựa chọn trực tiếp 720p/1080p/4K cùng thời lượng 4/6/8 giây. 15 / 23 / 75 tín dụng theo độ phân giải.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

Kling 3.0 Turbo dành cho video ngắn 3–15 giây: dùng chế độ văn bản khi không tải ảnh, hoặc chuyển sang ảnh thành video sau khi tải một ảnh hợp lệ. Độ phân giải và thời lượng trực tiếp quyết định mức tạm giữ trước khi tạo.

Văn bản sang video
Hình ảnh sang video

Seedance 2.0 Mini gom tạo video bằng văn bản, khung đầu-cuối và tham chiếu đa phương thức vào một cổng. Video tham chiếu tham gia công thức phí trước khi tạo, vì vậy cả thời lượng tư liệu và thời lượng đầu ra đều phải được xác minh đáng tin cậy trước.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu
102-4110

Seedance 2.5 đưa ranh giới 30 giây, số lượng tư liệu lớn hơn và đầu vào tham chiếu kiểu chỉnh sửa video vào cùng một hợp đồng kịch bản nghiêm ngặt. Thời lượng tự động không được ước tính thấp theo mặc định 5 giây mà được tạm giữ theo mức tối đa 30 giây.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu
Video sang video

MiniMax H3 cung cấp hai mức 768P và 2K, đồng thời hỗ trợ văn bản, khung đầu-cuối cùng tham chiếu ảnh/video/audio. Thời lượng video tham chiếu và số ảnh từ ảnh thứ 6 trở đi đều tham gia mức tạm giữ trước khi tạo.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

HappyHorse 1.1 tự động phân luồng theo số ảnh: không có ảnh là chế độ văn bản, 1 ảnh là tạo video từ khung đầu, còn 2–9 ảnh là chế độ tham chiếu. Cả ba dùng chung độ phân giải, thời lượng và mức phí mỗi giây.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu

Quy trình cốt lõi của OmniHuman 1.5 dùng một ảnh chủ thể là người, thú cưng hoặc nhân vật hoạt hình cùng một audio để tạo video chuyển động. Thời lượng audio được xác minh bằng chữ ký tải lên và trực tiếp quyết định mức tạm giữ trước khi tạo.

image-audio-to-video

Video Lip Sync dùng một video có sẵn và một audio giọng nói mục tiêu để tạo lại khẩu hình. Chế độ nhẹ dành cho video một người nhìn chính diện; chế độ cơ bản dành cho cảnh một người phức tạp hơn và có thể bật phát hiện cảnh.

video-audio-to-video

Wan 3.0 kết hợp các tầng Standard và Prime với tạo video từ văn bản, khung hình đầu/cuối và tham chiếu đa phương thức đã ký. Khoản giữ chỗ bằng đơn giá theo phiên bản và độ phân giải nhân với tổng số giây video đầu vào đã xác minh và số giây đầu ra được giữ chỗ, sau đó chỉ làm tròn lên một lần. Thời lượng thông minh giữ chỗ 30 giây đầu ra và không dùng được với video tham chiếu.

Văn bản sang video
Hình ảnh sang video
Tạo từ nội dung tham chiếu
Video sang video

Trạng thái hiện tại — Đã mở tạo một cảnh có thể kiểm chứng từ văn bản, một khung hình đầu hoặc một cặp khung hình đầu và cuối. Tham chiếu video, chuyển đổi, nhiều cảnh và phần tử vẫn đóng vì các nhánh hợp đồng đó còn mơ hồ.

Văn bản sang video
Hình ảnh sang video
Hiện không khả dụng

Seedance 1.0 Pro liên quan đến quy trình Seedance Pro đời đầu để tạo video từ văn bản hoặc hình ảnh. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Văn bản sang video
Hình ảnh sang video
Hiện không khả dụng

Seedance 1.0 Pro Fast liên quan đến quy trình Seedance đời đầu tập trung tạo nhanh video từ một ảnh. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Hình ảnh sang video
Hiện không khả dụng

Seedance 1.0 Lite liên quan đến quy trình Seedance đời đầu để tạo video ngắn từ văn bản hoặc hình ảnh. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Văn bản sang video
Hình ảnh sang video
Hiện không khả dụng

Luma Modify Video liên quan đến khả năng chỉnh nội dung và phong cách hình ảnh của video có sẵn bằng chỉ dẫn văn bản. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Đổi phong cách video
Chỉnh sửa video có sẵn
Hiện không khả dụng

Sora 2 Pro liên quan đến tài liệu lịch sử về Sora 2 Pro dành cho tạo video cấp cao hơn. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Văn bản sang video
Hình ảnh sang video
Hiện không khả dụng

Sora 2 liên quan đến tài liệu lịch sử về Sora 2 để tạo video từ văn bản hoặc hình ảnh. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Văn bản sang video
Hình ảnh sang video
Hiện không khả dụng

Sora Watermark Remover liên quan đến quy trình lịch sử để làm sạch các thành phần nhìn thấy trong video có sẵn. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Xóa hình mờ
Xử lý liên kết Sora
Hiện không khả dụng

Gemini Omni Video hướng đến quy trình tạo video bắt đầu từ văn bản, một hình ảnh hoặc nhiều tư liệu tham chiếu. Website hiện chưa hỗ trợ tạo video bằng mô hình này nên trang tập trung vào trạng thái, giới hạn và lựa chọn thay thế.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Hiện không khả dụng

PixVerse V6 hướng đến video ngắn bắt đầu từ văn bản, một hoặc hai hình ảnh hay nhiều tư liệu tham chiếu. Website hiện chưa hỗ trợ tạo video nên trang tập trung vào thông tin đã xác minh, giới hạn và lựa chọn thay thế.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Hiện không khả dụng

Wan 2.6 Flash liên quan đến quy trình thuộc họ Wan 2.6 tập trung vào tốc độ tạo video nhanh hơn. Chức năng tạo hiện đóng nên không phát sinh tác vụ hay trừ điểm. Trang giữ lại bối cảnh đã xác minh và dẫn tới các lựa chọn thay thế đang hoạt động.

Thông tin mô hình đầy đủ vẫn được giữ lại, nhưng hiện không hỗ trợ tạo trực tuyến.

Sắp ra mắt

Flux 3 hiện được xếp vào danh mục video của thị trường mô hình nguồn công khai và đánh dấu Coming Soon; thẻ chỉ công khai Text to Video cùng Image to Video. Kyeo chưa mở sử dụng và không suy ra khả năng từ dòng mô hình ảnh Flux 2.

Văn bản sang video
Hình ảnh sang video
Sắp ra mắt

Wan Animate 2 hiện được đánh dấu Coming Soon trên thị trường nguồn công khai với duy nhất nhãn Video to Video. Trang công khai giới thiệu hoạt họa nhân vật, nhưng việc tạo, tải lên, giá và tham số API chưa được bật tại đây.

Video sang video