跳到主要内容
AI 视频模型
Alibaba
Wan

Wan 2.2 A14B Turbo

Wan 2.2 A14B Turbo 在 Kyeo 中不是单一工作流:无素材使用文字生成,上传一张图片改走图片生成,同时提供一张图片和一段音频才进入语音驱动。三条工作流的分辨率、点数和可见参数不同,选择前应先确认素材组合。

能力标签
文字生成、图片生成、图片加音频
积分消耗
标准 40/60/80;语音按秒
提示词上限
提示词必填,最多 5,000 字符
上传限制
最多 1 张图;语音另加 1 个音频;单个 10 MB
三条当前公开资料模型路由由无素材、单图或单图加单音频动态选择
文字、图片与语音工作流均支持 480p/580p/720p
文字/图片固定 5 秒为 40/60/80 credits;语音为 12/18/24 credits 每输出秒
语音工作流按当前合同发送默认开启的 `enable_safety_checker`
30 秒了解
Wan
标准 40/60/80;语音 12/18/24 每秒
它擅长什么
根据输入素材选择文字生成视频、图片生成视频或语音驱动视频。三种模式使用各自的输入和参数。
适合谁用
适合分别验证纯文字生成、单图动画,或以单图和单音频驱动人物的视频任务;三种路径应单独评估,不应把其中一条的表现外推到另外两条。
大家都在搜
如何使用 Wan 2.2 A14B Turbo?Wan 2.2 三条工作流分别需要什么素材?Wan 2.2 的六档路由价格如何计算?

一句话了解

这个模型怎么样?

文字与图片工作流固定输出 5 秒:480p/580p/720p 为 40/60/80 credits。语音工作流按 `num_frames ÷ frames_per_second` 得到输出秒数,再乘 12/18/24 credits;Kyeo 对总价向上取整。页面不承诺生成速度、同步精度、画质或人物一致性。

它擅长什么
根据输入素材选择文字生成视频、图片生成视频或语音驱动视频。三种模式使用各自的输入和参数。
适合谁用
适合分别验证纯文字生成、单图动画,或以单图和单音频驱动人物的视频任务;三种路径应单独评估,不应把其中一条的表现外推到另外两条。
为什么在 Kyeo AI 用
Kyeo 按素材组合自动选择三条工作流,并在提交前显示标准固定 5 秒档与语音按秒费率;每条路径仍须单独验收。

关键参数一览

帮你快速评估这个模型和你的业务场景是否匹配。

模型类别
AI 视频模型
厂商
Alibaba
模型家族
Wan
接入方式
当前站内接入
能力标签
Wan — 异步任务
运行方式
异步任务
提示词上限
Kyeo 请求:提示词不能为空,最多 5,000 字符
上传限制
JPEG/PNG/WebP;语音另需 1 个音频;单个 10 MB

它还叫什么

同一个模型在不同资料里可能有不同叫法,这里统一整理,方便搜索和比较。

Wan — Wan 2.2 是否开放 enable_safety_checker?
Wan — Wan 2.2 单独上传音频会发生什么?
Wan — Wan 2.2 与 Wan 2.6 应如何选择?

用户常见问题

从实际任务、输入条件和结果要求出发,整理选择模型时最需要确认的问题。

如何使用 Wan 2.2 A14B Turbo?
Wan 2.2 三条工作流分别需要什么素材?
Wan 2.2 的六档路由价格如何计算?
Wan 2.2 三条工作流都支持 580p 吗?
Wan 2.2 图片路由接受哪些格式?
Wan 2.2 语音路由需要图片和音频吗?
Wan 2.2 的 num_frames 为什么必须为 4 的倍数?
Wan 2.2 是否开放 enable_safety_checker?
Wan 2.2 单独上传音频会发生什么?
Wan 2.2 与 Wan 2.6 应如何选择?

选型指南

还在纠结用哪个模型?先看这几个关键决策点。

1
先按素材确定工作流

没有素材时只测试文字工作流;一张图且没有音频时测试图片工作流;语音工作流必须同时提供一张图和一段音频。

2
再核对分辨率与价格

文字和图片为固定 5 秒档,480p/580p/720p 分别预授权 40/60/80 积分;语音按输出秒计费,三档费率为 12/18/24 credits 每秒,并对总价向上取整。

3
提交前检查高级参数

语音模式的 `num_frames` 使用 40~120 之间的 4 的倍数,帧率使用 4~60。

用户常搜的对比

把常见候选放在同一任务下比较,帮助你确认输入方式、控制项和成本差异。

Wan 2.2 和 Wan 2.6 的素材工作流有何不同?
Wan 2.2 vs Wan 2.6:分辨率与点数
Wan 2.2 和 Wan 2.5 Video 的参数有何不同?
Wan 2.2 vs Wan 2.5 Video:输入与价格
Wan 2.2 语音路由和 Infinitalk 有何不同?
Wan 2.2 vs Infinitalk:图片、音频与提示词

模型横向对比表

正在纠结选哪个?这张表帮你一眼看清当前模型和替代方案的核心差异。

素材触发路由
Wan 2.2 A14B Turbo
无素材、单图、单图加单音频
Wan 2.6
无素材、单图或单个视频
Infinitalk
固定要求单图、单音频与提示词
当前点数
Wan 2.2 A14B Turbo
文字/图片 40、60、80;语音 12/18/24 每秒
Wan 2.6
70-315 点,按分辨率与时长
Wan 2.5 Video
60-200 点,按分辨率与时长
分辨率选项
Wan 2.2 A14B Turbo
三条工作流均为 480p、580p、720p
Wan 2.6
720p、1080p
Wan 2.5 Video
720p、1080p
可见控制项
Wan 2.2 A14B Turbo
文字/图片开放标准控制;语音另开放帧数、帧率、推理与安全检查
Wan 2.6
分辨率与时长 2 项
Infinitalk
分辨率与 seed 2 项
当前校验边界
Wan 2.2 A14B Turbo
音频须配图;帧数须为 4 的倍数
Wan 2.6
影片工作流不使用图片或音频
Infinitalk
图片与音频固定同时必填

实际使用体验

结合公开资料、当前站内边界和典型任务,说明模型适合与不适合的情况。

当前公开资料接口工作流名不等于 Alibaba 直连型号

Alibaba 官方 Wan 2.2 A14B 发布资料覆盖文字与图片模型;Alibaba Cloud 当前 `wan2.2-s2v` 还有独立图片检测步骤。当前公开资料接口的 A14B speech 工作流应只按当前公开资料接口表单和 Kyeo 载荷陈述。

营销语不能替代当前任务验证

720p、24 fps、快速生成、稳定动作与音画同步都不是 Kyeo 的结果保证;应以实际任务输出为准。

能力详解

文字与图片模式

文字模式可设置提示词、分辨率、画幅、提示词扩展、加速和可选随机种子;图片模式改为上传一张参考图,不再单独选择画幅,其余可见控制项保持一致。安全检查始终启用。

语音驱动模式

语音模式需要提示词、一张图片和一段音频,并提供帧数、帧率、分辨率、推理步数、引导强度和偏移量控制;负面提示词与随机种子可选,安全检查默认启用。

安全字段边界

所有模式都会启用安全检查,但自动检查不能替代人工内容安全和素材权利审查。

适合做什么

纯文字镜头测试

只用提示词比较 16:9 与 9:16、480p/580p/720p;结果需人工检查主体、动作、文字与画面连续性。

单图动态化

上传一张 JPEG、PNG 或 WebP 图片,为动作和镜头写清提示词。

图片加音频驱动

同时上传一张图片与一段受支持音频后,按帧数和帧率测试口型或动作;正式发布前必须人工核对同步、身份、声音和素材权利。

提示词技巧

先写可见动作

说明主体、场景、动作和镜头移动,避免把速度、稳定性或最终质量写成提示词中的确定结果。

图片工作流不写比例假设

图片模式不发送 aspect_ratio;先确认原图构图,再说明希望保留或改变的主体动作,输出仍需检查裁切与边缘。

语音路由分开控制画面

音频决定声音输入,提示词仍用于描述人物状态与画面动作。negative_prompt、guidance_scale 和 shift 只是请求控制项,不等于同步或质量保证。

为什么选它

同一页面可按素材切换三条明确的当前公开资料接口模型版本。
文字与图片路由提供比例、提示词扩展、seed 和 acceleration 的较小控制集合。
全部工作流默认启用安全检查,语音模式也保持开启
六档 Kyeo 工作流价格与对应分辨率可以在提交前直接核对。

使用前要知道

建议先用非关键素材分别验证所选路由、输出、扣点与退款,再处理正式素材。
三条工作流都支持 480p/580p/720p,但标准工作流按固定 5 秒档计费,语音工作流按 `num_frames ÷ frames_per_second` 的输出秒数计费。
语音模式的 `num_frames` 必须是 40~120 之间的 4 的倍数。
Turbo、24 fps、动作稳定、同步、画质、安全过滤和生成时长会受实际输入与当前公开资料状态影响,不构成 Kyeo 的结果保证。

可调参数

帮你快速评估这个模型和你的业务场景是否匹配。

分辨率
resolution
可选
参数类型: select
默认值:720p
480p
580p
720p
画面比例(仅文字路由)
aspect_ratio
可选
参数类型: select
默认值:16:9
16:9
9:16
提示词扩展(文字/图片)
enable_prompt_expansion
可选
参数类型: select
默认值:false
关闭
开启
随机种子
seed
可选
参数类型: number
范围 0-2147483647
加速级别(文字/图片)
acceleration
可选
参数类型: select
默认值:none
none
regular
视频帧数(语音)
num_frames
可选
参数类型: number
默认值:80
范围 40-120,必须为 4 的倍数
帧率(语音)
frames_per_second
可选
参数类型: number
默认值:16
范围 4-60
反向提示词(语音)
negative_prompt
可选
参数类型: text
推理步数(语音)
num_inference_steps
可选
参数类型: number
默认值:27
范围 2-40
提示词引导强度(语音)
guidance_scale
可选
参数类型: number
默认值:3.5
范围 1-10
偏移值(语音)
shift
可选
参数类型: number
默认值:5
范围 1-10
安全检查(仅语音)
enable_safety_checker
可选
参数类型: select
默认值:true
关闭
开启

积分消耗

标准 40/60/80;语音 12/18/24 每秒

文字与图片工作流固定输出 5 秒:480p/580p/720p 为 40/60/80 credits。语音工作流按 `num_frames ÷ frames_per_second` 得到输出秒数,再乘 12/18/24 credits;Kyeo 对总价向上取整。

省钱小技巧

批量出图或出视频前,建议先用同一组素材在当前模型和同类候选之间做 AB 测试,确认效果后再批量跑,避免浪费积分。

常见问题

同类模型推荐

还没决定用哪个?顺手对比一下这几个同类候选。

Wan 2.6

不附媒体时使用文字生成视频,恰好 1 张图片时使用图片生成视频,1–3 个视频时使用视频编辑;图片与视频不能混用。 默认为 1080p、5 秒、镜头结构关闭、内容过滤开启。

AI 视频模型
70–315 积分 / 次

Wan 2.5 Video

了解 Wan 2.5 Video 在 Kyeo AI 的文生与单图视频流程、5/10 秒、720p/1080p、提示词差异和 60–200 点计费。 Kyeo 按分辨率和时长精确计费:720p 5 秒 60 点、720p 10 秒 120 点、1080p 5 秒 100 点、1080p 10 秒 200 点;默认 720p 5 秒为 60 点。Wan 2.5 的 60/100/120/200 点如何计算? — 了解 Wan 2.5 Video 在 Kyeo AI 的文生与单图视频流程、5/10 秒、720p/1080p、提示词差异和 60–200 点计费。

AI 视频模型
每次 60/100/120/200 点

Infinitalk

Infinitalk 在 Kyeo 使用 1 张图片、1 个不超过 15 秒的音频文件和必填提示词生成口播视频。可选 480p 或 720p,也可填写 `seed`;费用按音频秒数与分辨率计算,不是固定单次价。

AI 视频模型
480p 3 积分 / 秒;720p 12 积分 / 秒

信息来源

页面内容结合模型资料、功能说明和 Kyeo AI 当前可用设置整理。

来源说明

了解 Wan 2.2 A14B Turbo 在 Kyeo AI 的文字、单图和语音驱动三种流程:标准 5 秒档 40/60/80 credits,语音 12/18/24 credits 每输出秒。 文字与图片工作流固定输出 5 秒:480p/580p/720p 为 40/60/80 credits。语音工作流按 `num_frames ÷ frames_per_second` 得到输出秒数,再乘 12/18/24 credits;Kyeo 对总价向上取整。

最后更新: 2026-08-27
Alibaba Cloud: Wan2.2 A14B 发布说明
官方
查看原始来源
Alibaba Cloud: wan2.2-s2v 直连说明
官方
查看原始来源