跳到主要内容
AI 视频工作流

从一张图到一段视频:选模型、写动作和单变量测试

图生视频的差别往往不在“哪个模型最强”,而在素材、动作、镜头、时长和试错方式是否匹配。这里是一套可在 Kyeo AI 直接执行、能够复盘的选型与测试方法。

Kyeo AI 编辑团队更新于 2026年8月10日9 分钟阅读
Kyeo AI 模型广场的视频模型列表

把静态图片交给视频模型,只写一句“让它动起来”,通常能得到一个会动的结果,却不一定得到能用的镜头。人物可能在漂,产品轮廓会变,镜头也可能擅自推进。问题不一定出在模型,而是我们还没有把“什么不能变、什么必须动”说清楚。

更稳妥的做法是先把任务压缩成一个镜头:一个主体、一种主要动作、一个镜头意图。先用短时长和可接受的成本验证方向,再决定是否追求更高分辨率、更长时长或更复杂的运动。这个做法不炫技,但能少浪费很多次生成。

1. 先决定你要的是“动态海报”还是“连续镜头”

动态海报通常只需要呼吸、头发摆动、光影流动或轻微镜头推进,身份和构图稳定比动作幅度更重要。连续镜头则要交代动作的起点、过程和收束,例如人物从桌边起身、转向窗外,最后停在侧脸。两类任务对运动幅度和时间连贯性的要求完全不同。

如果素材只有一个清晰姿态,却要求人物完成多段复杂动作,模型就需要补出大量看不见的信息,服装、手部和背景更容易发生变化。与其把一整段分镜塞进一次生成,不如先拆成可以独立验收的短镜头。

2. 检查参考图有没有给运动留下余地

常见失败并不是清晰度不够,而是主体贴边、手脚被裁掉、背景线条穿过身体,或者画面里有必须保持准确的小字。视频模型需要在相邻帧之间推断新的位置;原图没有的信息越多,它自由补全的范围就越大。

  • 人物镜头:确认脸、手和主要服装细节清楚,动作方向一侧留有空间。
  • 产品镜头:轮廓与商标区域要干净,反光和阴影不要互相打架。
  • 带文字画面:尽量让文字保持静止;重要字幕更适合在后期叠加。
  • 竖屏内容:从一开始就按 9:16 构图,不要指望最后裁切能救回主体。
Kyeo AI 工作台中的模型与生成参数区域
Kyeo AI 工作台会根据所选模型与模式展示对应输入、上传项和参数。截图为公开页面,不包含用户数据。

3. 把提示词写成一份短镜头说明

一条实用的图生视频提示词,可以按“主体动作 + 环境变化 + 镜头运动 + 稳定约束”的顺序来写。比如:人物缓慢抬头看向窗外,窗帘被微风轻轻吹动,镜头保持中景并缓慢向前,面部、服装和房间布局保持一致。

不要同时要求旋转、奔跑、变装、爆炸和大幅运镜。动作越多,模型越难判断优先级。负面词也不是越长越好;先把正向动作说明写清楚,再补最关键的稳定要求。

4. 按当前任务筛模型,不按热度排队

进入模型广场的视频分类,先看模型当前是否可用,再查看它支持的生成模式、素材要求、参数边界、积分消耗和限制。有的模型适合从首帧做自然运动,有的更强调镜头控制或多参考输入;这些差异比榜单上的“综合最好”更有用。

Kyeo AI 的模型详情页把当前站内接入范围与公开资料分开说明。看到模型厂商的完整能力时,不要自动假定当前工作台已经开放了同样的参数;最终以页面当前状态和实际表单为准。

5. 第一次测试先控制时长、分辨率和积分

长视频和高分辨率并不会自动修复错误,反而会让一次方向错误变得更贵。第一次生成的目标只是验证三件事:主体是否稳定、主要动作是否正确、镜头是否朝预期方向运动。

选择模型和参数后,工作台会显示当前预计积分。不同模型的计费维度并不相同,可能与时长、分辨率、模式或其它参数有关,所以不要把一个模型的价格经验套到另一个模型上。提交前读一遍当前页面显示的成本。

6. 每轮只改一个变量

如果第一轮同时换模型、重写提示词、改变时长又更换原图,第二轮即使更好,也无法知道哪个变化真正有效。更可靠的方式是固定参考图和大部分提示词,只改一个因素,例如把“快速推进”改成“缓慢推进”,或只切换一个候选模型。

把结果按“身份稳定、动作完成度、镜头可控性、背景一致性、可剪辑性”五项做简短记录。两三轮之后,你会得到一套适合自己素材的判断,而不是继续依赖别人给出的通用排名。

  • 记录轮次、生成时间、模型与模式,方便回到作品记录核对。
  • 写清固定项:参考图、提示词主体、画幅和主要参数。
  • 只列一个变量:模型、时长、镜头速度或某一句动作说明。
  • 记下预计积分、任务状态,以及五项观察中最明显的变化。
  • 最后只写一个下一步,不在下一轮同时修改多个方向。

7. 失败时先判断是哪一层出了问题

脸和产品变形,多半先检查参考图与动作幅度;动作方向错误,先收紧提示词;镜头忽快忽慢,减少同时发生的事件;结果符合描述但不适合剪辑,则回到镜头用途重新定义起止状态。

生成式视频有不确定性,没有一种设置可以保证每次复现同一结果。真正可复用的不是某句“神奇提示词”,而是一套知道如何缩小问题、控制试验并保留可用镜头的流程。

常见问题

图生视频一定比文生视频更稳定吗?

不一定。参考图给了主体和构图起点,通常更容易控制视觉方向,但复杂动作仍需要模型补全大量信息。参考图质量、动作幅度和镜头要求同样重要。

提示词应该写得越长越好吗?

不是。优先说明一个主要动作、一个镜头意图和必要的稳定约束。只有当新增细节能消除歧义时才值得加入。

怎么判断应该换模型,还是继续改提示词?

先确认当前模型的模式和输入边界确实匹配任务。若动作方向经简化后仍反复错误,或模型不支持所需控制,再固定素材与提示词切换候选模型做对照。

先从一个可验收的短镜头开始

打开模型广场查看当前可用的视频模型和真实参数边界,或先阅读第一次创作指南,再回到工作台测试。