AI 生成视频画面
这一篇走一遍「从文字提示词到成片画面」的完整流程,以文生视频为主,并对比图生视频的用法。
工具怎么选
| 工具 | 特点 | 适合 |
|---|---|---|
| 可灵 Kling | 中文理解好、动作可控、有口型 | 国内用户首选 |
| 即梦 | 图生视频顺手、和剪映打通 | 中文短剧 |
| Runway Gen-3 | 画质顶尖、电影感强 | 追求画质 |
| Pika | 上手快、特效元素多 | 快速试片 |
| 海螺 | 免费额度多、表情自然 | 新手试水 |
TIP
不要纠结「哪个最好」。先选一个免费额度多的工具,跑通流程最重要。多工具混用是常态。
文生视频实操步骤
第 1 步:输入提示词
直接把上一篇的提示词贴进去,选好比例(竖屏 9:16)和时长(5~10s)。
第 2 步:多抽几版
同一个提示词一次生成 3~4 条,挑动作和画面最顺的一条。这是废片率最高的环节,耐心一点。
第 3 步:修废片
- 人物变形/手部扭曲 → 加负面提示词,或降低运动幅度。
- 画面模糊 → 提高清晰度关键词,或换高分辨率模式。
- 动作不合理 → 把提示词里「动作」部分写得更具体。
图生视频:控制力更强
文生视频最大的问题是不可控。图生视频可以先用 AI 画一张分镜图,再把图变成动态镜头,人物长相和构图都能锁死。
text
流程:AI 画分镜图(即梦/任意文生图) → 图生视频(可灵/即梦) → 动态片段图生视频提示词只描述「动」的部分:
text
人物缓缓转头,镜头缓慢拉近,雨越下越大WARNING
图生视频时不要重复描述画面里已有的内容(人物长相、场景),只写动作和镜头运动,否则会「画蛇添足」改变原图。
生成素材的组织习惯
建议为每一集短剧建立这样的素材目录:
text
ep01/
├─ script.md 剧本
├─ frames/ 分镜图
├─ shots/ 生成的视频片段
├─ audio/ 配音与音效
└─ rough-cut/ 粗剪版本下一步
当画面片段都齐了,就可以进入配音环节。