AI短剧第五步:关键帧已经锁定, 现在开始把22个镜头 真正变成视频素材
到第5步,我们终于正式进入视频生成。 但这里仍然不是把22张关键帧全部扔进工具里让AI自由发挥。 每个镜头都要按照上一阶段锁定的起始状态、结束状态、动作方向和镜头任务单独处理。 简单镜头使用单关键帧生成, 状态变化明显的镜头使用首尾帧控制, 高难动作继续拆解,必要时再使用备用模型尝试。
← 还没完成第4步?先完成关键帧与画面一致性做完这一篇,你应该得到一套可以直接进入剪辑的视频素材
这里追求的不是每个镜头都一次生成完美, 而是得到稳定、可用、能够通过剪辑组成完整88秒短剧的视频片段。
视频阶段不再重新设计画面
这一阶段真正的输入不是故事,也不是剧本, 而是上一阶段已经通过验收的关键帧和镜头任务书。
操作 1:建立“05_视频素材”文件夹
操作 2:继续沿用镜头编号
从现在开始,不要用“视频1”“最终视频2”“最后最终版”这样的名字。 所有文件必须继续对应S01—S22。
S02_V01.mp4 → S02_V02.mp4 → S02_LOCK.mp4
操作 3:先确认当前镜头属于哪一种生成方式
单关键帧图生视频
适合氛围、人物反应和简单动作。
首尾帧控制
适合明确状态变化,需要控制动作终点。
分段生成 + 剪辑
适合三箭、影子异变、动物抢匣等复杂动作。
视频提示词不是重新描述画面,而是告诉AI“怎么动”
关键帧已经决定了谁、在哪里、长什么样。 视频提示词重点只剩下动作、速度、幅度和镜头运动。
少描述身份
不重新写人物长相、服装和环境, 这些已经存在于参考图。
多描述动作
明确谁动、怎么动、速度多快、最后停在哪里。
控制镜头运动
没有必要就保持固定机位, 不要让模型自动增加复杂运镜。
动作越难越要短
高难动作不要追求长镜头, 分段完成以后交给剪辑连接。
操作 1:统一使用“主体动作 + 环境动作 + 镜头运动”结构
三个系统同时运动, 模型需要同时维持人物、空间和摄影机关系, 失败概率会明显增加。 对短剧来说,剪辑节奏通常比复杂长运镜更重要。
样镜通过以后,再批量生产22个镜头
S02上一阶段已经生成了稳定关键帧, 现在用它测试人物小动作、风雪运动和镜头稳定程度。
操作 1:上传S02_LOCK关键帧
进入可灵AI当前的视频生成入口, 使用图生视频方式, 上传上一阶段已经验收的S02关键帧。
不需要死记某个版本按钮叫法。 这一阶段需要的能力本质上只有: 使用已有图片作为视频起始视觉依据。
操作 2:输入S02视频提示词
保持起始图片中的人物身份、服装、幽灯和北哨结构稳定。
主体动作
赫连朔缓慢、小幅抬头, 视线落向画面右上方的幽灯。
人物状态
身体基本保持不动, 只有头部和眼神发生轻微变化, 神情警觉、克制。
环境动作
背景暴雪持续由左向右横向吹动, 衣角和少量碎发受到轻微风力影响。
摄影机
固定机位, 不推拉, 不旋转, 不改变构图。
避免
- 不要改变人物脸型。
- 不要改变护甲。
- 不要出现夸张表情。
- 不要新增人物。
- 不要让幽灯自行变形。
- 不要出现无原因大幅镜头运动。
操作 3:生成以后只检查6件事
简单镜头不要过度控制,让AI只完成一个主要动作
S02样镜通过以后, 先把所有低难度和大部分中难度单帧镜头完成, 建立第一批稳定视频素材。
人物反应
抬头、看向某处、简单后退、对白口型前的身体动作。
环境镜头
暴雪、雪骑出现、环境轻微推进等。
小幅主体动作
照野挖雪、人物走近、枪轻微转向等。
操作 1:先确定动作幅度
操作 2:不要让所有镜头都动摄影机
真实影视并不是每个镜头都在移动。 特别是AI短剧, 稳定的固定镜头、轻推、轻跟, 往往比大幅环绕更容易形成统一风格。
如果人物本身已经在快速移动, 摄影机尽量稳定; 如果人物基本不动, 可以用轻微推进增加画面生命力。
动作终点非常重要时,不要让模型自己猜
例如牧迟最后必须摔倒、铜匣必须脱手, 如果只提供首帧, 模型可能产生完全不同的动作结果。
操作 1:S14使用首尾帧控制“奔跑 → 摔倒”
操作 2:提示词只描述首尾之间的运动
从首帧自然过渡到尾帧, 严格保持牧迟身份、服装、铜匣和雪原环境一致。
动作过程
牧迟正在向前奔跑, 身体突然像被后方无形力量猛地拽住, 向前速度迅速消失。
身体失去平衡向后摔倒, 双手松开, 铜匣由于惯性继续向前滑出。
镜头
摄影机基本固定, 允许极轻微跟随人物, 不做环绕。
环境
暴雪持续, 地面积雪受到脚步和摔倒动作轻微扰动。
禁止
- 不要让角色主动跳起。
- 不要改变铜匣尺寸。
- 不要改变人物服装。
- 不要增加其他人物。
- 不要自动旋转镜头。
操作 3:首尾帧之间差异不要过大
如果人物从画面左侧瞬间跑到右侧, 同时服装、姿态、背景机位都变化, 模型中间仍然很难构建合理运动。 首尾帧越像同一个连续镜头里的两个状态,成功率越高。
不要求一个模型一次完成整场动作戏
高难镜头真正有效的方法, 仍然是拆分、减少主体、降低动作复杂度,再通过剪辑制造连续感。
影子异变
人物和影子最好分阶段处理, 部分黑影变化留给后期。
照野夺匣
动物运动 + 道具交互本身已经足够复杂, 不同时要求复杂运镜。
三箭连射
用三个不同镜头表现结果, 不做一镜到底。
多人互动
一次生成里尽量减少同时发生复杂动作的主体数量。
操作 1:S16照野夺铜匣分成两个视频任务
操作 2:S17—S19三箭分别生成
操作 3:可灵连续失败时,再把Vidu作为备用
备用模型不是为了每个镜头都多生成一遍, 而是处理少数始终无法稳定完成的高难镜头。
仍然使用已经锁定的关键帧、相同的动作起点和终点。 工具可以换,但项目资产不能跟着换。
不要每次失败以后原提示词再抽一次
重生成之前先判断失败属于哪一类, 否则只是重复消耗时间和生成次数。
降低动作幅度, 减少头部大角度旋转, 回到更稳定的关键帧重新生成。
将复杂全身动作继续拆短, 减少多人交互和快速肢体变化。
删除不必要的摄影机描述, 明确固定机位或单一轻微移动。
把道具变成当前镜头主要视觉主体, 不要同时加入太多人物动作。
检查首尾状态差异是否过大, 必要时加入一个中间状态再拆成两段。
明确动作速度和爆发感, 同时减少镜头本身的移动。
操作 1:一次重生成只修改一个主要变量
保持上一版本中已经正确的人物身份、 服装、场景、构图和动作方向全部不变。
本次只修正
【例如:人物头部转动幅度过大,本次改为小幅向右转头,身体保持不动。】
其余保持
- 角色身份不变。
- 场景不变。
- 镜头位置不变。
- 光线不变。
- 主要动作方向不变。
禁止
- 不要重新设计镜头。
- 不要增加新动作。
- 不要自动增加运镜。
不按镜头编号做,按“成功率”安排生产顺序
先快速把简单镜头做完, 让整个项目尽快拥有可剪辑骨架, 最后再集中攻克少数高难镜头。
低难镜头
环境、特写、人物轻微动作先全部完成。
中难镜头
奔跑、挖雪、人物移动和简单道具动作。
高难镜头
影子、动物抢匣、摔倒、武器交互最后集中解决。
操作 1:推荐生产顺序
操作 2:每完成一个镜头就立刻锁定,不等全部结束再整理
某条镜头通过验收以后, 直接复制到“07_锁定视频”文件夹, 后面不要再把测试版本混进正式素材。
这一阶段结束时,不要求已经像最终成片
对白、配音、音乐、警钟、箭声、黑影特效和精确节奏, 下一篇才会统一进入后期。 这里先保证视觉素材真正可剪。
操作 1:逐镜检查
操作 2:不要因为最后0.5秒崩了就整条作废
如果一条5秒素材前3.5秒完全可用, 后1.5秒开始变形, 它仍然可能是一条合格素材。 真正的判断标准是: 有没有足够长的有效段落可以进入剪辑。
操作 3:统一保存最终视频
操作 4:最终完成10项检查
到这里,《幽灯转南》已经从文字故事真正变成了一组可剪辑的视频镜头。 下一篇进入最后一步《第6步:配音、音效与剪辑成片》, 使用MiniMax Audio完成中文配音, 再进入剪映专业版统一对白、环境音、音效、音乐、节奏、转场和最终导出, 把前5篇积累的所有资产真正组装成一支完整短剧。
学完这篇,还可以继续这样做
如果你想把这篇内容真正用起来,可以继续查看资料、工作流,或者加入寻刻AI实用学习圈。