AI短剧第六步:镜头都有了还不算完成, 最后把声音、节奏和画面 真正剪成一部短剧
前5步已经完成《幽灯转南》的故事改编、角色场景、 22个镜头任务、关键帧和视频素材。 现在进入整个项目最后一个阶段: 把这些零散素材放进剪辑时间线, 先剪出88秒完整视觉骨架, 再加入旁白、角色对白、环境音、关键音效、音乐和字幕, 最终导出真正可以观看和发布的竖屏成片。
← 还没完成第5步?先完成22个视频镜头做完这一篇,你应该得到真正的最终成片
不再是镜头素材、关键帧或测试片段, 而是一支拥有完整画面、对白、声音设计、字幕和节奏的88秒竖屏AI短剧。
不要一上来加音乐,先把所有素材整理干净
最后的后期阶段最容易因为文件混乱返工。 先把锁定视频、台词、声音和输出文件分开, 再进入剪映专业版。
操作 1:建立“06_后期成片”文件夹
操作 2:在剪映专业版新建竖屏项目
1080 × 1920
整个系列从第一步开始就是9:16竖屏, 最后不要临时修改画幅。
约88秒
后期可以微调几秒, 但不要因为素材很多把成片拖成长视频。
先建立画面骨架
此时只导入锁定视频, 暂时不要加音乐、花字和复杂效果。
先让22个镜头能够从头顺畅看到尾
第一遍剪辑不追求高级感。 唯一目标是把每个AI视频素材中真正有效的部分截出来, 按剧本顺序拼成完整视觉故事。
操作 1:先按镜头编号排到时间线
S01、S02、S03……一直排到S22。 如果S16拆成S16A和S16B, 就按实际叙事顺序连续放置。
操作 2:只保留每条AI视频真正能用的区间
一条素材如果前3秒人物和动作都稳定, 最后2秒开始脸变形, 就直接把后2秒剪掉。 AI视频后期的核心工作之一,就是从生成素材里找到“有效区间”。
操作 3:先恢复我们第一篇设计的时间结构
短剧的大多数镜头直接切就够了。 先把叙事和动作节奏解决, 不要用大量淡入淡出、旋转和模板转场掩盖镜头问题。
《幽灯转南》只保留4条主要语音
第一篇已经刻意压缩旁白和对白。 到后期不要觉得画面空,就重新给所有镜头塞解说。
这是第一篇已经确定的角色表达方式。 不要到了配音阶段临时给他们增加台词。 沉默本身就是人物塑造的一部分。
先锁定声音身份,再逐句生成
这里的目标不是追求“最像真人的声音”, 而是让不同角色之间有明显区别,并且符合故事气质。
旁白
中低音、冷静、克制, 不要像纪录片播音,也不要故意压成气泡音。
洛葵
年轻女性,声音清晰, 判断性强,不慌乱。
乌洛
年龄偏大,低沉、疲惫, 最后一声“容城”要带明显不安。
操作 1:每个角色先生成一条测试语音
在MiniMax Audio当前版本中找到文本转语音或对应语音生成能力。 具体按钮名称未来可能变化, 但操作原则不变: 先用一句短文本选声音,再正式生成全部台词。
操作 2:先做旁白测试
为东方玄幻悬疑短剧生成中文旁白。
声音气质
- 成年男性或中性中低音。
- 冷静、克制、略带压迫感。
- 不要播音腔。
- 不要明显情绪表演。
- 语速偏慢但不能拖沓。
试读文本
北哨的灯,四百年来第一次背对雪原。
操作 3:锁定声音以后逐句单独生成
后期需要分别控制每一句的入点、停顿和音量。 每句单独导出, 比在一个长音频里反复切割更容易管理。
操作 4:统一命名
声音不是“有配音就够了”
《幽灯转南》的压迫感很大一部分来自声音。 风雪、幽灯机械转动、心跳、箭声和最后的警钟, 都比额外增加对白更重要。
操作 1:先铺环境底,再加具体音效
不要一上来逐帧塞几十个声音。 先建立持续的风雪底噪, 让整部片有统一空间, 再逐个加入关键动作声音。
操作 2:只有真正重要的动作才需要强调音效
幽灯转动
这是全片第一异常事件, 需要让观众听到“它真的动了”。
影子脱离
可以用短促低频、衣料摩擦和心跳, 不必使用夸张魔法音效。
三箭
三箭声音要有节奏差异, 第三箭命中应最明确。
最后一声警钟
负责把“容城”悬念真正砸在观众记忆里。
音乐不是从第一秒到最后一秒一直铺满
悬疑短剧如果音乐始终很满, 真正的异常和动作反而没有重点。 音乐应该跟随叙事阶段变化。
这一集不是大战高潮, 而是悬疑事件的第一集。 音乐重点是压迫和未知, 不是英雄感和胜利感。
现在才开始真正调整节奏
粗剪解决“看不看得懂”, 精剪解决“想不想继续看”。
前3秒必须出现异常
不要用长时间雪原空镜做开头, 幽灯转南必须尽早出现。
信息镜头稍慢
冰鳞、黑冰方向、地图节点需要给观众一点识别时间。
动作段加快
牧迟、照野和三箭之间尽量少留无效停顿。
结尾不要解释
“木爿,容城。”之后警钟、切黑, 不再增加说明。
操作 1:把每个镜头头尾无效停顿剪掉
AI生成视频经常会在开头先“静止一下”, 或动作结束以后继续停顿。 如果这些停顿没有叙事作用, 直接剪掉。
操作 2:动作可以利用“切点”隐藏生成瑕疵
不必让整个动作完整持续到镜头结束。 当枪锋最接近背部、白毛飞起时直接切到S17箭撞长枪, 既能提高节奏,也能隐藏后半段可能出现的AI变形。
操作 3:三箭不要平均分配时长
第一箭快, 第二箭更快, 第三箭命中黑缝稍微停一下。 这样才有“连续攻击 → 最终命中”的节奏层级。
让观众听得清,但不要让声音互相抢
到这一阶段画面和声音已经齐全, 最后需要解决声音层级和移动端观看时的字幕可读性。
操作 1:先关掉音乐检查对白
单独播放旁白、对白、环境音和关键音效。 先确认这些声音本身没有问题, 再把音乐打开。
操作 2:对白出现时自动压低背景音乐
不需要把音乐整体调得非常小, 只要在有人说话时让音乐适当退后, 台词结束以后再恢复。
操作 3:字幕只服务可读性
不要太靠底部
给手机平台底部UI留出安全区。
一次不要太多字
四条主要语音都很短, 没必要做大段字幕。
样式保持统一
不同人物不需要频繁换字体、动画和颜色。
不再逐镜看,连续从头看到尾
单独看每个镜头都没问题, 连起来仍然可能出现节奏、声音和连续性问题。
操作 1:再用手机完整看一遍
这部片最终是9:16竖屏, 不要只在电脑大屏检查。 手机端重点看字幕大小、人物面部、暗部细节和声音大小。
操作 2:发现问题时按类型修改
先检查镜头顺序和信息镜头时长, 不要第一反应增加旁白解释。
优先剪掉镜头开头、结尾的无效停顿和重复信息。
先调整声音和剪辑切点, 不要直接增加更多特效。
缩短崩坏画面暴露时间, 用切点、声音和反应镜头隐藏模型瑕疵。
删除没有叙事功能的装饰音, 保留风雪、关键动作和警钟。
压低“容城”前的音乐, 留出声音空间, 警钟后立即切黑。
最终成片只是一个文件,真正值钱的是整个生产资产
做完第一集以后, 不要把项目文件删掉。 角色、场景、镜头方法和声音设定都可以继续服务下一集。
操作 1:导出最终成片
1080 × 1920
保持9:16竖屏, 不在最终导出时临时裁切。
MASTER
先保存一份完整最高质量主版本, 后续平台版本从MASTER再复制。
完整播放
导出以后重新打开最终文件从头播放一次, 不只看剪辑工程。
操作 2:保存最终项目结构
操作 3:最后检查整个项目是否真正完成
从最初的一段文学故事开始, 我们先完成故事改编和视听剧本, 再建立角色与场景视觉资产, 拆成22个镜头任务, 制作关键帧和一致性体系, 逐镜生成AI视频, 最后完成配音、声音设计、剪辑、字幕和成片导出。 这才是一条完整的AI短剧项目生产流程。
现在你已经有了一套可以重复使用的AI短剧生产流程
下一次不需要重新摸索“AI短剧到底从哪里开始”。 换一个故事, 继续按照剧本 → 视觉设定 → 分镜 → 关键帧 → 视频 → 后期这6步执行即可。
返回 AI 内容创作工作台 →学完这篇,还可以继续这样做
如果你想把这篇内容真正用起来,可以继续查看资料、工作流,或者加入寻刻AI实用学习圈。