特种猫社区
灌水茶馆

竖屏短剧做了三集,分镜拆法比你想的麻烦

发布于 2026-08-25 · 20 浏览

这阵子我一直在折腾竖屏短剧ai怎么制作这件事,前后做了三集,每集大概两分钟。第一集基本报废,第二集修了四个小时才勉强能看,第三集流程顺了之后两三个小时出片。今天把中间踩的坑和最后跑通的步骤写出来,省得你们再走一遍我的弯路。

剧本和人设别省,这步决定后面崩不崩

说句不好听的,竖屏短剧ai怎么制作最大的坑不在生成视频那一步,在你前面没把人物锁死。我第一集图省事,人设就写了"短发女生,穿白衬衫"六个字,结果第3镜和第7镜的刘海方向都不一样,到第12镜直接换了张脸,观众评论区当场问"这是不是两个人"。

后来我学乖了,人设描述拉到这个颗粒度:齐肩碎发偏分、偏圆脸短下巴、深棕瞳、米白圆领针织衫无图案、微驼背手指偏长。写完之后先用文生图出一张正面半身参考图,确认五官比例对了,后面所有镜头都用这张图做图生视频的锚定参考,不再让AI自由发挥长相。

这里有个容易忽略的细节:参考图的光影要和你的场景匹配。我第三集有个夜戏,参考图是白天光线的感觉,结果生成的画面里人物脸特别亮,跟昏暗室内背景完全脱节,怎么调都不对。后来我专门给夜戏多出了一张暖光版参考图,问题就解决了。

竖屏短剧做了三集,分镜拆法比你想的麻烦

分镜拆到三秒一个镜头,别贪长

竖屏短剧ai怎么制作里,分镜拆法直接决定你后面返工多少。我现在一个镜头严格卡在3到5秒,超过5秒一定拆。原因是运动幅度一加大,AI生成的手指、关节就频繁出错,4秒以内的简单推拉基本能过,一旦你写"她转身从桌上拿起杯子喝一口"这种复合动作,十次有六七次手是歪的或者多出来一根。

我的分镜表就四列,够用:镜头编号、时长(秒)、画面描述、台词。画面描述我固定写"景别+主体+具体动作+表情变化",比如"中景,女主坐窗边,右手拿手机,表情从平静转惊讶",不写"她很生气"这种情绪词,AI看不懂情绪,只认具体动作。

这个表格格式我是在特种猫社区看到有人分享的模板,我拿过来改了两版用到现在。最实用的一点是加了一列"参考图编号",因为我不同场景会用不同参考图,不标清楚的话生成到第20个镜头自己都搞混了谁对应哪张脸。

生成参数我调了一晚上才稳定

竖屏短剧ai怎么制作,单镜头生成那步参数真得自己反复试。我走的是图生视频路线,参考图锁人物,提示词只写动作和景别,不再重复外貌描述,你重复写了反而跟参考图打架,AI不知道该听谁的。

运动幅度这个参数我一开始拉满,想着画面生动,结果人物一挥手胳膊就断成三截,脸也跟着扭曲。后来固定拉到30%左右,画面就是简单推拉和微微转头,反而自然。还有个坑:背景描述别贪复杂,"繁华夜市霓虹闪烁"这种写法,AI会把路人全生成出来,每个镜头路人长相都不同,特别出戏。我现在就写"室内暖光,背景虚化书架",够了。

竖屏9:16的比例一定要在生成时就设好,别到时候再裁。我试过先生成16:9再竖着裁,上下裁掉的部分经常刚好是头顶或者手里的道具,一集里裁废了快十个镜头,返工时间比重新生成还长。

配音对嘴和剪辑,最后两小时全耗在这

竖屏短剧ai怎么制作,很多人以为视频生成完就齐活了,其实后面配音、对口型、剪辑合成才是大活。我现在给每个角色固定一个AI配音音色,三集不换,观众听着有辨识度。台词生成之后我在剪映里逐句对齐,一句一帧地卡,对不上的地方先试着把那句台词剪短半个字,往往就能救回来。

口型修不好的镜头我一般两个办法:换角度重新生成,或者在剪映里用对口型工具硬修,修三次修不好就放弃那个镜头,用下一个备选。BGM我固定选节奏慢的钢琴或弦乐,音量压到台词的15%到20%,再高就盖人声了。转场能不用就不用,硬切比任何花哨转场都看着专业。

最后导出前我把整集从头看一遍,专门盯手指和耳朵,这两个部位AI最爱出错。耳朵多出一块或者手指变成六根这种事,单独看一帧不明显,但连着播就特别扎眼。发现就回那个镜头重新生成,或者把镜头时长剪掉0.5秒把崩的那帧切掉。

写到最后,竖屏短剧ai怎么制作这件事没有捷径,前面多花功夫在人设和分镜上,后面返工量就小很多。我第三集从写剧本到导出成片大概四个半小时,纯生成只占四十分钟,剩下全在拆镜头和修细节。刚做的话别追求一镜到底,三秒一个镜头拆着来,质量反而稳。做完我一般发到特种猫社区,那边有朋友能帮你看分镜逻辑,比闷头改强。

全部回复 0
登录后即可回复参与讨论…去登录 →
相关主题