跑了三集竖屏短剧,分镜和提示词说点实话
这阵子在 ai短剧制作平台工具 上连跑了三集竖屏短剧,每集四十几秒,从写分镜到出成片,中间废了不下二十条生成结果。不吹效果,就想把几个卡点讲清楚,给同样在折腾的同行省点时间。
分镜别贪多,一个镜头只写一个动作
我最早的问题是分镜写得太"电影感",一个镜头里塞了转身、抬手、表情变化三件事,生成出来的东西要么动作糊成一团,要么直接忽略后半段。后来我改了一个死规矩:每个镜头只描述一个主动作,镜头时长控制在两到四秒。比如原来写"她转身面向镜头,眼眶泛红,缓缓放下手里的信",改成两个镜头——第一个"中景,她转身,面朝镜头",第二个"特写,眼眶泛红,信纸从指尖滑落"。
拆完之后喂给生成器的描述,每个镜头我卡在三十到五十个字之间,前面标景别,后面只跟一个动词短语。ai短剧制作平台工具 对长句的理解能力还是有限,你给它写八十个字的复合动作,它大概率只执行前二十个字,后面的细节就丢光了。
- 景别标注放最前面:特写 / 中景 / 全景 / 过肩,别埋在句子中间
- 主动作只有一个,副动作(眨眼、嘴角动)全部砍掉
- 环境描述不超过十个字,比如"深夜办公室"就够了,别展开
- 镜头之间留一行空行,别让两个镜头的描述连成一段

提示词改了五版才稳定的写法
角色形象生成这块我反复折腾了至少五版提示词,前四版全是风格不统一的问题——同一个女主角,第一帧是清冷古风,第三帧突然变韩剧现代妆。后来我总结出一个顺序:先锁主体描述,再写环境,最后补光线和镜头参数。主体描述写成一个固定字符串,从第一场戏到最后一场戏一字不改,只在后面追加当镜的环境和动作。
负面提示词这块我也踩过坑,一开始加了一长串"no deformed, no extra fingers, no blurry, no watermark",结果生成速度变慢不说,画面反而出现奇怪的色偏。后来精简到三个:deformed hands, extra fingers, low quality。ai短剧制作平台工具 的负面提示词不是越多越好,超过四个关键词的时候它就开始互相打架了。
还有一个细节:如果你要统一色调,别在每帧都写"暖色调、电影感、胶片颗粒",这样写每帧的色调理解是独立的,会漂移。正确做法是第一帧把色调写死,后面几帧用"maintain consistent lighting and color grade from previous frame"这种延续性指令,生成器会参考上一帧的色温来出图,比每帧重写稳定得多。
角色一致性,参考图比文字管用
说实话,光靠文字描述锁定角色脸,成功率大概三四成。我后来在特种猫社区里看到有人分享的做法:先单独生成一张角色定妆照,正面、半身、纯色背景、平光,存下来当参考图。之后在 ai短剧制作平台工具 里每一帧生成时把这张参考图挂上去,文字描述只写动作和表情变化,不再重新描述五官和发型。这样一致性直接拉到八九成。
但参考图本身也有讲究。我试过用侧脸参考图,生成出来鼻子和下巴的角度每帧都不一样;也试过用全身图,结果生成器把注意力分散到服装和肢体比例上,脸部反而不稳定。正面半身、平光、无遮挡,这三个条件缺一个一致性就掉。
失败案例也说一下:有一集里女主换了个场景从室内到室外,我参考图没换,文字里加了"自然光、逆光",结果生成出来她脸上出现一层不自然的亮斑,像贴了个假高光。后来我把参考图也换成室外光版本,问题才解决。所以参考图不是"一张走天下",光线条件变了你就得换。
拼接节奏比单帧画质更影响观感
单帧生成质量其实已经够用,真正让片子看起来"像样"的是拼接节奏。我前两场戏每帧给了五到六秒,配上慢节奏钢琴曲,观众反馈说"看着像PPT翻页"。后来我把所有单镜时长压到两到三秒,硬切转场,不加任何花哨的溶解和擦除,BGM换成带鼓点的,卡点在每次切镜的瞬间落下去。观感直接不一样了。
ai短剧制作平台工具 导出片段的时候默认带半秒的黑边过渡,如果你要做硬切,记得在剪辑软件里把首尾各裁掉零点三秒左右,不然每两个镜头之间会闪一下黑,看着很廉价。另外竖屏短剧的画幅是 9:16,但生成器出图默认 16:9 或 1:1,裁切的时候注意人物头部别被切掉——我有一帧男主抬头的动作,裁完头顶刚好被切,废了重跑。
- 单镜时长:对话镜两秒,动作镜三秒,留白或反应镜最多四秒
- 转场:九成用硬切,需要情绪转折的地方用一次 0.5 秒叠化就够
- BGM 卡点:切镜帧对齐鼓点,别对齐旋律线,鼓点更脆
- 字幕:放在画面下方四分之一处,别压到人物面部,字号别超过画面的十五分之一
折腾了这么多,其实 ai短剧制作平台工具 的核心瓶颈不在生成质量,在你前面的分镜拆解和提示词纪律上。工具能帮你把图跑出来,但"这个镜头该不该切"这件事它替不了你。我平时跑片的一些分镜模板和踩坑记录都发在 特种猫社区 上,有在做的可以翻翻,有问题评论区聊。