跑了三集AI短剧,分镜和角色一致性终于不翻车了
上个月帮朋友推一本仙侠小说,要出三集短剧,每集大概两分钟。头两天我对着屏幕干瞪眼,AI 生成的角色到第二集脸就变了,分镜节奏也完全卡不住。折腾完第三集我才把流程理顺,今天把这套 ai短剧制作教程 里真正有用的东西拆出来,省得你们再走我那条弯路。
分镜脚本先列成表格再动手
我一开始犯的错误是直接让 AI 生成两千字剧本然后整段丢进去跑。结果出来的分镜全是远景大全景,没有近景没有特写,节奏跟 PPT 翻页似的。后来我学到一个在 ai短剧制作教程 里反复被提到、但自己之前没当回事的做法:先用 AI 出故事大纲,分镜表必须自己一镜一镜地列。
表格我固定用五列:镜号、AI 生图提示词、画面内容描述、镜头景别、预估时长。其中提示词那列是核心,写的时候会把角色外貌描述完整塞进去(后面细说),景别用「全景 / 中景 / 近景 / 特写」四个词就够,时长一般三到五秒一个镜头。两分钟的片子拆下来大概 25 到 30 个镜头,这个数字别贪多,AI 生成单个镜头的等待时间是实打实的。
列完表之后我会通读一遍,重点检查两件事:一是相邻两个镜头的景别别一样,全景接全景看着就闷;二是每五到六个镜头必须有一个情绪转折点,不然观众撑不到第二集。这个检查花不了十分钟,但能省掉后面大量返工。

角色一致性这关我卡了整整三天
说个具体的失败经历。第一集我让 AI 生成女主,提示词写的是「古代女子,长发,红裙」,第二集换了个场景重新生成,出来的人头发变短了、裙子颜色偏粉。第三集更离谱,直接多了根眉毛。我在特种猫社区翻了半天帖子,才意识到问题出在描述太模糊,AI 每次都在自由发挥。
后来我给自己立了个规矩:角色首次出现时,把外貌写成一个固定字符串,之后每一镜的提示词里原封不动地复制这段。我的女主固定描述是「22 岁女性,黑色长发扎低马尾,细圆框眼镜,鹅蛋脸,米白色交领汉服,腰间系一条暗红色丝带」。二十几个字,看着啰嗦,但生成一致性直接就不一样了。
另外有个小细节:场景变化大的时候,光线描述也要跟着改。室内写「暖黄烛光,柔光」,室外写「冷白光,侧逆光」,不然同一套衣服在不同光线下颜色会飘。这个在 ai短剧制作教程 里提的人不多,但我实测确实管用,省了至少两次的重生成。
提示词里这几个数值我反复调过
生成视频片段的时候,运动强度这个参数我前前后后试了五六次。第一次图省事直接拉满,结果女主说台词的时候脸像融化的蜡像一样抖。后来我总结出大概的范围:对话场景运动强度控制在 0.3 到 0.5 之间,人物基本只有口型和细微表情变化;打斗或者转场镜头可以放到 0.7 到 0.8,但超过 0.8 手指和头发大概率穿模。
镜头运动我一般只给一个方向,别贪心。比如写「镜头缓慢右移」就行,你要是写「镜头右移同时轻微上摇」,AI 经常只执行一半,出来一个很奇怪的斜角。运镜越简单越稳,复杂运镜留给后期剪辑里用关键帧补。
还有一个坑:画面比例。我一开始用 16:9 生成,剪到竖屏里上下全是黑边。现在直接在提示词里锁 9:16 竖构图,人物站位偏上三分之一处,底部留白给字幕。这个在 ai短剧制作教程 的实操环节里算基本功,但我第一次做的时候就是忽略了,白重生了十几个镜头,心态差点崩掉。
配音和卡点别全交给自动
平台的自动配音功能说实话能用,但直接用出来就是「AI 念稿」的味儿。我的做法是先让它出一版,然后手动调两个地方:悲伤或回忆段落把语速降到 0.8 倍,句尾加个气声;冲突或争吵戏把语速提到 1.1 倍,中间插一个 0.5 秒的停顿当喘气。光这两步,听感就完全不同了,不像在听机器朗读。
卡点这件事我一开始也偷懒,全用智能自动匹配。结果发现 AI 理解的「卡点」跟观众理解的不是一回事——它喜欢在动作完成的时候切,但观众要的是动作刚开始就切,才有那种「啪」的爽感。现在我会在剪辑软件里手动把切点提前两到三帧,这个微调在 ai短剧制作教程 的后期环节里提得少,但真的是肉眼可见的差别。
封面和花字我一般不在生成工具里做,导出来到剪映里套模板更快。不过最近看到有人分享了一个技巧:生成封面图的时候提示词里加「留白区域在画面下三分之一」,出来一张图直接当封面用,省了排版时间。我试了两条,确实比后期硬抠省事。
一套流程跑下来到底要多久
以两分钟一集、28 个镜头为标准,我现在完整跑一集大概是:剧本大纲 20 分钟,分镜表 40 分钟,角色和场景图生成 1 小时(含反复修脸),视频片段批量生成 1 小时 20 分钟,配音和剪辑 1 小时。加起来四个半小时左右。第一集我花了两天,第三集压到四个小时出头,主要是提示词模板熟了不用反复调了。
要说局限,多角色同框的打斗场景到现在我还是不太满意。两人以上同时动,AI 经常出现一个人变透明或者手臂数量不对。我的做法是拆成两个单人镜头快切,观众 0.3 秒的切换根本反应不过来。另外超过 8 秒一句的长对话,AI 口型同步会有半拍延迟,这种我直接关掉口型动画,用侧面或过肩镜头糊过去。
最后说两句。ai短剧制作教程 这种东西,看十篇不如自己跑一遍再回来改。别一上来就追大制作,先拿一个三分钟的单集把分镜表、角色一致性、运动参数这三件事跑通,剩下的都是量变。我自己在 特种猫社区 发过第三集成品和分镜表模板,需要的可以翻翻。一个人坐电脑前四五十分钟出一个镜头,不用等导演不用等场地,这个自由度是真人拍摄给不了的。