拿AI短剧从剧本到成片平台做了部3分钟片,说点实话
上礼拜接了个活,给一个美妆账号做3分钟剧情短视频,全AI生成、不能真人出镜。我第一反应是头大——剧本、分镜、画面、配音、剪辑全得自己串。后来在特种猫社区翻到几个老玩家的经验帖,就顺着那套AI短剧从剧本到成片平台的流程跑了两周,从最初一集生成十几遍才满意,到现在基本能一次出七八成。踩过的坑和调出来的参数写下来,给同样在摸索的朋友参考。
剧本别直接丢AI,先自己拆三幕
在这套AI短剧从剧本到成片平台的流程里,剧本是最容易偷懒也最容易翻车的一步。我一开始图快,直接把"美妆博主发现闺蜜偷用她的产品"丢进生成器,出来的东西像流水账,没有冲突升级,AI只会把一句话扩成八句同义反复。后来改成先自己在纸上写三幕结构、每幕标一个核心冲突点,再交给AI去填充对话和细节,出来的质量完全不是一个级别。
我固定下来的操作顺序是这样的:每次接到新选题,先花二十分钟在纸上把三幕骨架搭出来,确认每个冲突点都立得住,再丢给AI去扩写对话和补场景细节。这样做的好处是生成出来不会跑偏,因为你已经给了它一条明确的情绪走向和节奏锚点:
- 第一幕(前15秒):建立日常,埋一个异常信号,比如"她桌上的口红颜色不对,品牌不是她平时用的"
- 第二幕(中间60秒):冲突升级,两次试探一次打脸,每15秒换一个情绪点,不能让观众猜得到下一步
- 第三幕(最后15秒):反转加钩子,"她笑着把口归还回去,说下次记得卸妆",画面定格在她嘴角那个不太对劲的笑
AI在这里面干的是让对话像人话的活,不是帮你编故事。如果你连"这集核心冲突是什么"都说不清,生成出来的剧本一定是散的、平的。我第一部片子就吃了这个亏,后面两部都先写骨架再动手,返工时间少了一半。

分镜提示词我改了七八版才顺
画面生成是最头疼的环节。用AI短剧从剧本到成片平台跑分镜时我发现一个反直觉的规律:提示词越"电影术语化",AI出图越跑偏。我试过写"35mm镜头,浅景深,黄金时段侧光,电影感",出来的画面要么过曝要么构图很怪。后来改成大白话——"中近景,只拍她半张脸和手里的口红,背景虚掉,暖黄灯光从左边打过来"——基本就对了。
废了两百多个分镜、对着屏幕改了几百行提示词之后,我总结出下面这几条规律。基本都是新人最容易踩的坑,也是社区里被问得最多的几个点,你们可以逐条对着调,不用像我当初那样一个坑一个坑地踩:
- 角色一致性:每次生成都把外貌完整重复一遍,"25岁女生,圆脸,扎高马尾,穿白色T恤",别写"同上"或"同前角色",AI不认这个
- 景别拉开:相邻两个分镜景别要错开,上一个特写下一个就切全景,不然看着像卡了
- 时长:单个分镜3到5秒最自然,超7秒容易出现画面漂移和肢体变形
- 运动描述:别写"镜头缓慢推进",写"画面从她肩膀慢慢移到她手背上的口红",给AI一个具体的起点和终点
我第一部光分镜提示词就改了七八版,第二部三版定稿,第三部基本一次过。**这个熟练度只能靠跑量,没有捷径。**另外,同一场景要出多个角度的话,建议一次性把四五个角度的提示词都写好再生成,比一个一个跑效率高,光线和色调也统一。
画面生成完,节奏比画质重要
分镜全部跑完之后,很多人会盯着画质抠细节,我觉得这步没那么关键。用AI短剧从剧本到成片平台生成的画面,单个镜头看可能不够"电影感",但拼在一起节奏对了,观众不会逐个镜头去审视。我第一部花两小时调画质,播放量反而不如第二部——第二部只花四十分钟粗剪,但卡点准、节奏紧,完播率更高。
剪片子这一步我一开始很迷茫,后来发现不用搞多复杂,重点就盯下面几件事。都是实操层面的具体操作,不是什么"要有网感""要抓节奏"之类的虚词,每次交片前我都会对着清单过一遍:
- 前3秒必须有视觉冲突或文字钩子,我把第二幕最激烈的镜头直接前置,配一句"你确定她没动过你的东西?"
- 转场用硬切最安全,最多在情绪转折处加0.5秒黑场,别用花式转场
- BGM选轻快的,音量压到人声30%以下,别盖住对话
- 字幕白色加黑描边,一行不超过12个字
配音说一句实话:AI短剧从剧本到成片平台批量出的配音,日常对话和旁白基本能直接用。但情绪爆发的那一两句,比如摔东西、喊"你凭什么",AI语气还是有点"端",像在念稿。我的处理是情绪最重的那一两句单独重新生成,跑三五个版本挑最自然的,其余批量出就行,不用每句都精修。
说几个它现在还不行地方
不能光说好话,跑了两周有几个地方我还是觉得别扭。第一个是长剧情连贯性:一集超过5个分镜,角色服装和背景容易出现细微变化,T恤领口从圆领变V领,窗外从白天变阴天。我的办法是每个分镜单独生成,靠剪辑节奏遮跳变,但一集20个分镜光对细节就多花半个多小时。
第二个是复杂动作。"她转身把口红摔在桌上,纸屑飞起来"这种多元素动态,AI大概率只让人物转了身,纸屑没有,或者口红掉错方向。我现在把复杂动作拆成两个镜头:一个转身,一个手砸桌面特写,中间硬切过渡,观众注意力不在那个衔接上就看不出来。
第三个是批量效率。分镜多的时候一个一个跑确实慢,我在特种猫社区看到有人批量导出再本地剪,效率是高了但牺牲了单镜头精调。看时间紧不紧:急就先批量出,再回头精修关键镜头,别每个都磨。
跑完两周出了三部片子,最大的感受是AI短剧从剧本到成片平台把技术门槛砍掉了大半,但审美判断还是得你自己来——哪个镜头该留、哪句台词该删、节奏在哪断,工具替不了。如果你们也在试,建议先去特种猫社区翻翻别人的分镜截图和提示词,比自己闷头跑快很多。