做了三集仙侠短剧,角色终于不串脸了
上礼拜接了个活儿,帮朋友公司做ai玄幻仙侠短剧制作,三集、每集90秒。第一集我光角色脸就重跑了二十多遍,每两个镜头换一次,真服了。这阵子把角色一致性死磕下来之后,后两集顺利多了,今天把踩坑过程记下来,你们少走点弯路。
角色资产这步我卡了整整一周
我之前做ai玄幻仙侠短剧制作一直图省事,每个分镜单独写提示词描述人物,结果模型每次都重新"理解"你的角色。一个90秒的片子拆成十二个分镜,我光重新生成就跑了三十多遍,算力和时间双重浪费。后来在特种猫社区翻了几个老哥的帖子,才明白得先做角色"数字人资产"再进分镜,顺序反了后面全是返工。
具体操作:先用绘图工具生成主角的正面、侧面、半身三视图,把五官比例、发色、道袍纹路全部锁死。我用的提示词模板大致是:"ancient Chinese xianxia male cultivator, black hair with jade hairpin, narrow phoenix eyes, thin lips, white-gold daoist robe with cloud pattern at collar, full body front/side/three-quarter view, cinematic lighting, 9:16"。三张图确认满意后,后续所有分镜都上传这三张做参考图,不再纯靠文字描述。
做完这步之后返工率从八成左右直接降到两成以内。有个坑提醒一下:三视图分辨率别低于1024,我最早用512的图做参考,模型抓不住细节,脸照样飘。这个细节当时没注意,白废了两天算力。

分镜拆法比提示词更重要
很多新手把ai玄幻仙侠短剧制作的重心全放在单条提示词上,反复调措辞。我现在的感受是分镜怎么拆比怎么写prompt影响大得多。比如"主角御剑飞越云海",我最早一条提示词搞定,出来要么剑飞了人没飞,要么云变成棉花糖。后来拆成三个镜头:远景云海两秒、中景御剑破云两秒半、仰角剑尖划破云层一秒半,单独生成再拼,稳得多。
拆的时候我固定了一个习惯:每个分镜只描述一个主体动作。提示词结构是"镜头类型 + 主体动作 + 环境 + 光影 + 风格",比如中景那条我写的是"medium shot, male cultivator riding a glowing sword, breaking through thick clouds, golden light from above, dramatic angle, xianxia style, 9:16, cinematic"。环境描述别超过两个词,多了模型会顾此失彼,出来的画面什么都有一点就是什么都不对。
竖屏9:16这个比例我一开始真没注意,出图全是16:9横的,后期裁掉两边少了一半构图空间。现在所有提示词尾部固定挂"9:16, vertical composition",省了裁切时间也省了重新生成的算力。
仙侠大场面怎么出图不翻车
ai玄幻仙侠短剧制作里最炸翻车的就是大特效:天劫、阵法、法宝对决。我踩最大的坑是一次生成"九天雷劫劈落",出来的雷是紫色的、形状像挂面,主角还被劈成两截。后来我调整了策略:特效镜头不让人物同框,单独生成空镜特效素材,剪辑时再叠在人物画面上做合成。
- 雷劫、法术特效单独生成,提示词去掉人物描述,只写场景和光效,比如"electrical storm, golden lightning, ancient Chinese temple, dramatic, 9:16"
- 单段生成时长控制在三秒以内,超过四秒模型尾部大概率变形
- 反向提示词固定加:deformed face, extra limbs, watermark, cartoon, low quality, blurry
- 同一条特效多跑五到八条再挑,别赌一次出好的
阵法类场景我换了个思路:先生成静态阵法底图,用Stable Diffusion出图,参数steps设35、CFG给7,再用图生视频工具让它缓慢旋转。比直接文生视频稳定太多。那个"太极八卦阵缓缓转动"的镜头,文生视频我跑了十几条全是乱的,图生视频一次就过了,省了将近一小时。
配音和剪辑的偷懒收尾
最后说一下ai玄幻仙侠短剧制作里容易被忽略的收尾环节。配音我全用AI合成,给男主设了个低沉带点沙哑的音色,女主用清亮偏冷的。每句台词我会手动调情绪标签,"你竟敢伤她"加了愤怒和急促,"罢了"加了叹息停顿。AI出来之后一定要逐句听,气口不对的地方手动加0.3秒静音,不然连在一起像机器在念稿。
剪辑我在剪映里做,先把配音轨铺好再按台词对齐画面。仙侠片统一加了暗角加暖色调滤镜,BGM音量压到人声的百分之二十左右,风声、剑鸣、雷声这些环境音铺最底层。转场以硬切为主,只在场景大跳时用半秒叠化,花哨转场在竖屏短剧里真的减分。字幕用白色描边黑字,字号别太大,别挡人脸。
收尾还有一个小细节:每集结尾最后半秒我留了个画面黑场加一声剑鸣,当个钩子让手指停在屏幕上想点下一集。三集发出去之后朋友反馈说"看着像那么回事了",虽然离电影质感还远,但至少角色不串了、节奏顺了,对新手来说这一步就够了。
说回ai玄幻仙侠短剧制作这件事,工具链现在已经很成熟了,真正拉开差距的还是你对节奏和画面的判断力。这三集做完我最大的体会是:少追求单镜头多华丽,多追求镜头之间顺不顺、观众认不认得出来角色。如果你也在做这类片子,可以来特种猫社区看看,里面有不少同题材的创作者在分享提示词和分镜模板,比我一个人瞎琢磨效率高不少。