做了三集AI漫剧,角色脸终于没崩,说点实话
前阵子做AI漫剧被问得最多的一句话就是:哪个AI漫剧工具可以保持人物不变?我自己也卡了快三周,第一集男主帅得我截图存手机,第二集出来他下巴宽了两厘米,我当场想删号。后来慢慢摸索出一套流程,今天把踩过的坑和能用的参数写下来,给同样在跟变脸较劲的朋友参考。
之前为什么角色老换脸
说实话,最开始我以为就是提示词没写好。每次生成前我都把剑眉、冷色瞳孔、黑色高领、短发碎刘海打一遍,结果第三集换了一个角度,五官比例又跑了。后来在特种猫社区翻到几个老帖才明白,光靠文字描述根本锁不住脸,模型每次渲染都是在重新理解你的描述,角度一变它就自由发挥了。
我试过最崩溃的一版:第一集正面特写,男主脸型偏窄,很利落;到第五集切了个侧面四分之三镜头,他直接变成圆脸,观众弹幕刷"男主是不是偷偷去打了玻尿酸"。那集完播率直接掉了六成,我盯着数据看了半小时没说话。
后来才知道,哪个AI漫剧工具可以保持人物不变这个问题的核心,不在于你描述得多细,而在于你有没有给模型一个锚点——一张固定的参考图,配合图生图模式,比纯文字prompt靠谱太多了。

我后来怎么把角色锁住的
转折是有一次我换用图生图流程,先单独生成一张角色定妆照,确认满意后把这张图存下来当参考底图。之后每一镜都走图生图,把定妆照丢进去当参考,提示词里只写动作和场景,不再重复描述五官。这一步做完,后面十几镜的脸基本稳了。哪个AI漫剧工具可以保持人物不变,我折腾了两周才想明白,核心不是换工具,而是换流程。
- 先单独跑一张角色定妆图,正面、平视、中性表情,背景纯色,比例9:16
- 定妆图出来后记录seed值,后续所有图生图都固定这个seed
- 提示词模板改成:动作描述 + 场景 + 镜头角度,不再写五官细节
- 随机性参数调到7左右,别超过10,太高脸还是会飘
- 负面提示词加上:变形、多脸、五官模糊、画风突变
我拿这套流程连出了八集,主角从第一集到第八集没崩过,观众在评论区说这脸终于不换人了。说实话还是能看出来是AI画的,但至少不像之前那样每集换一版,完播率也稳住了,没再出现那种"这到底是谁"的弹幕。
分镜和画面节奏这块
角色脸稳住之后,下一个坑是分镜节奏。很多人——包括当时的我——习惯把一整段对话塞进一个镜头,结果生成出来人物表情僵硬,像是被冻住了。后来我学乖了,把分镜拆细:一个镜头只放一句台词或一个动作,单镜时长控制在两到三秒,靠剪辑节奏带情绪,别指望一张图把情绪演完。
关于哪个AI漫剧工具可以保持人物不变,光锁脸还不够,你每镜的画风参数也得统一。我之前有一集中间混了一帧风格跳了,像是从厚涂突然切到赛璐璐,观众直接以为我剪辑串片了。后来我把风格模型锁定在同一个二次元预设上,每一镜的色调、线稿粗细就不漂移了。
分镜拆解的顺序我是这样走的:先把剧本按台词断句,一句一格;再给每格标镜头角度,特写、中景、全景轮换着来;最后统一生成,生成完立刻过一遍,有变脸的单独重跑,别攒到最后一把筛,效率太低。
说点不太行的地方
不是所有场景都顺。说实话,多人同框的时候人物一致性还是打折扣——两个角色站一起,配角偶尔会蹭主角的脸,五官往主角那边靠。我试过把两个角色分别定妆再合图,效果好一些,但还没做到完全隔离,目前只能靠后期局部修。
另外纯文字驱动的漫剧,如果剧本里角色有大量情绪变化,比如从哭到笑到愤怒连续切,表情生成的连贯性还是不够,你得手动挑好几版才能接上。这个目前只能靠人工筛选,没有特别好的自动化方案,耐心差的话会很痛苦。
还有一个小问题:竖屏9:16出图没问题,但如果你要做横屏16:9的B站版本,重新生成一遍时角色偶尔会有细微偏移,得再对一次参考图。所以哪个AI漫剧工具可以保持人物不变这件事,单角色、单画幅、少切角度的场景基本能搞定,复杂场景还是得预留手动修的时间。
写了这么多,核心就一句话:定妆图、图生图、固定seed、锁定画风,这四步走下来日常更新够用了。如果你也在纠结哪个AI漫剧工具可以保持人物不变,与其天天换工具,不如先把这套流程跑通,工具只是载体,流程才是关键。有问题可以去特种猫社区里翻翻别人的分镜和提示词,比我当初瞎摸索快多了。