特种猫社区
灌水茶馆

同一角色拍八条只崩两条,说说我的笨办法

发布于 2026-08-19 · 14 浏览

这阵子我在拍一个四集AI短剧,主角是个穿红色卫衣的年轻女人,每集大概九十字。第一集我跑了十几条,同一个人换了三个镜头脸就全变了——ai视频角色一致性这个问题把我折磨了快两周,差点想弃坑。

先别急着调提示词,把参考图搞对

我之前犯的最大错误就是拿生成出来的视频里截一帧当参考图。问题在于那帧的光线、角度、甚至表情都是随机的,模型下一段根本抓不住你真正要的那个"人"。后来我换了个做法:先用文生图跑出一组六张角色定妆照——正面、左侧四十五度、右侧四十五度、正侧面、低头、抬头,全部用同一组描述词,只改角度描述。

参考图的光线一定要统一。我试过拿一张暖光一张冷光的混着用,结果生成出来人物肤色跳得厉害,看着像两个人。现在我的习惯是所有定妆照都用中性灰背景,提示词里加 even studio lighting, neutral color temperature 把色温锁死,省得后面每条镜头都在跟光影较劲。

还有一个细节:参考图里角色不要戴帽子、墨镜或者大耳环。我第一版定妆照给了她一副圆框眼镜,结果后面五个镜头里有三个眼镜直接消失或者变成了方框,ai视频角色一致性直接废了。把配饰去掉之后,面部特征的权重才真正被模型抓住。

同一角色拍八条只崩两条,说说我的笨办法

分镜拆法决定了脸崩不崩

我后来把每集的镜头拆得很碎,单条生成不超过五秒。之前我贪心,想一次生成八秒甚至更长的片段,结果越往后人物越"散",到第五秒脸就开始漂移。现在我的规则是:一条镜头四到五秒,角色只做一个核心动作,比如"抬头看窗外"或者"把杯子放下",不要同时让她转头加抬手加说话。

每条镜头的提示词我固定成四段结构,复制粘贴式地改:

  • 角色锚定段:写死 "a young woman, red hoodie, shoulder-length black hair, oval face, thin lips",每帧一字不改。
  • 动作段:只写一个动词短语,比如 "she tilts her head slightly to the left",不叠加。
  • 镜头段:锁死机位,"medium close-up, 35mm lens, shallow depth of field, eye-level angle"。
  • 环境段:背景描述保持同一段文字,不要每条换措辞。

这么拆下来,ai视频角色一致性肉眼可见地稳了。以前十条里崩六七条,现在十条里最多崩两条,而且崩的基本都是快速转头的镜头。后来我在特种猫社区看到有人分享了一套参考图工作流,试了之后确实比我自己瞎摸索快不少。

镜头切换时我踩最大的一个坑

最要命的是镜头之间的衔接。我第一集有个从全景推到特写的转场,全景里她站在咖啡馆靠窗的位置,推到特写的时候脸突然变成了一张圆脸,发型也从齐肩变成了长发。我盯着屏幕愣了十几秒,发现问题是全景和特写用了两组不同的参考图,模型在"人"的锚定上打架了。

后来我的办法是:同一个场景里所有角度的镜头,全部用同一张正面定妆照做参考,不再按角度换图。全景镜头在提示词里加 "wide shot, character in the center, full body visible",特写就加 "extreme close-up on face, only eyes and nose visible",但角色描述段和参考图锁死不动。

我后来在特种猫社区发了帖问大家转场怎么处理,有哥们说这本质上是ai视频角色一致性在时间轴上的断裂——两个独立片段之间没有共享上下文,模型每次都在"重新认识"你的角色。他建议镜头间加半秒黑场或模糊过渡,观众注意不到细微偏差,确实管用,比逐帧修图省了至少两小时。

哪些场景它到现在还是不行

说点不好听的:多人同框我还是搞不定。这也是ai视频角色一致性目前最大的短板——单主体能锁,多主体一上来模型就要分配"注意力",谁的描述都写不全,脸就互相污染了。我试过让主角和一个中年男人坐在沙发两边对话,四秒的镜头里两个人的脸在第二秒就开始互相"串",她的颧骨跑到他脸上了,单人对白还行,双人以上我真的放弃生成改用手绘分镜加后期合成。

另一个翻车场景是快速运动。我有一条想让她跑过走廊回头看的镜头,参考图给得再准也没用,模型在运动模糊里根本来不及"记住"她的五官。现在我遇到跑动、转身超过一百八十度的动作,一律拆成"跑"和"回头"两条,中间剪一刀,勉强能看。

还有就是表情变化太大的段落。从平静到崩溃大哭这种跨度,一条五秒的镜头根本承载不了,脸会在第三秒直接"碎"掉。我现在把情绪变化拆成三级——平静、眼眶泛红、流泪,每级一条,剪辑里用节奏感把过渡藏住。

折腾了快一个月,从第一集的脸崩到怀疑人生,到第四集基本能看,最大的体会就是:**ai视频角色一致性这件事,百分之七十靠前期定妆和分镜纪律,百分之三十才靠模型本身。**你现在用哪个工具不重要,重要的是你愿不愿意把每条镜头的角色描述当成合同条款一样锁死。我后面打算试试多集连拍时跨集保持一致性,有进展再回来写。大家平时在角色一致性上有什么土办法,欢迎评论区拍砖,也欢迎去特种猫社区翻翻帖子,里面有一帮同方向在踩坑的同行。

全部回复 0
登录后即可回复参与讨论…去登录 →
相关主题