首页指南 › AI 短剧角色一致性怎么做:跨集不变脸的四层方法

AI 短剧角色一致性怎么做:跨集不变脸的四层方法

跨集变脸不是「模型不行」,多数是参考链路断了。稳定的做法有四层:① 解析层把外貌写成可还原的具体特征(脸型/眉眼/鼻唇/肤色/发型/体型/年龄感 + 一个锚点,不写「英俊」「漂亮」);② 定妆照白底正面中性光、鞋只看得到侧面(防俯拍);③ 每一段视频生成都把该角色的全身照与脸部裁切作为参考图送入模型;④ 分镜层写清「谁在画面里」并只正向枚举,不点名出画的人。四层缺一层,一致性就掉一档。

第一层:外貌描写要能被图像模型「读回来」

「30 岁左右、气质冷峭的男人」无法还原;「窄长脸、眉峭而直、内双眼、鼻梁高挺、薄唇、冷白皮、黑短发向后梳、身高 1.85 米偏瘦、左眉尾一道 1 厘米旧疤」可以。记忆点只能是静态特征(疤、痣、饰品、发型),不能是表情——写「笑起来眼睛先弯」定妆照就会咧嘴笑,然后每一段开场都在笑。

也不要写站姿与步态:全身照里「上身前倾」等于「头近脚远」,成片就是俯拍。

第二层:定妆照的六条硬约束

  • 纯白背景(独立条款 + 负面清单双写,埋在别的段落里会被突破)
  • 正面全身、镜轴水平、相机架在人物身高一半处
  • 方向主光 + 补光 + 轮廓光,禁平光(平光 = 塑料脸)
  • 脸 > 体态 > 服装的优先级,禁止为展示服装拉远景别
  • 中性表情,不做「电影感」调色
  • 9:16 竖版,2K 级分辨率(便于脸部裁切当第二参考图)

第三层:参考图注入

视频生成时至少送两张:全身定妆照 + 脸部裁切图;多人同框时每人一张,场景空景一张。注意各模型上限:MiniMax H3 参考图 ≤9 张、超 5 张按张加价;通义万相参考素材免费。首帧图与参考图在部分模型上互斥——要连续性就要放弃角色参考图,这是跨段站位漂移的机制性原因,只能在分镜层用场景锚点缓解。

第四层:分镜层的承接纪律

  • 只正向写「画面里有谁」;不要写「其余人出画」——点名反而提高乱入概率。
  • 上一段已完成的动作在下一段写成既成状态,不重演。
  • 剧情临时可见状态(受伤、换装、道具被改变)逐段复述,布景行不写裸名词。
  • 位置用场景锚点(「贴着窗边最后一排桌子」)而不是画框方位(「画面左」),机位一换方位就失效。

常见问题

为什么同一张参考图,不同模型还原度差很多?

各模型对参考图的权重不同,且对中文形制词(马面裙、盘领袍)的理解差异大。古装题材建议优先中文母语图像模型出设定图。

能靠后期换脸补救吗?

可以做局部补救,但成本高于在设定图阶段做对;且换脸对侧脸、遮挡、多人同框效果差。

多形象角色(换装、成长)怎么处理?

为同一角色维护多张定妆照(looks),按集绑定;面部特征描述保持同一份,只换服装与发型段。