CHARACTER CONSISTENCY

AI漫剧人物总变脸怎么办?先把角色变成可复用资产

同一个角色换个镜头就变脸、换装后像换人、两个人同框时五官互相污染,往往不是再加一句“保持一致”就能解决。稳定的做法,是先固定角色身份,再分别管理服装版本、镜头变化和剧情状态,让每次生成都从同一份人物资产出发。

发布于 2026-08-23 · 深度更新于 2026-09-02 · 适合:跨镜头变脸、多人串脸、换装漂移和视频阶段人物失真

先判断:到底是哪一种“不一致”

人物一致性不只是一张脸。返工前先把问题分开,否则容易改了发型又丢掉衣服,修了服装又改变年龄感。

第一步:建立最小角色资产卡

角色卡不是人物小传,也不是把性格和世界观全部塞进提示词。它只保存能够在画面中识别这个人的信息:

身份代号:使用不会重复的名称,例如“阿绫-A01”,避免只写“女主”“少女”。

稳定外观:年龄感、脸型、眉眼特征、鼻唇关系、肤色、发型、体型和一个标志性细节。

基础服装:上装、下装、鞋、主色、辅色、材质和固定饰品。

比例关系:全身高度、头身感觉,以及与主要对手角色的身高差。

禁止变化:不能增加的耳饰、不能改变的发色、不能消失的疤痕或道具。

核心描述要短而稳定。动作、表情、景别和场景放在本镜变量中,不要混进永久角色卡。若每一镜都重新改写同一人物,模型接收到的身份也会持续变化。

第二步:选主参考,不要堆很多“差不多”的图

  1. 先选一张五官、发型、服装都最准确的主参考,作为身份基准。
  2. 需要侧面或全身信息时,再补与主参考同画风、同服装版本的辅助图。
  3. 移出脸型不同、妆容不同或光线极端的候选图,它们会给模型多个竞争答案。
  4. 按“角色代号—服装版本—角度”命名,避免生成到第十镜时拿错素材。

一张清楚、身份明确的主参考,通常比多张相互矛盾的图片更容易管理。正式生成前可先看AI漫剧提示词四层写法,把人物身份与镜头动作分开。

第三步:换装建立新版本,别临场改衣服

换装后变脸,是因为同一次生成同时承担了保留身份、改变服装、改变场景和完成动作。先单独制作“阿绫-A01-夜行装V2”,确认脸和体型仍与基础版一致,再把V2作为后续镜头参考。身份代号不变,服装版本独立变化。

剧情中的伤痕、湿发、破损衣服也要记录状态。例如第12镜衣袖被划破,第13镜继续使用“衣袖破损V3”,而不是回到完好服装。这样管理的不只是长相,也是剧情连续性。

第四步:多人同框先分配位置,再写互动

多人串脸常见于两个人物描述太像,或文字、参考图和站位没有一一对应。可以使用“身份槽位”:

角色A/画面左侧:阿绫-A01,黑色低马尾,左眼下小痣,深蓝短外套,右手持折扇。

角色B/画面右侧:顾川-B01,短银发,狭长眼,灰白长袍,双手空置。

互动:A把折扇递向B,B先看折扇再看A;两人不交换左右位置,折扇始终属于A。

先分别完成两人的单人定妆和简单半身镜头,再进入双人复杂动作。若两人同为黑发、同龄、同色服装,就增加真正可见的区分点。左右关系、视线对象和道具归属还要与AI漫剧分镜表一致。

第五步:从简单镜头建立“通过样本”

不要一开始就测试奔跑、打斗、背身转头和多人拥抱。先生成正面中景、侧面半身、全身站姿和一个常用表情,身份稳定后再逐步增加动作难度。每通过一个关键角度,就把它加入角色资产,而不是只保存最好看的正脸。

这一步能尽早暴露边界:正脸稳定但侧脸漂移,说明侧面信息不足;静态图稳定而大幅运动变形,说明动作需要拆镜;单人稳定而双人串脸,说明身份槽位和视觉区分不够。

第六步:图片合格后再进入图生视频

视频模型会在时间中补全动作。首帧已经错脸、手指遮脸、服装结构含糊时,运动只会放大问题。进入视频前检查:

逐镜一致性检查表

□ 脸型、眉眼、发型和年龄感与主参考一致。

□ 当前服装版本正确,固定饰品没有消失或复制。

□ 多人左右、前后、身高和视线关系符合分镜。

□ 道具由正确角色持有,损坏状态承接上一镜。

□ 场景画风、光源方向和人物材质没有突然改变。

□ 视频运动中没有短暂换脸、身体融合或服装闪变。

□ 每轮只改一个明确问题,并保留修改前版本用于对照。

三个常见失败怎么修

同一人物每一镜都像不同演员

暂停继续生成,回到主参考和最小角色卡。删掉冲突描述,先通过正面与侧面基础镜头,再恢复剧情镜头。不要用更多抽象形容词掩盖身份不清。

两个人同框后五官互相交换

检查两个人物是否有可见区分点,再固定左右站位、参考图顺序和角色编号。把拥抱、打斗等大面积交叉动作拆成接近、接触、反馈三个镜头。

图片里稳定,视频一动就变脸

减少头部快速旋转、遮脸和大幅环绕,把复杂动作拆短。若任务状态、播放或素材本身异常,应按视频生成排错清单检查,不要把接口故障误认为角色设定问题。

常见问题

固定随机种子就能保证人物一致吗?

它只能作为部分流程中的辅助变量。镜头角度、场景、动作和参考素材改变后,仍要依靠稳定角色资产与逐镜检查。

角色描述是不是越长越稳定?

不是。决定身份的可见特征应稳定复用;与当前镜头无关的经历、性格和重复形容词会稀释重点。角色卡负责“是谁”,分镜和提示词负责“这一镜做什么”。

发现一帧变脸,需要整段重做吗?

先判断错误发生在首帧、动作过程还是尾帧。局部问题优先重做当前镜头;若主参考含糊或角色卡持续变化,就先修资产源头,否则后面的镜头还会重复出错。