帧节拍FRAMEBEAT
进阶教程

人物一致性实战:三视图 + 声纹锁定,让角色 32 个镜头不换脸

同样的角色,第 1 镜和第 20 镜判若两人?四个可落地的方法,从资产、提示词、声音到回炉机制一次讲透

2026-08-049 分钟读完人物一致性AI角色资产Seedance 2.0AI视频教程

你会学到什么

四个可直接落地的人物一致性方法:三视图资产、每镜重申约束、声纹锁定、抽帧回炉。全文以《外星人要接我走》复刻项目的 32 个真实镜头为例。

做 AI 视频最劝退的瞬间:第 1 个镜头里还是那张脸,第 20 个镜头突然变成了另一个人。观众一眼出戏,整条片子的努力全部作废。人物一致性不是靠运气抽卡,而是一套可以复制的工程方法。

为什么 AI 视频总「换脸」

  • 没有固定参照:模型每个镜头都在「重新想象」这个角色,而不是「还原」这个角色。
  • 提示词漂移:镜头之间的描述措辞不一致,模型理解为不同的人。
  • 相似角色互相污染:两个外形接近的角色(比如两个外星人)在多人镜头里交换特征。

方法一:三视图资产,给角色一个「身份证」

一致性的一切前提,是每个角色都有一份固定的参考图。正面、侧面、背面三视图是最低配置——模型在生成任何角度时都有据可依,不需要即兴发挥。

《外星人要接我走》复刻项目的角色三视图:三个角色各一份,全片 32 个镜头固定引用
  • 三视图只保留角色本体:纯色背景、无道具、无场景,避免模型把背景学进去。
  • 相似角色必须分开生成、分开保存,绝不能共用一张参考图。
  • 参考图一旦定稿就不要中途更换,换图等于换人。

方法二:每个镜头重申「位置 + 禁止项」

模型不会「记住」上一个镜头。一致性不是靠模型记住,而是靠你在每一个镜头里把关键约束重新写一遍——谁在左、谁在右、谁说话,以及明确禁止什么。

可直接复制 · 每镜重申模板
人物:___固定位于画面左侧;___固定位于画面右侧,不得交换左右位置。
外貌:严格保持参考图中的人物外貌、服装与体型,禁止换脸、禁止改变发型与服装。
台词:只有___张嘴说话,其他人物全程闭嘴。

禁止:人物交换位置、多人同时张嘴、外貌漂移、服装变化。
  • 位置写死:用「固定位于画面左侧」而不是「站在左边」,措辞越强硬,模型越听话。
  • 禁止项写全:换脸、交换位置、同时张嘴,这三条是多人镜头的保命符。
  • 措辞统一:全片对同一个角色使用同一个称呼,不要一会儿「老人」一会儿「大爷」。

方法三:声纹锁定,别让声音「换演员」

脸没换、声音变了,同样出戏。只写「老人口音」这种文字描述,模型每次都会重新配一个声音。正确做法是使用固定的参考音频(声纹),并在提示词里声明锁定。

声纹锁定后的对白片段:老人与主外星人在旧屋签约,两个声音全程稳定
可直接复制 · 声纹锁定提示词
优先锁定人物口音、音色、音高、共鸣位置、咬字习惯、语速、停顿和句尾处理。
始终使用同一份参考音频和同一个声音设置,不得根据人物年龄重新生成通用声音。
准确口型同步,嘴部动作自然,人物说话时头部和身体不要频繁晃动。

方法四:抽帧回炉机制

即使前面三步都做了,个别镜头还是会翻车。不要等到剪辑时才发现——每生成一个镜头,立刻抽帧与参考图对比,不合格就只重做这一镜。

逐镜抽帧检查:脸、服装、左右位置、道具四项对照参考图
  • 脸:与三视图对比,五官和皱纹位置一致
  • 服装:颜色、款式、脏旧程度没有变化
  • 位置:多人镜头左右关系与原片一致
  • 道具:关键道具没有变形或消失
  • 声音:音色与参考音频一致,口型同步

口诀

三视图定脸、每镜重申定位、声纹锁音、抽帧回炉。哪个镜头不对,只重生成那个镜头。

这套方法在《外星人要接我走》的 32 个镜头里全程验证过:三个角色全片零换脸、零交换位置。想拿到文中同款三视图、声纹和逐镜提示词,可以直接去复刻项目页下载素材包对照练习。