# AI短剧人物一致性怎么做？跨镜跨集角色一致性完整方法（三层文件事实） - 布咕咕

> 三视图只解决“这个人长什么样”，解决不了“这一镜他穿什么、拿什么、看向哪”。AI 短剧/漫剧的跨镜、跨集角色一致性怎么做：视觉设定与连续性锁、参考图 IMG/PLAN/REF 三种状态、冻结关键帧与视觉依据三层文件事实，让穿帮在出图前就能看出来。

来源：布咕咕 https://www.bugugu.cn/ai-character-consistency/

---

AI 短剧怎么保证跨集、跨镜头角色一致：三视图之外还要做什么

 
 三视图只解决「这个人长什么样」，解决不了「这一镜他穿什么、拿什么、看向哪」。AI 短剧 / 漫剧的跨镜、跨集角色一致性，要拆成三层文件事实来做：身份与造型写进视觉设定并加「连续性锁」，参考图按 IMG-* / PLAN-* / REF-* 三种状态登记，每个镜头先写「冻结关键帧」再回填「视觉依据」。文字约束不能保证生成结果一致，但能让不一致在生成前就被看出来。

 这份文档讲这三层各自锁什么、怎么衔接。它描述的是当前仓库的机制，不生成图片或视频。

 为什么只靠三视图会崩

 三视图（正、侧、背）是身份参考，用来喂 --cref、LoRA 或图生视频的参考槽。但跨镜穿帮多数不是脸变了，是这些变了：服装颜色、伤口位置、手里的东西、湿没湿、门开没开、站在轴线哪一侧。这些在剧情里会变，所以不能锁死在三视图里；又必须在相邻镜头里保持，所以不能每镜随手写。需要一个专门的地方记"哪些可见事实现在必须保持"。

 第一层：视觉设定与连续性锁

 $short-drama-assets 从剧本拆出人物/造型、地点/视图、道具/状态，写成 剧集/<EP>/视觉设定.md。核心区分：

 
 身份：这个人是谁，跨集不变。

 变体：身份不变，但服装、伤势、时段、天气、开合或持有状态改变。"换了件外套"是变体，不是新角色。

 连续性锁：只锁不随剧情改变、且观众看得出不一致的可见事实。锁面用提示词语言写成最小名词短语（例如一枚固定的耳饰、外套的颜色），会变的部分留给状态。

 

 每个出场条目都要落成四种之一：新建、复用、变体、真实未决。含混指代不猜。

 第二层：参考图的三种状态

 $short-drama-image-prompts 写参考图提示词，但仓库明确区分：

 
 标记含义

 IMG-*只是一条提示词，图还没出

 PLAN-*计划由创作者在自己的界面里提供的参考图

 REF-*确实存在于项目里、并且已经检查过的图片

 

 只有 REF-* 才能进入视频提示词的参考槽，每张参考只控制身份、造型、地理、构图或风格中的明确部分，并写出用途。被连续性锁点名的条目，锁面原样出现在参考图提示词正文里，让这张图本身把跨镜事实定住。用户没有手工点名参考图，不等于选择文生视频；缺哪张就列出来，不要静默降级。

 第三层：冻结关键帧和视觉依据

 $short-drama-storyboard 把每镜写成 ## SHOT-...，每镜下有 ### 冻结关键帧提示词（镜头起点那一格能看见的东西），需要时加 ### 收尾关键帧提示词（终点）。规则：

 
 每镜先写"起点 → 唯一动作 → 终点"，说明人物、双手和持物怎样完成本镜的状态转换。

 锁定人物朝向、位置、视线、持物、出入口、屏幕方向和必要状态；上游已有的持续关系投影进本镜起点与终点。

 冻结关键帧只写起点那一瞬间能看见的内容；终点才出现的动作、姿态或道具状态删掉。

 关键帧成稿后，反查这一格画面里需要保持身份、造型或地理的人物、地点和道具，逐项写进"视觉依据"。关键帧正文点名的条目必须出现在视觉依据里；视觉设定里的连续性锁在生效镜头上原样写进关键帧正文，不因"参考图会交代"而省略。

 

 $short-drama-video-prompts 再把分镜逐镜翻译成视频提示词，按目标模型（例如 MiniMax H3）绑定已有的 REF-* 图和本镜起始帧。

 检查点

 $short-drama-review 审查资产、提示词、分镜和冻结关键帧的连续性，只写问题和修订要求，不替创作者改来源文件。生产（$short-drama-produce）只在创作者明确确认后执行，预览不算确认。

 边界

 
 以上都是文本约束。生成模型仍可能出错；这套做法的价值是把"哪些必须一致"写成可检查的事实，让穿帮在出图前可见，而不是承诺零穿帮。

 静态漫剧（关键帧切换加配音）可以跳过视频提示词那一层。

 

 本文方法整理自开源项目 drama-skills（GitHub: zenstory-ai/drama-skills，MIT 许可）的公开文档，在布咕咕的出图/出片实践里做了落地适配。

 动手试试：按这套方法出的角色定妆照、场景板和关键帧， 打开 布咕咕 AI 商品图页 或 AI 视频生成页，浏览器打开即用，无需安装软件。

 常见问题

 为什么有了角色三视图，AI 短剧还是每镜长得不像同一个人？

 因为三视图只固定「这个人长什么样」。跨镜穿帮多数不是脸变了，而是服装颜色、伤口位置、手里的东西、湿没湿、门开没开、站在轴线哪一侧变了。这些在剧情里会变，不能锁死进三视图，又必须在相邻镜头保持，所以需要一个专门记录「哪些可见事实现在必须保持」的地方，也就是连续性锁。

 连续性锁具体锁什么？

 只锁不随剧情改变、且观众看得出不一致的可见事实。锁面用提示词语言写成最小名词短语，例如一枚固定的耳饰、外套的颜色；会变的部分留给状态。每个出场条目都要落成四种之一：新建、复用、变体、真实未决，含混指代不猜。

 IMG、PLAN、REF 三种参考图标记有什么区别？

 IMG-* 只是一条提示词，图还没出；PLAN-* 是计划由创作者在自己的界面里提供的参考图；REF-* 是确实存在于项目里、并且已经检查过的图片。只有 REF-* 才能进入视频提示词的参考槽，每张参考只控制身份、造型、地理、构图或风格中的明确部分，并写出用途。

 这套做法能保证 100% 不穿帮吗？

 不能。以上都是文本约束，生成模型仍可能出错。这套做法的价值是把「哪些必须一致」写成可检查的事实，让穿帮在出图前可见，而不是承诺零穿帮。
