← 返回布咕咕
首页 / 教程 / AI 短剧人物一致性

AI 短剧怎么保证跨集、跨镜头角色一致:三视图之外还要做什么

布咕咕 · 更新于 2026-10-10 · 阅读约 9 分钟
三视图只解决「这个人长什么样」,解决不了「这一镜他穿什么、拿什么、看向哪」。AI 短剧 / 漫剧的跨镜、跨集角色一致性,要拆成三层文件事实来做:身份与造型写进视觉设定并加「连续性锁」,参考图按 IMG-* / PLAN-* / REF-* 三种状态登记,每个镜头先写「冻结关键帧」再回填「视觉依据」。文字约束不能保证生成结果一致,但能让不一致在生成前就被看出来。

这份文档讲这三层各自锁什么、怎么衔接。它描述的是当前仓库的机制,不生成图片或视频。

为什么只靠三视图会崩

三视图(正、侧、背)是身份参考,用来喂 --cref、LoRA 或图生视频的参考槽。但跨镜穿帮多数不是脸变了,是这些变了:服装颜色、伤口位置、手里的东西、湿没湿、门开没开、站在轴线哪一侧。这些在剧情里会变,所以不能锁死在三视图里;又必须在相邻镜头里保持,所以不能每镜随手写。需要一个专门的地方记"哪些可见事实现在必须保持"。

第一层:视觉设定与连续性锁

$short-drama-assets 从剧本拆出人物/造型、地点/视图、道具/状态,写成 剧集/<EP>/视觉设定.md。核心区分:

每个出场条目都要落成四种之一:新建、复用、变体、真实未决。含混指代不猜。

第二层:参考图的三种状态

$short-drama-image-prompts 写参考图提示词,但仓库明确区分:

标记含义
IMG-*只是一条提示词,图还没出
PLAN-*计划由创作者在自己的界面里提供的参考图
REF-*确实存在于项目里、并且已经检查过的图片

只有 REF-* 才能进入视频提示词的参考槽,每张参考只控制身份、造型、地理、构图或风格中的明确部分,并写出用途。被连续性锁点名的条目,锁面原样出现在参考图提示词正文里,让这张图本身把跨镜事实定住。用户没有手工点名参考图,不等于选择文生视频;缺哪张就列出来,不要静默降级。

第三层:冻结关键帧和视觉依据

$short-drama-storyboard 把每镜写成 ## SHOT-...,每镜下有 ### 冻结关键帧提示词(镜头起点那一格能看见的东西),需要时加 ### 收尾关键帧提示词(终点)。规则:

  1. 每镜先写"起点 → 唯一动作 → 终点",说明人物、双手和持物怎样完成本镜的状态转换。
  2. 锁定人物朝向、位置、视线、持物、出入口、屏幕方向和必要状态;上游已有的持续关系投影进本镜起点与终点。
  3. 冻结关键帧只写起点那一瞬间能看见的内容;终点才出现的动作、姿态或道具状态删掉。
  4. 关键帧成稿后,反查这一格画面里需要保持身份、造型或地理的人物、地点和道具,逐项写进"视觉依据"。关键帧正文点名的条目必须出现在视觉依据里;视觉设定里的连续性锁在生效镜头上原样写进关键帧正文,不因"参考图会交代"而省略。

$short-drama-video-prompts 再把分镜逐镜翻译成视频提示词,按目标模型(例如 MiniMax H3)绑定已有的 REF-* 图和本镜起始帧。

检查点

$short-drama-review 审查资产、提示词、分镜和冻结关键帧的连续性,只写问题和修订要求,不替创作者改来源文件。生产($short-drama-produce)只在创作者明确确认后执行,预览不算确认。

边界

本文方法整理自开源项目 drama-skills(GitHub: zenstory-ai/drama-skills,MIT 许可)的公开文档,在布咕咕的出图/出片实践里做了落地适配。

动手试试:按这套方法出的角色定妆照、场景板和关键帧, 打开 布咕咕 AI 商品图页 或 AI 视频生成页,浏览器打开即用,无需安装软件。

常见问题

为什么有了角色三视图,AI 短剧还是每镜长得不像同一个人?

因为三视图只固定「这个人长什么样」。跨镜穿帮多数不是脸变了,而是服装颜色、伤口位置、手里的东西、湿没湿、门开没开、站在轴线哪一侧变了。这些在剧情里会变,不能锁死进三视图,又必须在相邻镜头保持,所以需要一个专门记录「哪些可见事实现在必须保持」的地方,也就是连续性锁。

连续性锁具体锁什么?

只锁不随剧情改变、且观众看得出不一致的可见事实。锁面用提示词语言写成最小名词短语,例如一枚固定的耳饰、外套的颜色;会变的部分留给状态。每个出场条目都要落成四种之一:新建、复用、变体、真实未决,含混指代不猜。

IMG、PLAN、REF 三种参考图标记有什么区别?

IMG-* 只是一条提示词,图还没出;PLAN-* 是计划由创作者在自己的界面里提供的参考图;REF-* 是确实存在于项目里、并且已经检查过的图片。只有 REF-* 才能进入视频提示词的参考槽,每张参考只控制身份、造型、地理、构图或风格中的明确部分,并写出用途。

这套做法能保证 100% 不穿帮吗?

不能。以上都是文本约束,生成模型仍可能出错。这套做法的价值是把「哪些必须一致」写成可检查的事实,让穿帮在出图前可见,而不是承诺零穿帮。