← 返回布咕咕
首页 / 教程 / AI 短剧全流程

AI 短剧 / 漫剧怎么做:从点子到成片的 9 步全流程

布咕咕 · 更新于 2026-10-10 · 阅读约 13 分钟
目标是把创作时间花在剧情、视觉选择和提示词上,而不是维护流水线文件。每集按需维护最多五份 Markdown——剧本、视觉设定、分镜、图片提示词、视频提示词——并直接以它们作为创作事实;先预览、明确确认,再生产。

目标是把创作时间花在剧情、视觉选择和提示词上,而不是维护流水线文件。每集按需维护最多五份 Markdown,并直接以它们作为创作事实。

一眼看懂

点子 / 原著 / 现成剧本 │ ├─ 原著分析、故事开发(都可选) ▼ 剧本.md ▼ 视觉设定.md ├──────────────┐ ▼ ▼ 图片提示词.md 分镜.md ▼ 视频提示词.md(动态漫剧) │ └─ 静态漫剧:关键帧切换 + 配音,可跳过 └──────────────┬──────────────┘ ▼ 预览 → 明确确认 → 生产 ▼ 剪辑单.md → render 成片(视频段 / 关键帧 + 配音)

默认位置是现有工具已识别的 剧集/<EP>/:

  1. 剧本.md
  2. 视觉设定.md
  3. 分镜.md
  4. 图片提示词.md
  5. 视频提示词.md

一次请求只创建它需要的文档,不预建空文件。场次、资产组和镜头组是内部批次,自动续跑;不要在 每批后等待“继续”,也不要落盘 JSON/JSONL、索引、指纹、覆盖表、QA、审核表或交接胶囊。

0. 原著分析与故事开发(可选)

有长篇原著、需要判断改编价值时才用 $short-drama-novel-analyze;需要系列承诺、改编契约或分集 地图时才用 $short-drama-develop。手上已经有可写的单集点子、提纲或剧本,直接进入写作,不为 完整流程倒补这两步。

1. 初始化(按需)

需要项目级语言、画幅、时长或生产配置时:

用 $short-drama 初始化一个都市逆袭竖屏漫剧项目,9:16

初始化不生成故事内容。制作形态、视觉方向或 Look Development 只有确实会约束多个阶段时才决定; Look Development 是可选分支,不是写提示词或做分镜的门槛。

2. 写 剧本.md

用 $short-drama-write 写完 EP001:外卖员在高档餐厅被经理羞辱,亮出集团董事身份

整集请求一次完成整集。先在上下文排因果节拍,再把场景、动作、对白、画外音和必要声音事实写进 唯一剧本;不另建 episode card、beats、block index 或录音表。剧本要可表演、可拍摄,每场改变 信息、权力、关系、情绪、物理状态或风险。

3. 写 视觉设定.md

用 $short-drama-assets 从 EP001 拆完人物、造型、地点、道具和本集状态

只保存后续生成需要保持的视觉事实。先判断身份是否相同,再决定复用、新建或变体;服装、伤势、 天气、光态、开合与持有通常是变体,姿势、视线和站位通常属于分镜瞬态。不要把每次出场、判断过程 和连续性检查分别写成账本。

4. 写 图片提示词.md

用 $short-drama-image-prompts 为 EP001 的角色、地点和关键道具写可直接复制的图片提示词

每项说明用途、稳定锚点、当前变体、构图/视角、光色/材质、参考边界和禁止项,再给一段可直接复制 的正文。图片提示词与分镜是兄弟分支;有视觉事实就能开始,不互相等待。

5. 写 分镜.md

用 $short-drama-storyboard 完成 EP001 的正式分镜和每镜冻结关键帧

先确认原文如何被镜头落实,再逐镜写职责、来源场景、景别/机位、时长、空间与资产绑定、 起点 → 唯一动作 → 终点 和声音职责。默认每镜在同一条目下写一个冻结关键帧提示词。 只有关键场次真有多个成立导演方案时,才在上下文比较方案;不为普通场次生成 audition、coverage 或 scene-plan 文件。

关键帧写完之后再回填三条依据,读的是成稿画面而不是镜头意图:必写的「视觉依据」列出这一格里需要 认出身份、造型或地理的人物、地点和道具,「图片提示词项」写已有的 IMG-...,「输入参考图」写项目里 找得到的真实图片并逐张标 用途。

6. 写 视频提示词.md

用 $short-drama-video-prompts 把 EP001 的分镜逐镜写成可直接复制的视频提示词

每条从已确认起始帧出发,逐项实现分镜的 起点 → 唯一动作 → 终点:触发、接触、落点、次级反应、 运镜、声音和可验证终点。不要重复静帧已经锁定的外观,不要跨到下一镜。连续段选择从上一段生成 结果续接时,第二段起同时使用上一段实际视频和从该视频取得的实际尾帧。用户明确要求时间线音乐时,把音乐意图作为 同一文档独立章节;歌词只能使用用户提供或明确接受的文本。只做“关键帧切换 + 配音”的静态漫剧时, 本步可以跳过,分镜关键帧与图片提示词直接进入生产预览,成片按第 8 步的静态路线装配。

7. 生产:唯一固定门禁

用 $short-drama-produce 预览 EP001 的这批图片/视频任务;等我确认后再执行

每个生产 job 必须按顺序走:

  1. 从当前提示词建立有边界的临时 job,source 指向所属 Markdown,输出放入 剧集/<EP>/制作成果/;
  2. prepare 并展示数量、正文、参考、参数、输出和 adapter;
  3. 用户看过这份预览后明确确认;
  4. run 才调用外部 adapter。

内容、输入、参数或输出变化都要重新预览和确认;失败重试也需要新确认。生产工具的隐藏 job、确认 和审计记录是付费副作用所需运行状态,不是创作内容。

8. 剪辑成片

用 $short-drama-edit 把 EP001 已生产的镜头剪成成片

动态漫剧从生成的视频里选入出点。静态漫剧这样装配:

  1. 生产分镜的冻结关键帧,逐张看过后接受;
  2. 用 $short-drama-produce 的 tts 模态按《剧本.md》逐句生成配音,同样先预览、确认再执行;
  3. 写《剪辑单.md》:每镜一段,来源 写 SHOT-... 和它的关键帧,按配音长度定 时长,

写 运镜、配音 与同时间的 字幕,需要时加 画面文字 和 音效;

  1. check 通过后 render,再 verify。

写法和每一镜的下落规则见静帧段。 视频与静帧可以混剪,但只在创作者选了静帧时,见什么时候用。

9. 审查与交付(按需)

用户点名审查时才调用 $short-drama-review。审查结论写入 审查/<EP>-审查.md,用场景、镜头和 提示词的可见 ID 指向问题;明确问题直接修正文档,不为普通创作新增 QA 回合。交付时直接复制或 归档用户点名的当前文档和成品,并排除私有输入、凭据和生产工具的隐藏运行状态。

常见卡点

卡点处理方式
漫剧人物好看但每镜不像同一个人回到 视觉设定.md 收紧可见识别锚点;分镜可引用同一 IMG-... 提示词条目来对齐意图,但只有生产 job 的 references 实际传入同一图片文件时才共享像素依据
二维画面有风格、没叙事重心使用漫剧关键帧视觉词表,先锁主体事实和注意中心,再投影画风
分镜遗漏原文或重复同一动作按场景逐条检查对白、动作、声音和画面文字的镜头承载,直接拆镜、并镜或修正文档
关键帧写了某个角色,视觉依据里却没有他这是 #84/#94 报告的缺陷。按成稿关键帧回填「视觉依据」;提示词正文用非中文点名时,给《视觉设定.md》条目补 画面代称,creator_markdown_check.py 就能抓到被点名的漏项。只描述不点名的角色抓不到,靠必写字段和审查 rubric 兜底
指定了目标视频模型,却收到文生视频提示词点名模型不等于选择文生视频。先把模型写进 production_profile,再让分镜按可见人物/地点/道具/起始帧找项目里已有的图并绑成带 用途 的 REF-...;仍缺图就列表停下,不改成文生
在网页界面里自己出图,被要求先在套件里生成参考图图片不进项目也能拿到图生视频提示词:让分镜把这一镜要挂的图写成 PLAN-... 槽位,定位符用 IMG-... 板子或本镜 SHOT-... 冻结关键帧,顺序 就是挂图次序。视频提示词照常产出,只是这些镜头不能转生产技能
分镜改了确认过的剧本每镜「来源」必须解析到《剧本.md》真实场景,剧本里每个场景都要有镜头承载或写进《分镜.md》的「未拍场次」并给出理由;可复制正文里的中文引文要能在剧本里逐字找到。creator_markdown_check.py 会核对这三条
起始帧提前出现动作结果冻结关键帧只保留镜头起点,把动作变化和终点交给视频提示词
提示词语言混用图片与关键帧跟随 format.prompt_language;视频优先跟随目标模型档案的 video_prompt_language,口语语言仍按剧本
静态漫剧被迫补视频运动提示词关键帧切换加配音可以直接预览生产,不为流程完整性补造无用文档
准备投产但任务边界不清先让 $short-drama-produce 展示数量、正文、参考、参数、输出和 adapter,再明确确认

什么时候停

普通创作只在三处停:用户点名范围完成;缺失事实形成会显著改变结果的真实创作分叉;即将调用 外部生产。其余批次自动继续。最终回报完成范围、关键创作决定、真实未决项和可选下一步,不汇报 内部流水线噪音。

本文方法整理自开源项目 drama-skills(GitHub: zenstory-ai/drama-skills,MIT 许可)的公开文档,在布咕咕的出图/出片实践里做了落地适配。

动手试试:流程里要生成的图片、关键帧和视频段, 打开 布咕咕 AI 商品图页 或 AI 视频生成页,浏览器打开即用,无需安装软件。

常见问题

静态漫剧(关键帧切换 + 配音)也要写视频提示词吗?

不用。分镜关键帧与图片提示词直接进入生产预览,跳过视频提示词那一层,不为流程完整性补造无用文档,成片按关键帧 + 配音的静态路线装配。

做 AI 短剧需要 GPU 或自己部署模型吗?生成媒体的钱从哪出?

不需要 GPU。写作、分镜和提示词由你正在用的编程 Agent 模型完成,本地只跑确定性的检查脚本;生成媒体走外部生产接口,用你自己配置的供应商凭据、按供应商计费,每个任务预览并明确确认后才执行。剪辑成片需要本机有 ffmpeg / ffprobe。

指定了目标视频模型,为什么收到的是文生视频提示词?

点名模型不等于选择文生视频。先把模型写进项目生产配置,再让分镜按可见人物、地点、道具和起始帧去项目里找已有的图,绑成带用途的参考槽;仍缺图就列表停下,不改成文生视频。

AI 短剧里对白赶读或被截断怎么办?

分镜阶段先估对白时长再定镜长:中文小样本约 4.1 个可发声字/秒,较密的输入会赶词或静默截断。分镜把估时依据写在本镜「声音」里,放不下就延长镜头或拆镜;视频提示词只能原样照抄已接受的时长。