← 返回布咕咕
AI 视频提示词与运镜教程:写出电影感的镜头语言
布咕咕教程中心 · 更新于 2026-10-05 · 阅读约 10 分钟
最简答案:AI 视频提示词的结构公式是 [镜头运动] + [方向/速度] + [主体] + [场景] + [光线/风格]。模型对提示词开头的权重更高,所以镜头运动要写在前三句。核心原则三条:一个镜头只写一个运动、说明什么必须保持稳定、给出速度。
一、为什么大多数 AI 视频"看起来像会动的图"
因为大部分人是在描述画面里有什么,而不是描述镜头怎么拍。前者是搜索式的关键词堆叠("美丽的女人 赛博朋克 4k 超写实"),后者才是导演式的镜头语言("缓慢推进 + 均匀速度 + 26 岁女性 + 霓虹小巷 + 高对比侧光")。视频模型是从大量专业拍摄素材里学出来的,你给它镜头语言,它就能调用那部分能力;你给它形容词,它只能猜。
二、提示词结构公式
公式:
[镜头运动] + [方向 / 速度] + [主体] + [场景 / 环境] + [光线] + [风格 / 画质] + [稳定性约束] + [时长]
反面示例(搜索式):
一个漂亮的女人在赛博朋克城市里走路,超写实,4k,电影感
→ 结果:主体模糊,背景随镜头乱改,画面像在融化。
正面示例(结构式):
缓慢推进(dolly push-in),较慢速度,镜头由远至近对准人物面部;
26 岁女性,黑色风衣,站在霓虹小巷;
高对比侧光,冷色调;
写实电影质感,85mm 镜头,浅景深,4K;
保持面部特征、服装与背景稳定;5s。
三条硬规则:
- 镜头运动写在最前面。模型对开头 token 的权重更高,运动写在结尾很容易被忽略。
- 一个镜头只写一个运动。不要"固定镜头 + 手持 + 推进"一起写,这是自相矛盾,模型会崩。
- 给速度。"镜头移动"等于什么都没说;"5 秒内缓慢推进"才给了节奏。
三、运镜词表(可直接抄)
| 运镜 | 适用场景 | 风险 | 提示词写法 |
| 固定镜头 | 人脸、商品、写实镜头 | 极低 | 锁定镜头,只有主体轻微动作 |
| 缓慢推近 | 情绪、悬念、商品特写 | 低 | 缓慢推进,匀速,由远至近 |
| 缓慢拉远 | 揭示全貌、结尾 | 中 | 镜头缓慢后拉,逐渐显露完整场景 |
| 平移 | 风景、室内、宽场景 | 中 | 镜头缓慢从左向右平移 |
| 上摇 / 下摇 | 垂直揭示、建筑 | 中 | 镜头缓慢上摇,显示天空/顶部 |
| 跟随 | 行走、动作 | 中高 | 稳定跟随镜头,与主体保持固定距离 |
| 环绕 | 商品展示、英雄镜头 | 高 | 镜头围绕主体缓慢环绕约 20 度 |
| 手持微晃 | UGC、纪实感 | 可变 | 手持镜头,自然的轻微抖动,抓拍感 |
不确定选哪个就用固定镜头或缓慢推近。最安全的运动是"变化最小的那个"——它既能让画面活起来,又不会逼模型去编造它没见过的那一面。
四、景别:控制观众的心理距离
| 景别 | 视觉感受 | 常用场合 |
| 远景 | 交代环境与规模 | 开场、转场 |
| 全景 | 人物 + 完整环境 | 动作、走位 |
| 中景 | 最自然的观察距离 | 对话、口播 |
| 近景 | 拉近情感 | 台词、反应镜头 |
| 特写 | 强调细节与情绪 | 关键情绪、商品卖点 |
| 微距 | 极致细节 | 材质、纹理展示 |
| 低角度仰拍 | 权威、力量感 | 英雄镜头、反派登场 |
| 高角度俯拍 | 弱势、全局感 | 受挫场景、交代场面 |
低角度让人显得强势,高角度让人显得弱势——这是传统电影语言,在 AI 视频里同样生效。景别写清楚,比多写十个形容词有用。
五、光线与风格词
- 光线方向:左侧自然窗光 / 侧逆光 / 顶光 / 伦勃朗光 / 黄金时刻逆光。
- 光线质感:柔和漫射 / 高对比硬光 / 霓虹冷调 / 暖色钨丝灯。
- 镜头语言:85mm 镜头 / 35mm 广角 / 浅景深 / 大光圈虚化。
- 整体调色:青橙对比(teal & orange)/ 胶片颗粒 / 黑色电影 / 低饱和日系。
- 画质词:4K / 高细节 / 商业广告质感。
整套内容用同一组调色词,多张图多个片段才会看起来像"同一个作品",而不是随手拼的素材。
六、稳定性:让模型别乱改东西
镜头一动,模型就要去"补"它没见过的那一面——脸的另一侧、商品的背面、房间的角落。这就是画面融化和变形的根源。三个做法:
- 明确保护对象。在提示词末尾写「保持面部特征、服装与商品形状完全稳定」,把不能变的东西点名。
- 用图生视频代替文生视频。先确认一张满意的画面,再让它动,出片率远高于直接文字描述。
- 竖屏少做横向大平移。9:16 更适合推近、上摇、小幅环绕;大幅度横向移动经常把画面拉坏。
七、七个常见错误
- 堆叠互相矛盾的运镜。如"固定镜头 + 手持晃动 + 快速推进"。选一个,只用这一个。
- 不写速度。"镜头移动"没有信息量,写成"5 秒内匀速慢推"。
- 忘记主体锚点。不说镜头要对准谁,模型会自己找它感兴趣的地方。
- 运镜写在最后。开头权重最高,运镜必须在最前面。
- 主体描述塞太多。超过四五个细节,高速运动镜头容易肢体融合。
- 运镜和画幅打架。竖屏上做大横向跟随,风险极高。
- 一次要求太多事。多人 + 复杂运镜 + 大幅度动作同时写,几乎必崩。拆成多个镜头。
八、常见问题
AI 视频提示词怎么写?
按「镜头运动 + 方向/速度 + 主体 + 场景 + 光线 + 风格 + 稳定性约束 + 时长」的结构写,镜头运动放在最前面,一个镜头只写一个运动。
运镜词应该放在提示词开头还是结尾?
放开头。模型对前面的内容权重更高,运镜写在结尾很容易被忽略,画面就变成"会动的图"。
为什么我生成的画面总是变形、融化?
通常是镜头运动太激进,模型被迫编造它没见过的侧面。改用固定镜头或缓慢推近、用图生视频、并在提示词里点名要保持稳定的对象。
竖屏 9:16 适合用什么运镜?
优先推近、上摇、小幅环绕和固定镜头;避免大幅度的横向平移与跟随,这类运动在竖屏里最容易把画面拉坏。
一次可以写几个运镜?
新手一个镜头只写一个。进阶可以用"先……然后……"串两到三个节拍,但最多不要超过三个,再多模型就会失去控制。