← 返回布咕咕
首页 / 教程中心 / AI 视频提示词与运镜教程

AI 视频提示词与运镜教程:写出电影感的镜头语言

布咕咕教程中心 · 更新于 2026-10-05 · 阅读约 10 分钟
最简答案:AI 视频提示词的结构公式是 [镜头运动] + [方向/速度] + [主体] + [场景] + [光线/风格]。模型对提示词开头的权重更高,所以镜头运动要写在前三句。核心原则三条:一个镜头只写一个运动、说明什么必须保持稳定、给出速度。

一、为什么大多数 AI 视频"看起来像会动的图"

因为大部分人是在描述画面里有什么,而不是描述镜头怎么拍。前者是搜索式的关键词堆叠("美丽的女人 赛博朋克 4k 超写实"),后者才是导演式的镜头语言("缓慢推进 + 均匀速度 + 26 岁女性 + 霓虹小巷 + 高对比侧光")。视频模型是从大量专业拍摄素材里学出来的,你给它镜头语言,它就能调用那部分能力;你给它形容词,它只能猜。

二、提示词结构公式

公式: [镜头运动] + [方向 / 速度] + [主体] + [场景 / 环境] + [光线] + [风格 / 画质] + [稳定性约束] + [时长]
反面示例(搜索式): 一个漂亮的女人在赛博朋克城市里走路,超写实,4k,电影感 → 结果:主体模糊,背景随镜头乱改,画面像在融化。
正面示例(结构式): 缓慢推进(dolly push-in),较慢速度,镜头由远至近对准人物面部; 26 岁女性,黑色风衣,站在霓虹小巷; 高对比侧光,冷色调; 写实电影质感,85mm 镜头,浅景深,4K; 保持面部特征、服装与背景稳定;5s。

三条硬规则:

  1. 镜头运动写在最前面。模型对开头 token 的权重更高,运动写在结尾很容易被忽略。
  2. 一个镜头只写一个运动。不要"固定镜头 + 手持 + 推进"一起写,这是自相矛盾,模型会崩。
  3. 给速度。"镜头移动"等于什么都没说;"5 秒内缓慢推进"才给了节奏。

三、运镜词表(可直接抄)

运镜适用场景风险提示词写法
固定镜头人脸、商品、写实镜头极低锁定镜头,只有主体轻微动作
缓慢推近情绪、悬念、商品特写低缓慢推进,匀速,由远至近
缓慢拉远揭示全貌、结尾中镜头缓慢后拉,逐渐显露完整场景
平移风景、室内、宽场景中镜头缓慢从左向右平移
上摇 / 下摇垂直揭示、建筑中镜头缓慢上摇,显示天空/顶部
跟随行走、动作中高稳定跟随镜头,与主体保持固定距离
环绕商品展示、英雄镜头高镜头围绕主体缓慢环绕约 20 度
手持微晃UGC、纪实感可变手持镜头,自然的轻微抖动,抓拍感
不确定选哪个就用固定镜头或缓慢推近。最安全的运动是"变化最小的那个"——它既能让画面活起来,又不会逼模型去编造它没见过的那一面。

四、景别:控制观众的心理距离

景别视觉感受常用场合
远景交代环境与规模开场、转场
全景人物 + 完整环境动作、走位
中景最自然的观察距离对话、口播
近景拉近情感台词、反应镜头
特写强调细节与情绪关键情绪、商品卖点
微距极致细节材质、纹理展示
低角度仰拍权威、力量感英雄镜头、反派登场
高角度俯拍弱势、全局感受挫场景、交代场面

低角度让人显得强势,高角度让人显得弱势——这是传统电影语言,在 AI 视频里同样生效。景别写清楚,比多写十个形容词有用。

五、光线与风格词

整套内容用同一组调色词,多张图多个片段才会看起来像"同一个作品",而不是随手拼的素材。

六、稳定性:让模型别乱改东西

镜头一动,模型就要去"补"它没见过的那一面——脸的另一侧、商品的背面、房间的角落。这就是画面融化和变形的根源。三个做法:

  1. 明确保护对象。在提示词末尾写「保持面部特征、服装与商品形状完全稳定」,把不能变的东西点名。
  2. 用图生视频代替文生视频。先确认一张满意的画面,再让它动,出片率远高于直接文字描述。
  3. 竖屏少做横向大平移。9:16 更适合推近、上摇、小幅环绕;大幅度横向移动经常把画面拉坏。

七、七个常见错误

  1. 堆叠互相矛盾的运镜。如"固定镜头 + 手持晃动 + 快速推进"。选一个,只用这一个。
  2. 不写速度。"镜头移动"没有信息量,写成"5 秒内匀速慢推"。
  3. 忘记主体锚点。不说镜头要对准谁,模型会自己找它感兴趣的地方。
  4. 运镜写在最后。开头权重最高,运镜必须在最前面。
  5. 主体描述塞太多。超过四五个细节,高速运动镜头容易肢体融合。
  6. 运镜和画幅打架。竖屏上做大横向跟随,风险极高。
  7. 一次要求太多事。多人 + 复杂运镜 + 大幅度动作同时写,几乎必崩。拆成多个镜头。

八、常见问题

AI 视频提示词怎么写?

按「镜头运动 + 方向/速度 + 主体 + 场景 + 光线 + 风格 + 稳定性约束 + 时长」的结构写,镜头运动放在最前面,一个镜头只写一个运动。

运镜词应该放在提示词开头还是结尾?

放开头。模型对前面的内容权重更高,运镜写在结尾很容易被忽略,画面就变成"会动的图"。

为什么我生成的画面总是变形、融化?

通常是镜头运动太激进,模型被迫编造它没见过的侧面。改用固定镜头或缓慢推近、用图生视频、并在提示词里点名要保持稳定的对象。

竖屏 9:16 适合用什么运镜?

优先推近、上摇、小幅环绕和固定镜头;避免大幅度的横向平移与跟随,这类运动在竖屏里最容易把画面拉坏。

一次可以写几个运镜?

新手一个镜头只写一个。进阶可以用"先……然后……"串两到三个节拍,但最多不要超过三个,再多模型就会失去控制。