分镜头脚本怎么写?
七个字段,一张能直接抄的表
很多人卡在分镜,不是因为不会写,而是因为不知道该填什么。 这篇文章把分镜头脚本拆到字段级别:每个格子填什么、为什么非填不可、常见错误长什么样; 再给一张填好示范内容的分镜表模板,抄走就能用。
5 张表,含可直接抄用的模板 字段级拆解,不讲空话 最后更新 2026-09-26
分镜头脚本不是「写得更细的剧本」,它是给执行环节看的施工图。
剧本回答「讲什么故事」,分镜回答「先拍什么、从哪拍、拍多久」。 判断一份分镜能不能用,只看一件事:换一个人拿着它去执行,能不能做出和你脑子里一样的画面。 做不到,通常是七个字段里有格子空着。
分镜头脚本是什么
先把定义说清楚,后面所有内容都建立在这上面:
分镜头脚本,是把一段文字内容切成一个个镜头,并逐镜写清「拍什么、怎么拍、拍多久」的表格化文档。 它上承剧本,下接拍摄或生成,是整条片子的中间层。
它和文学剧本的差别,不是「详细程度」,而是服务对象不同。 剧本写给读者看,分镜写给执行的人看 —— 在 AI 视频里,「执行的人」就是你自己加你手上的工具。
| 对比项 | 文学剧本 | 分镜头脚本 |
|---|---|---|
| 回答的问题 | 讲了一个什么故事 | 先拍什么、从哪拍、拍多久 |
| 写作单位 | 场次、段落 | 镜头(一个镜头一行) |
| 主要读者 | 读者、演员、投资人 | 拍摄或生成环节的执行者 |
| 情绪怎么表达 | 可以用描写、对白、旁白铺陈 | 只能靠景别、表演动作和时长来体现 |
| 能不能直接执行 | 不能,中间还需要一次转译 | 能,按行执行即可 |
| 改动成本 | 改一句台词影响有限 | 改一处,下游画面与配音都要跟着动 |
还有一个常见疑问:分镜头脚本和故事板是一回事吗?不是。 分镜以文字和表格为主,故事板以画稿为主。实际项目里通常先出分镜表定结构, 再挑重点镜头画故事板。做 AI 视频时,分镜表更关键 —— 它是画面生成时的直接输入。
分镜头脚本格式:七个字段逐个拆
格式这件事没有强制标准,但字段是通用的那七个。 下面这张表把每个字段说透:填什么、为什么要填、常见错误长什么样。 写分镜的时候对着它逐行检查,比看十篇教程都有用。
| 字段 | 填什么 | 为什么要填 | 常见错误 |
|---|---|---|---|
| 镜号 | 场次加序号,例如 S03-07,表示第 3 场第 7 镜;同一场戏内连续编号 | 它是整张表的坐标。改片、补镜、和素材对号,全靠这个编号,讨论时不用再靠描述 | 用「开头那个」「后面那个」代替编号;中途插镜改成小数,后面对不上 |
| 景别 | 远景、全景、中景、近景、特写,标清主体在画面里占多大 | 景别决定观众和人物的距离。同一个动作,远景是看环境,特写是看情绪 —— 这是叙事选择 | 整场戏全是中景,不难看,但也没有重点 |
| 运镜 | 固定,或推、拉、摇、移、跟,并写清方向与幅度,例如「缓慢推近」 | 运镜决定这个镜头的呼吸。只写「推」不写幅度,执行时可能变成猛推,情绪完全不同 | 每个镜头都写运镜。固定镜头也是一种选择,而且是最稳的一种 |
| 画面内容 | 谁、在哪、做什么、画面里还有什么。只写看得见的东西 | 这是生成画面时唯一的依据。写「他很失落」生成不出来,写「他坐在楼梯上低着头」可以 | 写情绪不写动作;一个镜头里塞进两个时空 |
| 台词 | 这一镜里说出口的话,写全,不要写「此处省略」 | 台词长度直接决定镜头时长,也决定后面配音的节奏;写在画面同一行,改的时候才知道影响范围 | 台词长得塞不进一个镜头,只能硬拆;或者干脆留空,到配音时才发现对不上 |
| 音效 | 环境声加动作声,需要时再标音乐进出的大致位置 | 声音是最容易被跳过的一列,也最容易让画面「变真」——空镜头配上环境声就不再是废镜头 | 整列空着;或者把音乐当音效,从第一个镜头铺到最后一个 |
| 时长 | 单个镜头的估算时长,全片加起来要能对上成片长度 | 时长是节奏的量化。写不出具体数字,往往说明这场戏的节奏你还没想清楚 | 用平均值糊过去,每镜都写同样的数,成片就会平得像流水账 |
两个最容易糊弄过去的字段:音效与时长
镜号、景别、画面内容大家都会填,因为看得见。真正拉开差距的是音效和时长这两列 —— 它们不影响画面生成,所以最容易被留白,然后在剪辑阶段集中爆雷: 镜头长度和台词对不上,或者整场戏安静得不像真的。
- 音效先写环境声。这一场在哪?办公室有空调声,街道有车流声,深夜的房间几乎是安静的 —— 写下来,画面就落地了。
- 时长按「这句话说完要几秒」估。先估台词,再估动作,最后补留白。全加起来超出成片长度,就要回头砍镜头,而不是硬压时长。
- 不要把所有镜头写成同一个数。节奏感来自长短交替:三个短镜头接一个长镜头,观众才有呼吸。
分镜头脚本模板:一张可以直接抄走的表
下面是一张填好示范内容的分镜表。字段就是前面那七个, 你可以把列保留、行换掉,直接当成自己的模板用。
| 镜号 | 景别 | 运镜 | 画面内容 | 台词 | 音效 | 时长 |
|---|---|---|---|---|---|---|
| S01-01 | 全景 | 固定 | 深夜办公室,只有主角工位一盏灯亮着,窗外城市灯光虚成一片 | 无 | 空调低频声、断续键盘声 | 3s |
| S01-02 | 中景 | 缓慢推近 | 主角盯着屏幕,眉头皱起,手指停在键盘上方没有再落下 | 无 | 键盘声停止,只剩空调声 | 2.5s |
| S01-03 | 特写 | 固定 | 屏幕上一条未读消息,发件人名称被界面挡住一半 | 无 | 消息提示音,一声 | 1.5s |
| S01-04 | 近景 | 固定 | 主角往后靠进椅背,视线从屏幕上移开,落在桌面 | 主角:这不可能。 | 椅子受力发出的轻响 | 3s |
| S01-05 | 中景 | 向左横移 | 镜头从主角肩膀移向门口,门缝下透进一道走廊的光 | 无 | 环境声压低,脚步声由远及近 | 3.5s |
| S01-06 | 特写 | 固定 | 主角的手把手机翻过来扣在桌面上 | 无 | 手机磕在桌面的钝响,随后安静 | 1.5s |
抄用这张表的四条规矩
- 一个镜头一行,不要合并。合并了就失去「逐镜可控」的意义,改一处会牵连一片。
- 画面内容用现在时、写动作。「他站起来走向门口」能拍,「他决定离开」不能拍。
- 台词写全,包括语气提示。同一句「我没事」,平静地说和咬着牙说是两场戏。
- 时长先粗后细。第一遍估个大概,通读全表时再调整 —— 调整顺序比调整数字重要。
模板的用法不是「填满」,是「对齐」。 填完之后横向读一遍:景别有没有变化、运镜有没有重复、时长有没有节奏。 分镜表最大的价值就在这一遍横向阅读里 —— 单看每一行都合格,连起来不成戏,是新手最常见的问题。
景别与运镜:分镜头脚本设计里的两套常用词
分镜头脚本设计听起来玄,落到实处就是这两个词库。 会写这两张表,你已经比大多数人写得清楚了。
景别:观众离人物有多远
| 景别 | 画面范围 | 一般用来做什么 |
|---|---|---|
| 远景 | 人物很小,环境占大部分 | 交代地点、时间、规模;用来开场或做段落之间的呼吸 |
| 全景 | 人物全身入画,环境可辨 | 交代人物与环境的关系、人物之间的位置 |
| 中景 | 膝盖或腰部以上 | 对话与动作的主力景别,信息量最均衡 |
| 近景 | 胸部以上 | 让观众进入对话,看清表情变化 |
| 特写 | 脸部、手或某个物件 | 强调。情绪转折、关键道具、信息揭示都用它 |
运镜:机器怎么动
| 运镜 | 机器怎么动 | 常用在哪 | 要注意什么 |
|---|---|---|---|
| 推 | 镜头向主体靠近 | 情绪收紧、注意力集中到某个细节 | 写清速度,「缓慢推近」和「快速推」是两种情绪 |
| 拉 | 镜头远离主体 | 段落收尾、揭示人物所处的更大环境 | 拉得太快会显得像在赶时间 |
| 摇 | 机位不动,镜头左右或上下转 | 展示空间、连接画面里的两个信息点 | 摇的落点要提前想好,否则观众不知道看什么 |
| 移 | 机位平移,镜头方向基本不变 | 跟随场景展开,带出纵深与层次 | 移动路径上要有内容,空移会显拖 |
| 跟 | 镜头跟着人物或物体移动 | 跟随行走、奔跑,保持观众与人物的距离 | 速度要与人物动作匹配,忽快忽慢最出戏 |
分镜头脚本生成器靠谱吗:AI 能做什么,不能做什么
现在不少工具都能「导入剧本、自动出分镜」。它确实省事,但你要清楚它替你做了什么、没做什么。
AI 擅长的部分
- 拆结构:把一整段剧本按动作、对白切成镜头,这一步又快又稳
- 补格式:自动填上景别、运镜、时长这类字段,给你一个不再空白的起点
- 批量转换:把分镜表按另一种格式重排,比手工复制粘贴快得多
- 扩写细节:把「他走进房间」扩成可执行的画面描述
AI 目前不擅长的部分
- 判断节奏:哪里该慢下来、哪里该一句带过,它给不出有意图的选择
- 判断重点:哪句台词值得一个特写,它通常平均分配镜头,结果就是平
- 判断留白:该不说话的时候不说话,这件事很难被生成出来
- 控制时长预算:它不知道你的成片要几分钟,只会一镜一镜往下拆
所以合理的使用方式是这样三步:
- 先让 AI 把结构拆出来,得到一个七列齐全的初稿 —— 这一步是纯体力活,交给工具。
- 然后自己重排节奏:哪几个镜头合并、哪个镜头换景别、哪里插一个空镜,这是导演的工作。
- 最后逐行核对画面内容,把心理描写改成动作,把抽象改成看得见的东西。
一句实话:别把「有分镜了」当成「分镜对了」。 自动生成的分镜最大的问题不是质量差,而是看起来都合格 —— 七列齐全、语句通顺,于是你直接拿去生成画面,做到一半才发现整场戏没有重点、节奏是平的。 分镜这一环省下来的时间,通常会在返工的时候还回去。
分镜之后接什么
分镜是整条流水线的第三环。它写完之后,后面的路是可以按顺序走的 —— 顺序反了,返工量会成倍增加:
先把角色形象定下来
在逐镜生成画面之前定角色:脸、发型、服装、气质。 同一个角色要出现在几十个镜头里,靠的是形象资产,不是每次重新描述一遍。 顺序不能反 —— 先铺画面再定角色,等于把已经生成的镜头全部作废。
按分镜逐镜出画面
分镜表里的「景别 + 画面内容」两列,就是画面生成的输入。 一镜一镜来,不要跳着做,也不要一次生成一大批再挑 —— 发现设定有问题时,没生成的那些就是你省下来的成本。
把静帧变成有运动的镜头
「运镜」那一列在这一步兑现。写的时候越具体,生成时越不容易跑偏; 反过来,如果分镜里只写了「推」,这里就只能靠运气。 复杂动作和长镜头仍然是最容易失败的部分,要有心理准备。
配音、音效与剪辑
「台词」与「音效」两列在这里被兑现。音画对不上的问题, 大多不是在配音环节产生的,而是分镜阶段时长没估准。 到这一步,片子开始成型 —— 也到了最需要狠心砍镜头的时候。
这四步和「工作流」是同一件事的两种说法: AI 视频工作流怎么搭讲的是为什么要把这些环节固定下来, 这篇讲的是其中一环具体怎么写。
如果你做的是短剧,可以顺着看 AI 短剧制作全流程, 那里把六个环节连起来讲了一遍; 到了配音那一步的取舍,见 AI 配音怎么选。 想知道这些环节能在哪个平台上一口气跑完,先看 LibTV 是什么。
常见问题
分镜头脚本是什么?
分镜头脚本是把文字剧本翻译成一条条可执行拍摄指令的表格,逐镜写清镜号、景别、运镜、画面内容、台词、音效和时长。剧本回答「讲什么故事」,分镜回答「先拍什么、从哪拍、拍多久」。它不负责文采,负责让执行环节不用猜。
分镜头脚本怎么写?
先把剧本按「一个动作或一次情绪变化」切成镜头,再逐个镜头填七个字段:镜号用来定位,景别决定观众看到多大范围,运镜决定机器怎么动,画面内容写清谁在哪做什么,台词写这一镜里说出口的话,音效写环境声与动作声,时长估一个数。填完自己读一遍,问一句「别人拿着这张表能不能做出同样的画面」。
分镜头脚本有标准格式吗?必须用表格吗?
行业里没有强制统一的格式,但字段是通用的那七个。表格是最实用的形式,因为镜头之间需要横向对比,也方便直接交给别人执行。手写、电子表格、专业分镜软件都可以,格式只服从一个标准:让人看懂。
分镜头脚本和故事板有什么区别?
分镜头脚本以文字和表格为主,重点是把拍摄指令写清楚;故事板是把关键镜头画出来,重点是让构图先被看见。两者经常一起用:先出分镜表定结构,再给重点镜头画故事板。做 AI 视频时分镜表的作用更直接,因为它是画面生成的输入。
有分镜头脚本生成器吗?AI 能直接生成分镜吗?
有,这类工具通常叫分镜生成器或 AI 分镜,思路是把剧本导入后自动拆成镜头并填好字段。它擅长拆结构和补格式,不擅长判断节奏 —— 哪句话该给特写、哪里该留白,仍然要人来定。LibTV 的剧本原创与改编、分镜与图像生成在同一条流程里,具体功能与计费方式以官网页面为准。
分镜头脚本用什么软件做?
预算有限的话,电子表格就够了,七列一张表,改起来最灵活。要贴画面参考可以用带图片列的工具,要交付给团队可以用专业分镜软件。工具不决定分镜质量,决定质量的是你有没有把景别、运镜、时长这三件最容易糊弄过去的事认真填完。
分镜写完,先跑通一个镜头
不用急着做完一整部。挑分镜表里最简单的一镜,从画面到配音跑一遍,你马上会知道自己的分镜漏了哪个字段 —— 这比继续改表格有用得多。