AI片场AI 视频工作流指南 免费注册体验
教程 + 模板

分镜头脚本怎么写?
七个字段,一张能直接抄的表

很多人卡在分镜,不是因为不会写,而是因为不知道该填什么。 这篇文章把分镜头脚本拆到字段级别:每个格子填什么、为什么非填不可、常见错误长什么样; 再给一张填好示范内容的分镜表模板,抄走就能用。

5 张表,含可直接抄用的模板 字段级拆解,不讲空话 最后更新 2026-09-26

先给结论

分镜头脚本不是「写得更细的剧本」,它是给执行环节看的施工图。

剧本回答「讲什么故事」,分镜回答「先拍什么、从哪拍、拍多久」。 判断一份分镜能不能用,只看一件事:换一个人拿着它去执行,能不能做出和你脑子里一样的画面。 做不到,通常是七个字段里有格子空着。

分镜头脚本是什么

先把定义说清楚,后面所有内容都建立在这上面:

分镜头脚本,是把一段文字内容切成一个个镜头,并逐镜写清「拍什么、怎么拍、拍多久」的表格化文档。 它上承剧本,下接拍摄或生成,是整条片子的中间层。

它和文学剧本的差别,不是「详细程度」,而是服务对象不同。 剧本写给读者看,分镜写给执行的人看 —— 在 AI 视频里,「执行的人」就是你自己加你手上的工具。

对比项文学剧本分镜头脚本
回答的问题讲了一个什么故事先拍什么、从哪拍、拍多久
写作单位场次、段落镜头(一个镜头一行)
主要读者读者、演员、投资人拍摄或生成环节的执行者
情绪怎么表达可以用描写、对白、旁白铺陈只能靠景别、表演动作和时长来体现
能不能直接执行不能,中间还需要一次转译能,按行执行即可
改动成本改一句台词影响有限改一处,下游画面与配音都要跟着动
这张表是整个分镜工作的前提:剧本负责「好看」,分镜负责「可执行」。两者不能互相替代,也不该混成一份文档。

还有一个常见疑问:分镜头脚本和故事板是一回事吗?不是。 分镜以文字和表格为主,故事板以画稿为主。实际项目里通常先出分镜表定结构, 再挑重点镜头画故事板。做 AI 视频时,分镜表更关键 —— 它是画面生成时的直接输入。

分镜头脚本格式:七个字段逐个拆

格式这件事没有强制标准,但字段是通用的那七个。 下面这张表把每个字段说透:填什么、为什么要填、常见错误长什么样。 写分镜的时候对着它逐行检查,比看十篇教程都有用。

字段填什么为什么要填常见错误
镜号 场次加序号,例如 S03-07,表示第 3 场第 7 镜;同一场戏内连续编号 它是整张表的坐标。改片、补镜、和素材对号,全靠这个编号,讨论时不用再靠描述 用「开头那个」「后面那个」代替编号;中途插镜改成小数,后面对不上
景别 远景、全景、中景、近景、特写,标清主体在画面里占多大 景别决定观众和人物的距离。同一个动作,远景是看环境,特写是看情绪 —— 这是叙事选择 整场戏全是中景,不难看,但也没有重点
运镜 固定,或推、拉、摇、移、跟,并写清方向与幅度,例如「缓慢推近」 运镜决定这个镜头的呼吸。只写「推」不写幅度,执行时可能变成猛推,情绪完全不同 每个镜头都写运镜。固定镜头也是一种选择,而且是最稳的一种
画面内容 谁、在哪、做什么、画面里还有什么。只写看得见的东西 这是生成画面时唯一的依据。写「他很失落」生成不出来,写「他坐在楼梯上低着头」可以 写情绪不写动作;一个镜头里塞进两个时空
台词 这一镜里说出口的话,写全,不要写「此处省略」 台词长度直接决定镜头时长,也决定后面配音的节奏;写在画面同一行,改的时候才知道影响范围 台词长得塞不进一个镜头,只能硬拆;或者干脆留空,到配音时才发现对不上
音效 环境声加动作声,需要时再标音乐进出的大致位置 声音是最容易被跳过的一列,也最容易让画面「变真」——空镜头配上环境声就不再是废镜头 整列空着;或者把音乐当音效,从第一个镜头铺到最后一个
时长 单个镜头的估算时长,全片加起来要能对上成片长度 时长是节奏的量化。写不出具体数字,往往说明这场戏的节奏你还没想清楚 用平均值糊过去,每镜都写同样的数,成片就会平得像流水账
七个字段里,镜号、景别、运镜、时长属于「拍摄指令」,画面内容、台词、音效属于「内容素材」。前者决定怎么拍,后者决定拍什么,缺一边都不完整。

两个最容易糊弄过去的字段:音效与时长

镜号、景别、画面内容大家都会填,因为看得见。真正拉开差距的是音效和时长这两列 —— 它们不影响画面生成,所以最容易被留白,然后在剪辑阶段集中爆雷: 镜头长度和台词对不上,或者整场戏安静得不像真的。

  • 音效先写环境声。这一场在哪?办公室有空调声,街道有车流声,深夜的房间几乎是安静的 —— 写下来,画面就落地了。
  • 时长按「这句话说完要几秒」估。先估台词,再估动作,最后补留白。全加起来超出成片长度,就要回头砍镜头,而不是硬压时长。
  • 不要把所有镜头写成同一个数。节奏感来自长短交替:三个短镜头接一个长镜头,观众才有呼吸。

分镜头脚本模板:一张可以直接抄走的表

下面是一张填好示范内容的分镜表。字段就是前面那七个, 你可以把列保留、行换掉,直接当成自己的模板用。

镜号景别运镜画面内容台词音效时长
S01-01全景固定 深夜办公室,只有主角工位一盏灯亮着,窗外城市灯光虚成一片 无空调低频声、断续键盘声3s
S01-02中景缓慢推近 主角盯着屏幕,眉头皱起,手指停在键盘上方没有再落下 无键盘声停止,只剩空调声2.5s
S01-03特写固定 屏幕上一条未读消息,发件人名称被界面挡住一半 无消息提示音,一声1.5s
S01-04近景固定 主角往后靠进椅背,视线从屏幕上移开,落在桌面 主角:这不可能。椅子受力发出的轻响3s
S01-05中景向左横移 镜头从主角肩膀移向门口,门缝下透进一道走廊的光 无环境声压低,脚步声由远及近3.5s
S01-06特写固定 主角的手把手机翻过来扣在桌面上 无手机磕在桌面的钝响,随后安静1.5s
示范内容只为说明每个格子该填成什么样,其中的秒数是示意值,不是标准。真实项目里时长由你的成片节奏决定,别为了填满而填。

抄用这张表的四条规矩

  • 一个镜头一行,不要合并。合并了就失去「逐镜可控」的意义,改一处会牵连一片。
  • 画面内容用现在时、写动作。「他站起来走向门口」能拍,「他决定离开」不能拍。
  • 台词写全,包括语气提示。同一句「我没事」,平静地说和咬着牙说是两场戏。
  • 时长先粗后细。第一遍估个大概,通读全表时再调整 —— 调整顺序比调整数字重要。

模板的用法不是「填满」,是「对齐」。 填完之后横向读一遍:景别有没有变化、运镜有没有重复、时长有没有节奏。 分镜表最大的价值就在这一遍横向阅读里 —— 单看每一行都合格,连起来不成戏,是新手最常见的问题。

景别与运镜:分镜头脚本设计里的两套常用词

分镜头脚本设计听起来玄,落到实处就是这两个词库。 会写这两张表,你已经比大多数人写得清楚了。

景别:观众离人物有多远

景别画面范围一般用来做什么
远景人物很小,环境占大部分交代地点、时间、规模;用来开场或做段落之间的呼吸
全景人物全身入画,环境可辨交代人物与环境的关系、人物之间的位置
中景膝盖或腰部以上对话与动作的主力景别,信息量最均衡
近景胸部以上让观众进入对话,看清表情变化
特写脸部、手或某个物件强调。情绪转折、关键道具、信息揭示都用它
景别不是越大越好,也不是越近越有力。它的作用是控制信息量:远景给环境,特写给重点。整场戏只有一种景别,等于没有重点。

运镜:机器怎么动

运镜机器怎么动常用在哪要注意什么
推镜头向主体靠近情绪收紧、注意力集中到某个细节写清速度,「缓慢推近」和「快速推」是两种情绪
拉镜头远离主体段落收尾、揭示人物所处的更大环境拉得太快会显得像在赶时间
摇机位不动,镜头左右或上下转展示空间、连接画面里的两个信息点摇的落点要提前想好,否则观众不知道看什么
移机位平移,镜头方向基本不变跟随场景展开,带出纵深与层次移动路径上要有内容,空移会显拖
跟镜头跟着人物或物体移动跟随行走、奔跑,保持观众与人物的距离速度要与人物动作匹配,忽快忽慢最出戏
固定镜头没有被列进来,因为它不是「没有运镜」,而是一种主动选择:需要观众安静下来看表演时,固定往往比任何运动都有效。生成视频时,固定镜头也是最不容易跑偏的一种。

分镜头脚本生成器靠谱吗:AI 能做什么,不能做什么

现在不少工具都能「导入剧本、自动出分镜」。它确实省事,但你要清楚它替你做了什么、没做什么。

AI 擅长的部分

  • 拆结构:把一整段剧本按动作、对白切成镜头,这一步又快又稳
  • 补格式:自动填上景别、运镜、时长这类字段,给你一个不再空白的起点
  • 批量转换:把分镜表按另一种格式重排,比手工复制粘贴快得多
  • 扩写细节:把「他走进房间」扩成可执行的画面描述

AI 目前不擅长的部分

  • 判断节奏:哪里该慢下来、哪里该一句带过,它给不出有意图的选择
  • 判断重点:哪句台词值得一个特写,它通常平均分配镜头,结果就是平
  • 判断留白:该不说话的时候不说话,这件事很难被生成出来
  • 控制时长预算:它不知道你的成片要几分钟,只会一镜一镜往下拆

所以合理的使用方式是这样三步:

  • 先让 AI 把结构拆出来,得到一个七列齐全的初稿 —— 这一步是纯体力活,交给工具。
  • 然后自己重排节奏:哪几个镜头合并、哪个镜头换景别、哪里插一个空镜,这是导演的工作。
  • 最后逐行核对画面内容,把心理描写改成动作,把抽象改成看得见的东西。

一句实话:别把「有分镜了」当成「分镜对了」。 自动生成的分镜最大的问题不是质量差,而是看起来都合格 —— 七列齐全、语句通顺,于是你直接拿去生成画面,做到一半才发现整场戏没有重点、节奏是平的。 分镜这一环省下来的时间,通常会在返工的时候还回去。

分镜之后接什么

分镜是整条流水线的第三环。它写完之后,后面的路是可以按顺序走的 —— 顺序反了,返工量会成倍增加:

先把角色形象定下来

在逐镜生成画面之前定角色:脸、发型、服装、气质。 同一个角色要出现在几十个镜头里,靠的是形象资产,不是每次重新描述一遍。 顺序不能反 —— 先铺画面再定角色,等于把已经生成的镜头全部作废。

按分镜逐镜出画面

分镜表里的「景别 + 画面内容」两列,就是画面生成的输入。 一镜一镜来,不要跳着做,也不要一次生成一大批再挑 —— 发现设定有问题时,没生成的那些就是你省下来的成本。

把静帧变成有运动的镜头

「运镜」那一列在这一步兑现。写的时候越具体,生成时越不容易跑偏; 反过来,如果分镜里只写了「推」,这里就只能靠运气。 复杂动作和长镜头仍然是最容易失败的部分,要有心理准备。

配音、音效与剪辑

「台词」与「音效」两列在这里被兑现。音画对不上的问题, 大多不是在配音环节产生的,而是分镜阶段时长没估准。 到这一步,片子开始成型 —— 也到了最需要狠心砍镜头的时候。

这四步和「工作流」是同一件事的两种说法: AI 视频工作流怎么搭讲的是为什么要把这些环节固定下来, 这篇讲的是其中一环具体怎么写。

如果你做的是短剧,可以顺着看 AI 短剧制作全流程, 那里把六个环节连起来讲了一遍; 到了配音那一步的取舍,见 AI 配音怎么选。 想知道这些环节能在哪个平台上一口气跑完,先看 LibTV 是什么。

常见问题

分镜头脚本是什么?

分镜头脚本是把文字剧本翻译成一条条可执行拍摄指令的表格,逐镜写清镜号、景别、运镜、画面内容、台词、音效和时长。剧本回答「讲什么故事」,分镜回答「先拍什么、从哪拍、拍多久」。它不负责文采,负责让执行环节不用猜。

分镜头脚本怎么写?

先把剧本按「一个动作或一次情绪变化」切成镜头,再逐个镜头填七个字段:镜号用来定位,景别决定观众看到多大范围,运镜决定机器怎么动,画面内容写清谁在哪做什么,台词写这一镜里说出口的话,音效写环境声与动作声,时长估一个数。填完自己读一遍,问一句「别人拿着这张表能不能做出同样的画面」。

分镜头脚本有标准格式吗?必须用表格吗?

行业里没有强制统一的格式,但字段是通用的那七个。表格是最实用的形式,因为镜头之间需要横向对比,也方便直接交给别人执行。手写、电子表格、专业分镜软件都可以,格式只服从一个标准:让人看懂。

分镜头脚本和故事板有什么区别?

分镜头脚本以文字和表格为主,重点是把拍摄指令写清楚;故事板是把关键镜头画出来,重点是让构图先被看见。两者经常一起用:先出分镜表定结构,再给重点镜头画故事板。做 AI 视频时分镜表的作用更直接,因为它是画面生成的输入。

有分镜头脚本生成器吗?AI 能直接生成分镜吗?

有,这类工具通常叫分镜生成器或 AI 分镜,思路是把剧本导入后自动拆成镜头并填好字段。它擅长拆结构和补格式,不擅长判断节奏 —— 哪句话该给特写、哪里该留白,仍然要人来定。LibTV 的剧本原创与改编、分镜与图像生成在同一条流程里,具体功能与计费方式以官网页面为准。

分镜头脚本用什么软件做?

预算有限的话,电子表格就够了,七列一张表,改起来最灵活。要贴画面参考可以用带图片列的工具,要交付给团队可以用专业分镜软件。工具不决定分镜质量,决定质量的是你有没有把景别、运镜、时长这三件最容易糊弄过去的事认真填完。

分镜写完,先跑通一个镜头

不用急着做完一整部。挑分镜表里最简单的一镜,从画面到配音跑一遍,你马上会知道自己的分镜漏了哪个字段 —— 这比继续改表格有用得多。