AI片场AI 视频工作流指南 免费注册体验
剧本教程

AI 剧本创作怎么做?
难点不在文笔,在结构和可拍性

用 AI 写剧本,卡住你的通常不是「它写得不好看」,而是写出来的东西没法往下做: 场次分不清、动作写成心理活动、台词漂亮但拍不出来。 这篇讲清从一句话创意到分场大纲的步骤、可拍剧本的固定结构,以及剧本怎么接到分镜。

约 3600 字 含剧本结构示例 最后更新 2026-09-26

先给结论

AI 剧本创作要盯的不是文笔,是结构和可拍性。

结构 = 每一场戏承担什么功能;可拍性 = 这一场发生在哪、有谁、做什么、说什么。 两件事都定下来,剧本才能往分镜走;只把台词写得漂亮,下一步会寸步难行。

AI 写剧本真正难的地方:结构和可拍性

先说一件反直觉的事:让 AI 把句子写好看,早就不是问题了。 它能把一段对白写得比多数人顺,也能模仿各种风格。真正让人返工的,是下面两件事。

结构:每一场戏在干什么

剧本不是句子的集合,是场次的集合。每一场都要承担一个功能:推进、转折、铺垫、还是揭示。 没有功能的场次,读起来不难受,但删掉也不会有人发现 —— 这就是「剧本很平」的来源。

可拍性:这一场做不做得出来

AI 会写出「人群在广场上四散奔逃」「镜头穿过整条街」这类场面, 读着很有画面感,但下一步要么做不出来,要么代价很高。 剧本阶段就要把做不到的场面换掉,而不是等生成时才发现。

判断一份 AI 剧本能不能往下走,就问两个问题: 删掉这一场,故事会不会变化? 这一场需要的东西,我做不做得出来? 两个问题有一个答不上来,先别急着拆分镜 —— 后面每一步都会放大这个问题。

一个常见误解:把剧本当成「给 AI 的提示词」。 剧本是给整条流程用的:它决定有多少场、每场多长、谁和谁说话。 提示词只管一个镜头里的画面。两者的颗粒度差着一个数量级 —— 剧本写成一句超长的画面描述,下一步根本没法拆。

从一句话创意到分场大纲:五个步骤

这套顺序的重点是「先定容器,再装内容」: 先知道有几场、每场干什么,再往里填戏,比一上来就让它写完整剧本要省事得多。

第一步:把创意压成一句话

格式固定成「谁 + 想要什么 + 被什么挡住」。 例如「一个夜班店员想在打烊前等到一个人,但对方一直没出现」。 这句话是整个剧本的判据:后面每一场都应该和它有关系。

第二步:先定时长和场次数量

一分钟的片子和三分钟的片子,场次数完全不同。 先把「大概几场、每场多长」定下来,再去写内容 —— 不定容器,AI 会给你一个长短随缘的稿子,删改比重写还费劲。

第三步:只让它出场次功能表

每一场一行,写清「场次号 + 地点 + 这一场要完成什么」, 先不要台词,也不要细节描写。 这一步的产出应该短到一眼能看完 —— 看不完,说明场次太多了。

第四步:人工删掉功能重复的场次

这一步不要交给 AI:它倾向于保留自己写的东西。 把功能相同的场次合并,把和那句话创意无关的删掉。 90 秒能讲完的故事,不要留四场铺垫。

第五步:再让它扩写成大纲

每场 2–3 句,只写发生了什么,不要台词。 到这一步你会第一次看清整个故事,也是发现「哪里接不上」的时机。 大纲没定就让它写台词,改起来等于重写。

给 AI 的约束写在提示词里,而不是留在脑子里。 至少要交代:题材、时长、场次数量、主要人物、每场要完成什么、输出格式。 其中输出格式经常被漏掉 —— 少了它,AI 会按自己的习惯输出, 下一步还要人工整理一遍。

让 AI 输出「可拍剧本」的固定结构

默认情况下,AI 会写成小说体:大段心理描写、环境抒情、「他感到一阵失落」。 这些内容在剧本里是无效信息 —— 往下走的那一步要的是能执行的东西。 把输出固定成五个字段,问题就解决了大半。

要素写什么无效写法可拍的写法
① 场次 编号与顺序 不分场,一整段写到底 每场一个编号,顺序就是剪辑顺序
② 地点 发生在哪、什么时间 「在一个压抑的地方」 「便利店门口 · 夜」
③ 人物 这一场有谁在场 「几个路人」「一个女孩」 「男人(40 岁上下,深色风衣)、店员(20 岁上下)」
④ 动作 能看见的动作 「他感到一阵失落」 「男人把伞收拢,抬头看招牌」
⑤ 台词 谁说了什么 大段内心独白 「店员:要打烊了。」
这是通用剧本格式的描述,不涉及任何工具的具体功能。各家平台怎么接收剧本、怎么把剧本转成后续环节,以其官方说明为准。

五个字段的作用,到下一步就看得出来了: 场次决定分镜的分组,动作行可以直接拆成镜头, 台词行可以拿去配音。如果剧本里混着心理描写, 拆分镜时就只能靠猜 —— 猜错一次,后面生成好的画面全部作废。

一个结构化剧本示例

同样一段内容,按五个字段写出来长这样:

场次:1

地点:便利店门口 · 夜 · 雨

人物:男人(40 岁上下,深色风衣,手里拿着一把湿伞);店员(20 岁上下,穿制服)

动作:男人站在门口的雨棚下,把伞收拢,甩了两下水,抬头看向招牌。店员从店内向外看了一眼,又低下头。

台词:

店员:要打烊了。

男人:再等两分钟。

店员:等人?

男人没有回答,把伞靠在墙上。

注意最后一行:它写的是动作,不是心理活动。 「男人没有回答」是可以拍出来的,「男人心里很失落」拍不出来。 这条例子的价值就在于示范这条界线 —— 写剧本时, 凡是不能用画面或声音表达的,全部换成外显的动作。

让 AI 按这个格式输出,关键在字段名要固定。 提示词里直接给出「场次 / 地点 / 人物 / 动作 / 台词」五个字段, 并要求「只输出这五个字段,不写心理描写和景色抒情」。 每次换项目都沿用同一套字段名 —— 字段名一变,下一步的拆分规则就得重写。

剧本的下一步:分镜,以及为什么这里需要工作流

剧本写的是发生了什么,分镜写的是镜头怎么拍。 同一场戏,分镜可能拆成三个镜头,也可能拆成八个 —— 这一步的输入是剧本,输出是逐镜的画面描述。掉链子通常发生在这里:

  • 同一场戏里的同一个人。三个镜头里的主角不是同一张脸, 因为每次生成都从零开始描述这个人。
  • 改一句台词的连锁反应。台词改了,配音要重做, 基于旧台词调整过的画面节奏也要跟着改 —— 而你不知道哪些地方受影响。
  • 场次顺序一调,前面白做。把第 3 场和第 5 场对调, 之前按旧顺序生成的画面全都要重新排。

这三个问题的共同点是:前后有依赖,但依赖没有被记录下来。 用聊天窗口一段段生成做不到这件事。把剧本、角色、分镜、画面放进同一条流程, 让它们之间建立依赖关系,改上游时下游自动更新,返工成本才降得下来 —— 这就是工作流的价值,完整做法见 AI 视频工作流怎么搭。

往下还有两个环节:分镜写完之后,每个镜头的画面描述怎么措辞,见 AI 视频提示词怎么写; 如果你不想从零写,可以直接取现成的场景模板, 见 AI 视频提示词模板库。

还有一点要有预期:从分镜往下,每一步生成都要消耗算力,具体计费方式与免费额度 以官网页面为准。在剧本阶段多过一轮可拍性, 比在生成阶段反复返工要省事得多。

什么情况不用写剧本: 如果你只是想把一段现成文字、一个产品卖点变成一段视频,不需要从剧本写起 —— 直接写画面描述更快。写剧本这一步是为多场次、多人物、需要反复修改的项目准备的; 一条 15 秒的单镜头内容,写剧本是多余的动作。

两个高发问题:剧本很平、人物说话一个味

问题一:AI 写出来「很平」

平不是文笔问题,是功能重复。检验方法很笨但有效: 删掉某一场,故事有没有变化?没有变化的那一场,就是可删的。

修法是两步:先给每一场标一个功能标签(推进 / 转折 / 铺垫 / 揭示), 功能重复的合并或删掉;然后只让它重写留下的那几场, 不要让它重写全篇 —— 重写全篇会把它已经写对的部分一起改掉, 你会陷入反复调整的循环。

问题二:人物说话都一个味

原因很简单:设定里只有名字,没有说话方式。补三条信息就够了 —— 这个人的身份与年龄、他此刻想达成什么、 他习惯怎么说话(爱绕弯子还是直给、句子长还是短、有没有口头禅)。

补完之后,让它只重写台词,动作行不要动。 一次改一件事,改完再对比 —— 同时改台词和动作,你分不清是哪一处起了作用。

问题三:场面写大了,做不出来

这是可拍性问题的典型表现。修法是在让它扩写之前,先给一份 「可执行清单」:能出现的场景有哪些、一场戏里最多几个角色、 有没有特殊道具或天气要求。让它在这个范围内写, 而不是先写出来再想办法实现 —— 后者往往要整场重来。

常见问题

AI 剧本创作和用 AI 写小说有什么区别?

小说只要读者在脑子里看得见就行,剧本要能往下拍、能往下拆。所以 AI 剧本创作真正要盯的是结构和可拍性:每一场戏承担什么功能,这一场发生在哪、有谁、做什么、说什么。文笔在剧本阶段不是重点,写得太文学化,反而会在拆分镜时没法下手。

AI 剧本生成器能直接出成品剧本吗?

能出一个结构完整的初稿,但不要指望一次成型。工具不知道你打算用几个镜头,也不知道某个场面你做不做得出来。比较实际的做法是:让它出大纲和场次结构,人工过一遍可拍性,把做不到的场面换掉,再让它扩写。

写 AI 剧本的提示词要多长?

关键不是长度,是有没有给约束。至少要交代题材、时长、场次数量、主要人物、每一场要完成什么,以及输出格式。少了输出格式这一项,它会按自己的习惯写,后面还要重新整理一遍。

AI 写出来的剧本很平怎么办?

平通常不是文笔问题,是每一场戏的功能重复了。检验方法很简单:删掉某一场,故事有没有变化,没有变化的那场就是可删的。修法是给每场标一个功能,重复的合并或删掉,再让它只重写留下的那几场,不要重写全篇。

AI 写的人物台词都一个味怎么办?

因为人物设定里只有名字,没有说话方式。补三件事:这个人的身份与年龄、他此刻想达成什么、他习惯怎么说话。把这三条写进设定,再让它单独重写台词,动作行不要动。

剧本写完怎么变成视频?

剧本只是第一步,后面还要拆分镜、定角色形象、逐镜生成画面和视频、配音、剪辑。剧本到分镜这一步经常被低估:剧本写的是发生了什么,分镜写的是镜头怎么拍。这套衔接方式可以看工作流那一篇。

剧本写对了,后面的每一步才省事

剧本、分镜、角色、画面放在同一张画布上,改一句台词不用重做全片。注册后可以先拿官方模板跑通一条短片,再决定要不要把自己的剧本搬进去。