AI 剧本创作怎么做?
难点不在文笔,在结构和可拍性
用 AI 写剧本,卡住你的通常不是「它写得不好看」,而是写出来的东西没法往下做: 场次分不清、动作写成心理活动、台词漂亮但拍不出来。 这篇讲清从一句话创意到分场大纲的步骤、可拍剧本的固定结构,以及剧本怎么接到分镜。
约 3600 字 含剧本结构示例 最后更新 2026-09-26
AI 剧本创作要盯的不是文笔,是结构和可拍性。
结构 = 每一场戏承担什么功能;可拍性 = 这一场发生在哪、有谁、做什么、说什么。 两件事都定下来,剧本才能往分镜走;只把台词写得漂亮,下一步会寸步难行。
AI 写剧本真正难的地方:结构和可拍性
先说一件反直觉的事:让 AI 把句子写好看,早就不是问题了。 它能把一段对白写得比多数人顺,也能模仿各种风格。真正让人返工的,是下面两件事。
结构:每一场戏在干什么
剧本不是句子的集合,是场次的集合。每一场都要承担一个功能:推进、转折、铺垫、还是揭示。 没有功能的场次,读起来不难受,但删掉也不会有人发现 —— 这就是「剧本很平」的来源。
可拍性:这一场做不做得出来
AI 会写出「人群在广场上四散奔逃」「镜头穿过整条街」这类场面, 读着很有画面感,但下一步要么做不出来,要么代价很高。 剧本阶段就要把做不到的场面换掉,而不是等生成时才发现。
判断一份 AI 剧本能不能往下走,就问两个问题: 删掉这一场,故事会不会变化? 这一场需要的东西,我做不做得出来? 两个问题有一个答不上来,先别急着拆分镜 —— 后面每一步都会放大这个问题。
一个常见误解:把剧本当成「给 AI 的提示词」。 剧本是给整条流程用的:它决定有多少场、每场多长、谁和谁说话。 提示词只管一个镜头里的画面。两者的颗粒度差着一个数量级 —— 剧本写成一句超长的画面描述,下一步根本没法拆。
从一句话创意到分场大纲:五个步骤
这套顺序的重点是「先定容器,再装内容」: 先知道有几场、每场干什么,再往里填戏,比一上来就让它写完整剧本要省事得多。
第一步:把创意压成一句话
格式固定成「谁 + 想要什么 + 被什么挡住」。 例如「一个夜班店员想在打烊前等到一个人,但对方一直没出现」。 这句话是整个剧本的判据:后面每一场都应该和它有关系。
第二步:先定时长和场次数量
一分钟的片子和三分钟的片子,场次数完全不同。 先把「大概几场、每场多长」定下来,再去写内容 —— 不定容器,AI 会给你一个长短随缘的稿子,删改比重写还费劲。
第三步:只让它出场次功能表
每一场一行,写清「场次号 + 地点 + 这一场要完成什么」, 先不要台词,也不要细节描写。 这一步的产出应该短到一眼能看完 —— 看不完,说明场次太多了。
第四步:人工删掉功能重复的场次
这一步不要交给 AI:它倾向于保留自己写的东西。 把功能相同的场次合并,把和那句话创意无关的删掉。 90 秒能讲完的故事,不要留四场铺垫。
第五步:再让它扩写成大纲
每场 2–3 句,只写发生了什么,不要台词。 到这一步你会第一次看清整个故事,也是发现「哪里接不上」的时机。 大纲没定就让它写台词,改起来等于重写。
给 AI 的约束写在提示词里,而不是留在脑子里。 至少要交代:题材、时长、场次数量、主要人物、每场要完成什么、输出格式。 其中输出格式经常被漏掉 —— 少了它,AI 会按自己的习惯输出, 下一步还要人工整理一遍。
让 AI 输出「可拍剧本」的固定结构
默认情况下,AI 会写成小说体:大段心理描写、环境抒情、「他感到一阵失落」。 这些内容在剧本里是无效信息 —— 往下走的那一步要的是能执行的东西。 把输出固定成五个字段,问题就解决了大半。
| 要素 | 写什么 | 无效写法 | 可拍的写法 |
|---|---|---|---|
| ① 场次 | 编号与顺序 | 不分场,一整段写到底 | 每场一个编号,顺序就是剪辑顺序 |
| ② 地点 | 发生在哪、什么时间 | 「在一个压抑的地方」 | 「便利店门口 · 夜」 |
| ③ 人物 | 这一场有谁在场 | 「几个路人」「一个女孩」 | 「男人(40 岁上下,深色风衣)、店员(20 岁上下)」 |
| ④ 动作 | 能看见的动作 | 「他感到一阵失落」 | 「男人把伞收拢,抬头看招牌」 |
| ⑤ 台词 | 谁说了什么 | 大段内心独白 | 「店员:要打烊了。」 |
五个字段的作用,到下一步就看得出来了: 场次决定分镜的分组,动作行可以直接拆成镜头, 台词行可以拿去配音。如果剧本里混着心理描写, 拆分镜时就只能靠猜 —— 猜错一次,后面生成好的画面全部作废。
一个结构化剧本示例
同样一段内容,按五个字段写出来长这样:
场次:1
地点:便利店门口 · 夜 · 雨
人物:男人(40 岁上下,深色风衣,手里拿着一把湿伞);店员(20 岁上下,穿制服)
动作:男人站在门口的雨棚下,把伞收拢,甩了两下水,抬头看向招牌。店员从店内向外看了一眼,又低下头。
台词:
店员:要打烊了。
男人:再等两分钟。
店员:等人?
男人没有回答,把伞靠在墙上。
注意最后一行:它写的是动作,不是心理活动。 「男人没有回答」是可以拍出来的,「男人心里很失落」拍不出来。 这条例子的价值就在于示范这条界线 —— 写剧本时, 凡是不能用画面或声音表达的,全部换成外显的动作。
让 AI 按这个格式输出,关键在字段名要固定。 提示词里直接给出「场次 / 地点 / 人物 / 动作 / 台词」五个字段, 并要求「只输出这五个字段,不写心理描写和景色抒情」。 每次换项目都沿用同一套字段名 —— 字段名一变,下一步的拆分规则就得重写。
剧本的下一步:分镜,以及为什么这里需要工作流
剧本写的是发生了什么,分镜写的是镜头怎么拍。 同一场戏,分镜可能拆成三个镜头,也可能拆成八个 —— 这一步的输入是剧本,输出是逐镜的画面描述。掉链子通常发生在这里:
- 同一场戏里的同一个人。三个镜头里的主角不是同一张脸, 因为每次生成都从零开始描述这个人。
- 改一句台词的连锁反应。台词改了,配音要重做, 基于旧台词调整过的画面节奏也要跟着改 —— 而你不知道哪些地方受影响。
- 场次顺序一调,前面白做。把第 3 场和第 5 场对调, 之前按旧顺序生成的画面全都要重新排。
这三个问题的共同点是:前后有依赖,但依赖没有被记录下来。 用聊天窗口一段段生成做不到这件事。把剧本、角色、分镜、画面放进同一条流程, 让它们之间建立依赖关系,改上游时下游自动更新,返工成本才降得下来 —— 这就是工作流的价值,完整做法见 AI 视频工作流怎么搭。
往下还有两个环节:分镜写完之后,每个镜头的画面描述怎么措辞,见 AI 视频提示词怎么写; 如果你不想从零写,可以直接取现成的场景模板, 见 AI 视频提示词模板库。
还有一点要有预期:从分镜往下,每一步生成都要消耗算力,具体计费方式与免费额度 以官网页面为准。在剧本阶段多过一轮可拍性, 比在生成阶段反复返工要省事得多。
什么情况不用写剧本: 如果你只是想把一段现成文字、一个产品卖点变成一段视频,不需要从剧本写起 —— 直接写画面描述更快。写剧本这一步是为多场次、多人物、需要反复修改的项目准备的; 一条 15 秒的单镜头内容,写剧本是多余的动作。
两个高发问题:剧本很平、人物说话一个味
问题一:AI 写出来「很平」
平不是文笔问题,是功能重复。检验方法很笨但有效: 删掉某一场,故事有没有变化?没有变化的那一场,就是可删的。
修法是两步:先给每一场标一个功能标签(推进 / 转折 / 铺垫 / 揭示), 功能重复的合并或删掉;然后只让它重写留下的那几场, 不要让它重写全篇 —— 重写全篇会把它已经写对的部分一起改掉, 你会陷入反复调整的循环。
问题二:人物说话都一个味
原因很简单:设定里只有名字,没有说话方式。补三条信息就够了 —— 这个人的身份与年龄、他此刻想达成什么、 他习惯怎么说话(爱绕弯子还是直给、句子长还是短、有没有口头禅)。
补完之后,让它只重写台词,动作行不要动。 一次改一件事,改完再对比 —— 同时改台词和动作,你分不清是哪一处起了作用。
问题三:场面写大了,做不出来
这是可拍性问题的典型表现。修法是在让它扩写之前,先给一份 「可执行清单」:能出现的场景有哪些、一场戏里最多几个角色、 有没有特殊道具或天气要求。让它在这个范围内写, 而不是先写出来再想办法实现 —— 后者往往要整场重来。
常见问题
AI 剧本创作和用 AI 写小说有什么区别?
小说只要读者在脑子里看得见就行,剧本要能往下拍、能往下拆。所以 AI 剧本创作真正要盯的是结构和可拍性:每一场戏承担什么功能,这一场发生在哪、有谁、做什么、说什么。文笔在剧本阶段不是重点,写得太文学化,反而会在拆分镜时没法下手。
AI 剧本生成器能直接出成品剧本吗?
能出一个结构完整的初稿,但不要指望一次成型。工具不知道你打算用几个镜头,也不知道某个场面你做不做得出来。比较实际的做法是:让它出大纲和场次结构,人工过一遍可拍性,把做不到的场面换掉,再让它扩写。
写 AI 剧本的提示词要多长?
关键不是长度,是有没有给约束。至少要交代题材、时长、场次数量、主要人物、每一场要完成什么,以及输出格式。少了输出格式这一项,它会按自己的习惯写,后面还要重新整理一遍。
AI 写出来的剧本很平怎么办?
平通常不是文笔问题,是每一场戏的功能重复了。检验方法很简单:删掉某一场,故事有没有变化,没有变化的那场就是可删的。修法是给每场标一个功能,重复的合并或删掉,再让它只重写留下的那几场,不要重写全篇。
AI 写的人物台词都一个味怎么办?
因为人物设定里只有名字,没有说话方式。补三件事:这个人的身份与年龄、他此刻想达成什么、他习惯怎么说话。把这三条写进设定,再让它单独重写台词,动作行不要动。
剧本写完怎么变成视频?
剧本只是第一步,后面还要拆分镜、定角色形象、逐镜生成画面和视频、配音、剪辑。剧本到分镜这一步经常被低估:剧本写的是发生了什么,分镜写的是镜头怎么拍。这套衔接方式可以看工作流那一篇。
剧本写对了,后面的每一步才省事
剧本、分镜、角色、画面放在同一张画布上,改一句台词不用重做全片。注册后可以先拿官方模板跑通一条短片,再决定要不要把自己的剧本搬进去。