短剧产线 · AI 短剧制作

剧本视觉化:短剧从剧本到竖屏成片与投放物料的 9 步产线

竖屏短剧的剧本写完之后,到真正开拍之间有一段很长的「靠嘴对齐」:导演脑子里的画面、编剧脑子里的画面、制片预算里的画面各不相同,主演长什么样、这场戏正打反打怎么切、第一集前几秒拿什么钩住观众,往往要到现场才吵出结果。用 AI 做短剧的团队问题更直接:角色每集换脸、镜头之间跳轴、台词和画面长度对不上。

这条产线按「剧本批准才生成人物,人物批准才生成分镜」的门禁顺序推进:剧本拆成拍点,主演做成三视图和外观签名,分镜按竖屏节奏切好并通过 17 项检查,再往下做关键帧、配音、镜头视频和剪辑,最后给每集产出投放封面和预告。适合手上已有剧本或详细梗概的短剧编剧、制片和 AI 短剧工作室。

打开工作台,用「剧本视觉化」开工
参考片段:一支古装悬疑题材 AI 短片的画面,用来示意人物神态与线索道具同框的镜头质感,并非本产线直接生成的样例。

这条产线做什么

剧本拆场→锁构图分镜→主演角色资产→CP 剧照→竖屏海报的短剧视觉工业链。共 9 个环节:剧本 → 主演卡 → 分镜 → 预演 → 关键帧 → 配音 → 视频 → 成片 → 物料。

  1. 1拆解剧本

    把剧本拆成拍点:动作和台词交替成拍,台词按每秒 4.5 字折算时长,再用每集目标时长反推拍数。冷开场有硬性要求:第 1 拍必须抛出冲突,铺垫不能超过 10 秒。台词按角色聚合成台词本,每句标好配音音色和语速,后面直接对接配音。同名人物、同一场景当场合并成一个实体,为后面的一致性资产打底。

    输入
    你贴的剧本或剧情梗概、主演数量与设定、整体基调;没给的话,助理会用选择题一次问齐,信息齐之前不生成任何东西。
    交付
    结构化场次表(每场的场景、人物、道具、服装、情绪拍点、钩子位)和按角色聚合的台词本。
    人工确认点
    你逐场确认或整体批准后才允许生成人物;不通过就带着理由回去重写,不会自动跳过。
    容易翻车的地方
    前 10 秒还在交代背景,是竖屏短剧最常见的节奏问题。拆场时看到第 1 拍没有冲突,宁可调整剧本顺序。
  2. 2铸造主演资产

    给每位主演做一套角色设定:正、侧、背三视图用同一 seed 一次生成,面部与服装的外观签名写进每次出图提示词的开头,一致性靠「固定 seed 加签名复述」两道保险。再出一张情绪九宫格,覆盖剧本情绪拍点里出现过的所有情绪,后面视频里的表情靠它当参考。道具出状态变体(崭新、破损、血渍),剧情里道具变化时直接换图。场景设定图出无人版本,带固定参照物和尺度参考(门高、桌高)。

    输入
    批准后的场次表和人物清单。
    交付
    每位主演的三视图、外观签名、情绪九宫格和道具状态变体,以及场景设定图。
    人工确认点
    主演三视图和签名经你确认后才进入分镜;某一位不满意可以单独重做,不必推倒全部。
  3. 3锁定分镜

    按竖屏逻辑切分镜:每段一次生成不超过 15 秒,每镜 2 到 5 秒,主体占画面约三分之二,头顶预留字幕位。正反打成对出,两个视角的视线方向、轴线和背景互为镜像,防止跳轴。每镜的时长等于台词字数除以 4.5 再加表演留白,「听见→停顿→眼神→表情→说话」的情绪顺序直接写进分镜字段。分镜阶段不做新的叙事决定,发现剧本问题就记成批注退回剧本。

    输入
    场次表和主演资产。
    交付
    逐场分镜表(段、镜、9:16 构图描述、正打反打过肩机位、转场标记),以及黑白线稿。
    人工确认点
    17 项分镜检查全过才放行,包括段长、镜长、画幅、正反打成对、轴线连续、切点与台词对账、钩子前置、资产引用完整等。
  4. 43D 白模预演

    在导演台上把分镜落成 3D 白模时间线:助理先读取导演台状态,按分镜表提出构图、机位、走位方案,停下等你选;确认后逐镜细化走位与运镜,形成可以回放的预演。

    输入
    通过检查的分镜表。
    交付
    白模预演方案和你确认过的镜头方案记录。
    人工确认点
    方案选定之前不落任何镜头动作。
    容易翻车的地方
    竖屏画面窄,两人对话时很容易有一个人被挤出画面。白模阶段就把站位定好,比关键帧阶段再调省得多。
  5. 5渲染关键帧

    出每镜的起始帧、镜内切点帧,以及情绪高潮处的主演双人剧照(按海报构图,两人视线交叉并留出标题位)。起止帧双锁:本镜尾帧就是下一镜的起始帧,镜头之间才不跳。外观签名放在提示词开头,三视图管脸,场景设定图管背景。每张关键帧出来立刻和三视图并排比对,脸不像就当场重出,不带问题进视频。

    输入
    分镜表、白模方案和主演资产。
    交付
    每镜起始帧和切点帧、主演双人剧照、每场色调参照帧。
    容易翻车的地方
    双人同框最容易互相串脸,重要的对手戏建议先用正反打单人镜头交代,再用双人剧照收。
  6. 6合成配音

    先做声音,再让视频对齐声音:按角色生成全剧台词配音,每句一个独立文件并带时长戳;实测时长和预折算时长偏差超过一成的句子单独调语速重出,不做后期硬拉伸。台词之间的停顿按表演留白保留,停顿本身就是戏。每个角色全剧用同一个音色,跨集不变声。另出背景音乐的情绪段标记表和音效点位表。

    输入
    台词本、关键帧和分镜时长。
    交付
    按角色聚合的配音音频、背景音乐情绪段标记表和音效点位表。
    容易翻车的地方
    这一环依赖的配音上游目前可能返回不可用。遇到时助理会直接告诉你,不会假装完成;台词本和时长表仍然可以交给其他配音工具。
  7. 7生成镜头视频

    每镜生成一段竖屏原生视频,不做横屏生成再裁切,裁切会破坏构图和字幕位。情绪顺序写进视频提示词的时间轴:先微转头、停顿、看向对方、起表情,最后才开口。镜头之间用首尾帧链接,对话的正反打共享同一张背景帧。每镜只给一个运动指令(推、拉、摇、跟或固定),复合运动容易糊;时长贴着分镜表的 2 到 5 秒。

    输入
    关键帧、配音时长和分镜表。
    交付
    按镜头顺序命名的 9:16 视频片段,以及失败镜头的重试清单。
  8. 8剪辑成片

    按情绪剪辑拼接:下一镜的声音提前进入再切画面,或者画面先走、声音拖尾,对话戏和情绪转折戏优先这样处理。字幕逐字对齐配音时间戳,竖屏字幕最多两行。每集时长回到剧本折算的目标,超了先剪空镜和留白,不剪台词。

    输入
    视频片段、配音与字幕时间戳。
    交付
    每集 9:16 成片(字幕、人声、背景音乐混音),以及一份标好字幕、配音、节奏、转场的剪辑清单,方便在剪映等软件里继续改。
    人工确认点
    你看完整集通过,或者标出有问题的秒点;这一集通过之前,不会批量做后面的集数。
  9. 9产出投放物料

    给每集做投放包:3 张竖屏封面(钩子位、双人剧照、反转位各一),标题位留在上三分之一,人物脸和冲突元素必须出现;一支 15 秒竖屏预告,结构是 0 到 3 秒冲突钩子、3 到 12 秒悬念升级、12 到 15 秒卡在断崖处,不剧透反转;再配三种角度的标题简介文案(冲突直给、悬念提问、身份反差),分别对应不同封面去测。所有物料标注来源集数和镜头号。

    输入
    每集成片、剧照和钩子位标注。
    交付
    每集的 3 张封面、15 秒预告和三组标题简介文案。

适合谁 / 不适合谁

手上有写好的竖屏短剧剧本,想在开拍前把主演形象、分镜和节奏可视化,让导演、制片、投资方看同一版画面的编剧和制片人。

用 AI 直接做短剧的工作室,最头疼角色每集换脸、正反打跳轴、台词和画面对不上。

需要按集推进、每集都要配封面和预告的团队,希望物料和正片出自同一套资产。

还只有一个故事点子、没有剧本:先把梗概写清楚再来,或者从「小说影视化」拿现成的小说文本起步。

只需要投放封面、正片已经拍好:用「投放海报线」,它专门做封面批量和 A/B 变体。

横屏长片或电影级长镜头:这条线的分镜规则是按竖屏短镜设计的。

目前做不到或要注意的

  • · 配音环节依赖的上游目前可能不可用,遇到时会如实说明;台词本、时长表和剪辑清单照常交付。
  • · 图生视频目前适合 2 到 5 秒的短镜,复杂动作、多人打斗要拆成多个镜头,效果仍可能需要多次重出。
  • · 外观签名、固定 seed 和三视图能显著减少换脸,但跨集长期使用时仍建议每集抽查主演关键帧。

怎么开始

  1. 1打开首页,在模板转盘里点「剧本视觉化」,画布铺出 9 个环节;只想先做开拍前对齐,可以只勾剧本、主演卡、分镜、预演四环。
  2. 2贴上剧本或详细梗概,说明主演数量、各自设定和基调;缺什么助理会用选择题一次问齐。
  3. 3看计划卡:先做哪一集、分几步、大概花多少,确认后开跑。
  4. 4剧本、主演、分镜三个关口逐一确认,之后关键帧、配音、视频、成片在画布上依次推进;一集通过再做下一集。
  5. 5随时可以喊停,已完成的节点保留;失败的生成自动退回金币。

可以直接说的愿望

「这是我短剧第一集的剧本,豪门替嫁题材,两位主演,先拆场、做主演三视图,别急着出分镜。」

「第一集第三场是男女主在电梯里对峙,按竖屏切分镜,正反打成对,前 3 拍就要有冲突。」

「第一集已经通过,给它做三张竖屏封面和一支 15 秒预告,别剧透结尾的反转。」

去首页点「剧本视觉化」

和手工流程比,省在哪里

开拍前就看到同一版画面

主演形象、分镜和白模预演都是看得见的资产,导演、编剧、制片对着同一版画面讨论,不再各自脑补。

门禁挡住最贵的返工

剧本没批准不出人物,人物没批准不出分镜。手工流程里常见的情况是镜头都做了一半,才发现主演形象要改。

声音先定,画面对齐

配音时长先锁住,视频向音轨对齐,避免剪辑时才发现画面短了、台词念不完。

物料和正片同源

封面和预告直接从每集的钩子位、剧照里取,不用再从成片里一帧帧截图挑封面。

常见问题

AI 做短剧,怎么避免主演每集换脸?

主演的三视图用同一个 seed 一次生成,外观签名写进每次出图提示词的开头,关键帧出来后立刻和三视图并排比对,不像就当场重出。跨集使用同一套主演资产。这能明显减少换脸,但不是绝对保证,所以每集仍有人工确认点。

竖屏短剧的分镜时长怎么定?

按产线规则:每段一次生成不超过 15 秒,每镜 2 到 5 秒;每镜时长等于台词字数除以每秒 4.5 字,再加表演留白。分镜要通过 17 项检查,其中包括切点与台词逐字对账。

什么是正反打成对,为什么要一起生成?

两人对话时,一个镜头从 A 的肩后拍 B,另一个从 B 的肩后拍 A。两镜的视线方向、轴线和背景要互为镜像,分开生成很容易跳轴,所以产线要求一次生成一对,并共享同一张背景帧。

配音可以直接用吗?

配音环节依赖的上游目前可能不可用,遇到时助理会如实告诉你,不会假装做完。台词本里每句都标了音色和语速,时长表也在,可以直接交给你常用的配音工具或配音演员。

一定要按集推进吗,能不能一次做完全季?

产线默认一集通过后才批量做下一集,这是为了让第一集暴露的问题(主演形象、节奏、画风)只改一次。确认第一集没问题后,后续集数可以沿用同一套主演资产和分镜规则加快推进。

相关产线

相关行业

查看全部 8 条创作产线