外观
环节 2:分镜与美术设定
分镜表是剧本和生成工具之间的"接口文档"——视频生成按镜头计费,分镜表质量直接决定你的钱花得值不值。
1. 为什么漫剧必须有分镜表
先澄清一个概念:影视行业里"分镜"通常指画出来的故事板(storyboard)——一格一格的草图,把全片预演一遍。本管线不需要你画画:它把传统故事板拆成两步完成——本章产出的文字分镜表(定结构、定预算)+ 第 3 环节产出的关键帧图(每镜一张定稿图,就是 AI 时代的故事板,见图像资产生产)。所以"不会画画怎么做分镜"的担心可以放下:分镜阶段只需写清"怎么拍",画面由出图环节替你画出来。
传统影视可以现场调度和补拍,漫剧不行:每个镜头都是积分换来的,"拍了再说"等于烧钱。分镜表让你在开生成之前回答三个问题:
- 这一镜存在吗?(删掉不影响叙事的镜头,直接删)
- 这一镜多长?(3~6 秒甜区,决定积分预算)
- 这一镜要什么资产?(角色/场景/关键帧图,第 3 环节的采购清单)
2. 镜头语言速成(零基础版)
景别:装多少内容,离角色多近
| 景别 | 画面内容 | 漫剧用途 |
|---|---|---|
| 远景 | 人物很小,环境为主 | 定场、转场 |
| 全景 | 人物全身 | 动作戏、人物登场 |
| 中景 | 腰部以上 | 对话主战场 |
| 近景 | 胸部以上 | 情绪表达 |
| 特写 | 面部/物体局部 | 钩子、反转、高光时刻 |
景别 = 心理距离:景别不只决定"看到多少",还决定观众与角色的心理距离——镜头越近,观众离角色的内心越近:远景是旁观(交代世界),中景是社交距离(对话的自然距离),特写是闯入内心(情绪只给关键时刻)。由此得出一个配给原则:特写是配给制——全集滥用特写等于没有特写,配额怎么花见 §5 节奏。
构图:主体放哪,视线就跟到哪
景别决定"装多少",构图决定"怎么摆"。五条最常用法则:
- 三分法:画面横竖各三等分,主体放在分割线交叉点附近——比呆板的正中构图更有呼吸感。下面竖屏要点的"面部放画面上 1/3 处"正是它的落地。附一条配套规则——视线留白:人物面部朝向的一侧要多留空间(脸朝左,左边空一点),否则观众有"撞墙"的憋闷感;正反打两镜的人物各靠画面一侧、面对面留白,对话的空间感就出来了。
- 居中对称:主体放中轴、左右对称——仪式感与对峙感的来源:登场宣告、婚礼、审判、对决场面的首选。竖屏的中轴构图天然有压迫性的力量。
- 框架式构图:用门窗、走廊、前景物把主体"框"在画面里——强行收拢观众视线,顺带增加层次。竖屏横向窄、画面容易空,一个前景框立刻让构图立起来。
- 留白(负空间):主体只占画面小面积,其余留空——孤独、渺小、心事重重。独白与情绪留白镜头的标配:大面积天空、空房间的角落、雨夜的整条街道。
- 纵深三层:把画面想成前景(遮挡物/过肩的肩)、中景(主体)、背景(环境交代)三个图层的叠放——竖屏横向施展不开,层次感全靠纵深:哪怕只加一个虚化前景,画面立刻"贵"起来。
竖屏构图要点(9:16):竖屏横向空间窄,主体居中或略偏上,面部放画面上 1/3 处(信息流观看时离眼睛最近);避免依赖横向大调度(多人并排、大幅度横移),改用纵深(前后景)构图;字幕放中下部安全区,避开平台 UI 遮挡区。
横屏构图要点(16:9):横屏横向空间宽——横向调度回归(多人并排、水平运动、左右对称构图都可行);三分法是主战场(主体放左/右三分之一处,环境与视线空间自然留出);纵深从"必需"变"可选"(画幅自带层次);字幕放底部中央安全区(B 站/YouTube 播放器 UI 遮挡下沿)。
视觉引导:观众第一眼看哪,是设计出来的
五条法则管"怎么摆",视觉引导管"先看哪"——一帧画面里观众的视线落点只有一个先到,三件套任选一个做焦点:
- 光影焦点:画面里最亮的区域(冷环境里的一束暖光——图像资产·光影与色调的"焦点发生器");
- 色彩焦点:低饱和画面里的一个高饱和色块(60-30-10 的 10% 强调色);
- 构图焦点:引导线汇聚处 / 框架中心(走廊尽头的人、门框里的脸)。
规则:一镜一个主焦点,且焦点必须落在"这一镜要观众看的东西"上(分镜表画面描述列的主语)。自查:把关键帧缩到缩略图大小眯眼看——第一眼没落到主体上,这镜的构图就要改。
镜头角度:机位高低是态度
景别和构图决定画框里有什么,角度决定观众"站在哪看"——机位高低本身就是一种态度:
| 角度 | 机位 | 心理效应 | 漫剧典型用法 |
|---|---|---|---|
| 平视 | 与角色视线同高 | 客观、平等(默认视角) | 对话戏基准角度 |
| 俯拍 | 从上向下 | 角色显小显弱:弱势、被困、孤独 | 主角落难、被围堵、独处沉思 |
| 仰拍 | 从下向上 | 角色显高显强:强势、压迫、崇拜 | 反派登场、高光变身、权力宣告 |
| 倾斜(荷兰角) | 机位歪转、地平线斜 | 失衡、疯狂、"要出事"的预感 | 精神崩溃、阴谋揭晓前——一集 ≤1 次 |
另有鸟瞰(正上方垂直向下,上帝视角):展示格局与命运感,漫剧使用频率低,认知即可。
AI 管线落地:角度是构图属性,写进出图提示词("低角度仰拍""俯视构图"),出图阶段定死——视频阶段想换角度只能重新出图,所以分镜表就要写清角度意图。同一角色,弱势戏俯拍、翻盘戏仰拍,观众不用听台词就能感到地位反转。
景深:谁清楚,谁模糊
景深是画面里清晰的纵深范围——类比人眼:盯着眼前的人看时,背后的街景自然模糊,那就是浅景深的效果。它是景别与角度之外的第三个画面变量,决定观众的视线落在画面的哪一层。
- 浅景深(背景虚化):只有主体清晰,前后景糊成一片——视线聚焦器。对话特写、情绪镜头的标配:背景再杂,观众眼里也只剩角色的脸。
- 深景深(前后皆清):前景、主体、背景都清晰——展示空间关系时用:定场镜交代环境全貌、两人对峙时谁都不虚。
AI 管线落地:浅景深是出图提示词里的高频词("浅景深""背景虚化"直接可写),还附送一个工程红利——背景虚化天然掩盖 AI 生成的背景瑕疵(乱入文字、结构崩坏糊在焦外就看不见了)。竖屏对话戏默认可写浅景深;定场镜与需要交代空间信息的镜头保持深景深,别把全景也虚了。
焦段:透视是空间感的来源
景别、构图、角度、景深之外,还有一个更隐蔽的画面变量——焦段(镜头的焦距长短,以毫米计)。手机拍照的 0.5× / 1× / 3× 变焦就是在切焦段:站在原地不动,同一个你,0.5× 拍出来背景又远又全,3× 拍出来背景又大又近——焦段不改变你拍到了谁,改变的是空间的"弯法"(透视关系)。
摄影按焦距把镜头分三档(毫米数为全画幅等效,认知即可,写提示词不必记数字):
| 焦段档 | 透视效果 | 心理效应 | 漫剧典型用途 | 提示词写法 |
|---|---|---|---|---|
| 广角(24~35mm) | 空间被拉伸:前景显大、背景显远显全,画面边缘轻微畸变 | 开阔、临场;近距离拍人带压迫与变形感 | 定场镜交代环境全貌;仰拍 + 广角 = 反派登场的张力;狭小房间的局促感 | "广角镜头""超广角构图" |
| 标准(~50mm) | 接近人眼所见,无夸张变形 | 客观、自然(默认视角) | 对话戏基准档;不抢戏的日常镜头 | 通常不写(默认即标准) |
| 长焦(85mm+) | 空间被压缩:背景被"拉近放大"、层层叠叠 | 亲密、聚焦;隔着人群的窥视感;天然配浅景深 | 情绪特写(背景虚化成大色块);"人群中只看得见她";隔窗/隔人群的偷看镜头 | "长焦镜头,空间压缩""85mm 人像镜头" |
两个关键认知:
- 焦段 × 景别是乘法关系:景别定"装多少",焦段定"空间怎么弯"。同样是面部特写,广角特写会把鼻子拍大、背景推远(漫画式夸张可用,日常慎用);长焦特写把脸拍平、背景拉成柔和大色块(电影感情绪特写的标配)。分镜表写"特写"时顺手标上焦段意图,出图质感差一个档次。
- AI 出图默认偏"手机广角感":不给焦段词时,模型倾向输出"全景深 + 平均透视"的手机快照感画面——背景全清楚、空间扁平。这正是「常见问题」里"画面平、像贴纸"的头号根因之一,矫正手段就是主动写焦段(配合浅景深):对话特写写"长焦镜头,背景虚化",定场镜写"广角镜头,视野开阔"。
AI 管线落地:焦段与角度一样是构图属性,出图阶段定死——写进分镜表"画面描述"列,视频阶段改不了。另有一条统一性纪律:一场对话戏的正反打两镜用同一焦段档,空间感才一致(一镜长焦一镜广角,同一张脸在两个镜头里忽而扁平忽而立体,观众说不上原因但会觉得"不对劲")。
对话镜头:正反打与轴线
漫剧大半是对话戏,而对话镜头的拍法有成熟套路。三个术语一次讲清:
- 正反打:对话双方在两个机位之间交替拍摄——A 说切 A、B 接切 B。这是对话戏的默认拍法,也是把多人戏拆成单人镜头、规避多人同框崩坏的核心手法。
- 过肩镜头:从一方肩后拍另一方(画面里带一个肩膀或后脑勺),让观众明确"谁在对谁说话"。用在对话开场确立两人的位置关系,之后即可切单人正反打。
- 轴线(180° 规则):以两人连线为"轴线",所有机位待在轴线同一侧的半圆内;跨到对侧拍(越轴),两人在画面里的左右位置会瞬间互换,观众立刻出戏。
对话戏之外再认一个常客:POV 镜头(主观镜头)——画面 = 角色所见:桌上的信、门外的黑影、系统面板的弹窗。观众与角色同步获得信息,是揭示型钩子的标准拍法(钩子类型见剧本与故事)。它与反应镜头是一对搭档,组合用法见下文「反应镜头」一节。
实操推论:一场对话戏 = 1 个过肩(或双人全景)定场 + 若干单人正反打(中景/近景)——这就是本章「常见问题与对策」中"合并同场景对话镜头"的执行依据。
AI 管线中的屏幕方向:实拍有真实机位可调度,AI 漫剧的"机位"只存在于提示词与关键帧构图里——越轴的实际表现是"同一场戏相邻镜头中,角色左右位置无故互换"。落地两条:① 提示词写明角色方位("角色 A 位于画面左侧、面朝右"),正反打两镜的角色朝向互为镜像;② 出图验收时检查相邻镜头的角色左右位置是否连续,跳变就重抽,或在剪辑阶段对单镜做镜像翻转补救。
轴线进阶:运动轴线与三人对话。对话轴线之外还有运动轴线:角色朝一个方向持续移动(赶路、追逐、逃离)时,机位要待在运动路径的同一侧——否则相邻镜头里移动方向突然反转,观众会本能地以为角色折返了(剪辑阶段兑现为"方向匹配",见剪辑与成片)。三人以上对话的处理规则:以"当前对话最重的两人连线"为临时轴线,轮到谁说话切谁的单人镜;好在多人戏在漫剧里本就稀少(多人同框崩坏风险,见图像资产·多人镜头处理)——新手期记住"两人轴线 + 正反打"已足够覆盖九成对话戏。
场面调度(角色位置与走位):影视术语"场面调度"指角色在场景空间里的位置与运动安排——谁坐谁站、谁近谁远、从哪里入画。漫剧以对话戏为主、走位简单,落地只需两条:① 分镜表"画面描述"列写明角色的空间位置与朝向("A 坐画面左侧沙发、面朝右,B 站右侧门口"),正反打两镜互为镜像(见上文屏幕方向条);② 同一场戏各镜的空间关系,以该场景的多机位概念图为统一基准(见图像资产·场景与道具资产),角色的入画/出画方向写清——剪辑阶段兑现为"方向匹配"(见剪辑与成片)。
一场戏的空间设计:观众脑中的场景地图
场面调度的目标是让观众脑中有地图——空间三件套各有分工:
- 定场建立空间:一场戏开头 1 镜交代布局(谁在哪、门窗在哪、光源在哪)——观众自此把后续镜头"挂"进这张地图;
- 正反打维持空间:之后每镜的位置与朝向必须与地图一致(轴线与屏幕方向约定的作用就在于此);
- 空镜转换空间:换场时用空镜重置地图——新场景的第一镜就是新的定场。
检验法:任选一场戏的任一镜问"谁在哪、朝哪看"——答不出,就是空间没建立(缺定场)或被破坏了(越轴/位置跳变)。AI 管线的空间基准是同场景多机位概念图(图像资产)——概念图就是那张地图的实体化。
空镜:没有人格化主体的环境镜头(空房间、街道、天空、静物道具)。用于场景切换过渡、情绪留白、剪辑垫跳切——它是生成成本最低的一类镜头,转场生硬时先想到它。独白/旁白台词(形态见剧本与故事)常配空镜或反应镜头使用:既压缩镜头数,也天然规避对口型。
信息镜头(系统面板/聊天界面):系统流、重生流题材高频出现"系统提示界面""手机聊天记录"这类承载文字信息的镜头。不要让模型直接生成文字(小字渲染是已知缺陷,见缺陷与优势)——分镜阶段照常规划该镜头的景别、时长与出现时机,画面只生成背景或设备空镜,文字内容留到剪辑阶段用贴图叠加。
术语表
正反打、过肩镜头、空镜等本章术语已收录进术语表,阅读其他章节时可对照查阅。
运镜:提示词写法详见提示词工程·运镜词汇表(角度是静态构图选择,运镜是镜头的运动选择,两者分开决策)。分镜阶段记住三问——这镜要动吗(对话戏固定机位即可,运镜不是默认项);动了给谁看(运镜是观众注意力的导游:推近 = 跟我凑近看,拉远 = 退后看全局);停在哪(落幅构图比运动过程更影响观感——首尾帧运镜的本质就是先设计好落幅)。铁律不变:一镜一运镜,运镜服务情绪(推近=紧张/强调,拉远=孤独/收尾)。
30° 规则:相邻镜头别"原地踏步"
轴线管"机位别拍到对面去",还有一条同级的经典规则管"机位别原地不动"——30° 规则:拍摄同一主体的相邻两个镜头,机位绕主体的夹角至少 30°。达不到时,两张画面高度相似又略有不同,剪在一起观众感知为"画面跳了一下"(跳切)——不是穿帮,但廉价感十足。
AI 管线落地两条:
- 分镜表自查:相邻两镜拍同一角色时,景别至少跳一档(中景 → 近景),或角度/机位明显变化(正面 → 45° 侧面)——"近景 → 近景、同角度、同构图"是最常见的偷懒写法,剪出来就是跳帧;
- 出图验收加一项:把相邻两镜的关键帧并排看——"太像"就改其中一镜的构图,别留到剪辑阶段才发现(剪辑的补救只有镜像翻转与插空镜,见剪辑与成片)。
注意它与首尾帧链式衔接并不矛盾:链式衔接追求"上一镜尾帧 = 下一镜首帧"的动作连续(接着演),30° 规则管的是同一时刻同主体的机位切换(换个机位看)——前者靠"完全一样"达成无缝,后者忌"几乎一样"造成跳帧。
反应镜头:戏在听者脸上
反应镜头不拍"说的一方/做的一方",而拍接收动作的那一方——听者、挨骂的人、推开门看到真相的人。它是漫剧性价比最高的镜头类型,却最常被新手漏掉:新手写分镜只会"谁说话拍谁",整集都是说话人的脸;老手知道戏往往长在听者的脸上。
为什么反应比动作本身更有戏:台词与动作只给信息,反应才给情绪——观众对一件事"该怎么感受",是通过角色的脸校准的。同一句"孩子是我的",接听者瞪大的眼睛是震惊戏,接听者别过脸去是虐心戏,接听者嘴角上扬是暗爽戏——台词没变,戏全在反应里。删掉反应镜头,观众只是"知道了剧情",却感受不到"剧情有多重"。
什么时候切反应镜头(五种典型时机):
- 重台词落地时:反转、告白、噩耗、身份揭晓之后,别急着接下一句——镜头在听者脸上停 1~2 秒,让情绪先落地。这是高潮特写配额最常见的花法(见 §5)。
- 连续正反打超过 4~5 个来回:插一个反应镜头打破"你一句我一句"的乒乓感(即 §5 经验法则第 4 条)。
- 长台词与独白/旁白的画面填充:一直拍说话人既单调又暴露口型,切到听者(或空镜)藏口型、添层次——漫剧大量内心独白的标准配法(见剧本与故事)。
- 揭示前的蓄力:先给听者的瞳孔地震,再切 POV 揭示他看到了什么——悬念翻倍;顺序反过来(先 POV 再反应),则把情绪一口气推到底。"反应 × POV"是揭示型钩子的黄金组合。
- 工程上需要藏拙时:说话人不在画面里 = 这一镜不用对口型;单人出镜 = 规避多人同框崩坏。反应镜头正是"规避口型"与"拆单人镜头"两大省预算手法的交汇点。
反应的三个层次(按情绪强度选):
| 层次 | 画面 | 承载景别 | 适用 |
|---|---|---|---|
| 微表情 | 瞪眼、瞳孔收缩、嘴角抽动、眼眶泛红 | 近景/特写 | 日常情绪波动 |
| 肢体外化 | 攥拳、后退半步、茶杯从手中滑落 | 中景/近景 | 强情绪——动作比脸更有信息量,且不依赖面部生成精度 |
| 无反应 | 面无表情、沉默定格 | 特写缓推 | 最大张力——"他毫无反应"本身就是戏(隐忍、心死、暴风雨前的平静) |
AI 管线落地:
- 分镜表写法:景别多为近景/特写;台词列写"无"或标注说话人的画外音(如"(画外)顾辰:你再说一遍")——提醒剪辑这一镜的声音在说话人那边。
- 资产依赖:反应镜头吃的是角色的表情差分存货——基准四件套是"喜/怒/悲/惊",再按剧本追加剧集定制项(本剧可加"冷/锋利",惊定可按需);按图像资产生产的表情差分 SOP 提前备齐(口径与该章一致),否则分镜写了也拍不出来。
- 声音配合:反应镜头里说话人的台词往往仍在继续——画面切走、声音延续,这正是剪辑与成片的 L-cut;剪辑时在情绪落点上垫一个音效重音(心跳、鼓点),落地感更强。
镜头句子:一场戏的景别推进语法
单镜合格之后,下一个问题是"一场戏的镜头按什么顺序排"。经典分镜语法把一场戏的镜头序列归纳成三种"镜头句子"(景别的推进模式):
| 句式 | 景别序列 | 叙事功能 | 漫剧典型场景 |
|---|---|---|---|
| 前进式 | 全景 → 中景 → 近景/特写 | 常规叙事:先交代环境与人物关系,注意力逐步收窄到情绪 | 一场戏的默认开头;对话戏的"定场 → 正反打 → 重台词特写" |
| 后退式 | 特写 → 中景 → 全景 | 悬念揭晓:先藏起环境,最后一拉"原来如此" | 揭示型钩子的标准拍法——剧本范例的镜 1~4(机票特写 → 睁眼近景 → 书房全景)正是此式 |
| 循环式 | 全景 → 特写 → 回到中景/全景 | 对比与回环:情绪推到高点后落回现实 | 爽点释放后的收束:打脸特写 → 拉回全场众人的反应 |
三条用法说明:
- 它是默认模板,不是公式——一场戏不知道从哪个景别开头时先用前进式;要藏信息时换后退式。熟练后按情绪自由变化,但没有模板时的"随机排"几乎总是更差;
- 与 §5 节奏表是两级分工:节奏表管"集"级的段落密度(钩子/升级/高潮/悬念各占多少、排多密),镜头句子管"场"级的镜序(一场戏内部景别怎么推进)——集级定快慢,场级定先后;
- 对话戏的"1 个过肩定场 + 若干单人正反打"(见上文对话镜头节)就是前进式句子的标准开头。
横屏形态:镜头语言的另一套参数
形态决策选了横屏后,本节所有概念依然成立,但默认值换一套:
| 参数 | 竖屏默认 | 横屏默认 |
|---|---|---|
| 调度方向 | 纵深为主(横向窄) | 横向回归(多人并排、水平运动可行) |
| 景别分布 | 中近特为主(小屏要近) | 中全景占比上升(画幅自带信息量) |
| 特写占比 | 高(竖屏是特写驱动) | 下降——特写配额更经花 |
| 多人同框 | 规避(画幅 + 模型双重不允许) | 画幅允许 ≠ 模型允许:崩坏风险不变,仍按多人镜头处理三路径执行 |
| 定场镜 | 每场景 1 个(省预算) | 价值上升——横屏环境信息量大,定场镜更"值回票价" |
横屏下表演载体的权重也随之变化(肢体上升、面部依赖下降),见表演设计·横屏形态的表演差异。
镜头验收:两档量规
| 维度 | 合格线(能用) | 优秀线(好看) |
|---|---|---|
| 构图 | 主体位置合理、形态构图要点执行 | 视觉引导自觉:每镜一个主焦点,第一眼落点 = 本镜主体 |
| 镜序 | 景别有变化、过 30° 规则 | 每场戏有自觉的镜头句子(前进/后退/循环),景别推进与情绪对位 |
| 空间 | 不越轴 | 观众脑中有场景地图:任一镜说得出"谁在哪、朝哪看" |
| 运镜 | 一镜一运镜 | 运镜有情绪语义(推 = 逼近、拉 = 疏离、环绕 = 高光);落幅构图经设计 |
正反对照(同一场对话戏的两种拆法):
text
常见做法(合格):6 个镜头全是"中景正面"——不越轴、没毛病,也毫无设计。
更好做法(优秀):过肩定场(建空间)→ 正反打中景 ×2 → 重台词切听者近景(反应)
→ 情绪顶点推近特写(焦点收口)——前进式句子 + 视觉焦点 + 空间三件套。3. 分镜表格式(直接可用)
用任意表格工具(飞书多维表格、Notion、Excel 均可)建表,字段:
先建 6 列空表(以下三行为格式演示,数值为示意、非后文 16 镜实例数据):
| 镜号 | 景别·运镜 | 画面描述 | 台词 | 时长 | 资产 |
|---|---|---|---|---|---|
| 1 | 特写·固定 | 机票特写,航班信息 | 无 | 3s | 场景-书房夜 |
| 2 | 近景·推近 | 顾辰睁眼,眼底冷下来 | 顾辰:我回来了 | 4s | 角色-顾辰居家 |
| 3 | 全景·摇 | 书房全貌,窗外夜色 | 无 | 3s | 场景-书房夜 |
再补两列工程字段:生成状态(待出图/待出片/已验收)与成本(积分消耗)——这两列让它同时成为生产管理表。
时长列的估法:台词时长 ≈ 台词字数 ÷ 5(中文配音约 4~6 字/秒,见剧本与故事),估算取整到秒、实际按配音节奏微调(如后文实例镜 5:37 字 ÷ 5 ≈ 7.4 秒,填 8 秒);估算超 6 秒的台词镜头要么拆镜、要么删台词——在写表阶段解决,比素材生成后返工便宜。例外:独白长镜头(情绪/信息密度高的独白段落)可填 7~8 秒——这类镜头不硬抽视频生成:用静帧化(关键帧位移/缩放模拟运镜,见剪辑与成片)或 6 秒生成素材 + 剪辑慢放(≤1.2 倍)/定格补足时长,下文实例的镜 4/5/10/12 即按此例外处理。无台词镜头按画面信息量在 3~6 秒甜区内定。
完整实例:第 1 集分镜表(16 镜)
把剧本章的完整范例(90 秒、剧本 12 镜)拆成分镜表——注意分镜会在剧本镜头基础上再拆细(12 镜 → 16 镜):12 镜 + 1 反应特写("睁眼"拆出,镜 3)+ 1 空镜(窗外夜色,作节奏缓冲,镜 14)+ 2 处拆分(心瑜的消息弹窗独立成镜,镜 9;剧本镜头 8 的"盯屏幕 + 打字回复"拆成两镜,镜 10、11)= 16 镜。
| 镜号 | 景别·运镜 | 画面描述 | 台词 | 时长 | 资产 |
|---|---|---|---|---|---|
| 1 | 特写·固定 | 书桌上的机票,航班信息"明早 8:00",冷光 | 无 | 2s | 场景-书房夜 |
| 2 | 近景·推近 | 顾辰睁眼,静静看机票,眼底一寸寸冷下来,低调侧光 | 独白 19 字 | 6s | 角色-顾辰居家 |
| 3 | 特写·固定 | 顾辰面部,眼神由茫然转锋利(反应镜头,声音延续) | (画外独白续) | 2s | 角色-顾辰·锋利 |
| 4 | 全景·固定 | 书房全貌,打包到一半的家:纸箱、行李箱、墙上合照 | 独白 32 字 | 7s | 场景-书房夜 |
| 5 | 中景·固定 | 俯拍过肩:拿起合照(心瑜抱念念,他站边上像局外人) | 独白 37 字 | 8s | 道具-合照 |
| 6 | 近景·缓推 | 扣下合照,打开电脑,屏幕亮起 | 独白 27 字 | 6s | 道具-电脑 |
| 7 | 特写·固定 | 电脑屏幕:星图企划书《星图_v6_final》(文字后期贴图/虚化) | 独白 27 字 | 5s | 信息镜头 |
| 8 | 近景·固定 | 手机震动,顾辰拿起手机 | 无 | 2s | 角色-顾辰居家 |
| 9 | 特写·固定 | 手机屏幕:心瑜消息弹窗(后期贴图) | 无 | 3s | 信息镜头 |
| 10 | 特写·缓推 | 顾辰盯屏幕,面无表情 | 独白 34 字 | 7s | 角色-顾辰·冷 |
| 11 | 近景·固定 | 打字回复"好",表情平静 | 独白 7 字(另屏幕文字 1 字) | 4s | 角色-顾辰居家 |
| 12 | 近景·推近 | 拉开抽屉底层,摸出旧 U 盘握进掌心 | 独白 31 字 | 8s | 道具-U 盘 |
| 13 | 特写·固定 | U 盘躺在掌心,屏幕冷光掠过眼镜 | 无 | 2s | 道具-U 盘 |
| 14 | 空镜·缓推 | 窗外夜色,对面写字楼零星灯光(节奏缓冲) | 无 | 3s | 场景-书房夜·窗外变体 |
| 15 | 特写·固定 | 手机再震:陌生短信(后期贴图) | 无 | 4s | 信息镜头 |
| 16 | 特写·缓推定格 | 顾辰瞳孔收缩,画面定格 | 独白 15 字 | 5s | 角色-顾辰·惊 |
读表要点(对照 §5 节奏表验收这张表):
- 密度分布:钩子段(镜 1~3)平均 3.3 秒/镜且全部特写/近景——"钩子段镜头最密、景别最近";升级段(4~11)主体回到 3~6 秒甜区(镜 8 消息打断压至 2 秒,是快切点例外),三段情绪独白按上文例外条款填 7~8 秒(镜 4/5/10);高潮(12~13)镜 13 只有 2 秒,同为快切点;悬念段(14~16)用空镜主动降速后停在定格。
- 特写配额:全表 8 个特写,其中 5 个花在钩子、高潮、悬念(镜 1/3/13/15/16)——"特写是配给制"(§2)的实例。
- 台词列的画外标注:镜 3 写"(画外独白续)"——提醒剪辑这镜的声音在上一镜延续(L-cut,见剪辑)。
- 资产列命名:"角色-顾辰居家"= 顾辰居家状态基准图("居家"是场景状态后缀,非服装变体——全剧无换装计划);"角色-顾辰·冷/锋利"= 对应表情差分。
- 时长列是预估值:合计 74 秒 + 台词实际配音后的呼吸留白,最终落在 80~90 秒区间——剪辑阶段按"先音后画"微调(见剪辑),分镜表不需要精确到 0.1 秒。
从分镜表到预算:成本联动演算
分镜表定稿的这一刻,单集视频成本就已经可算了(公式与参数口径见视频生成·抽卡与成本控制):
text
本表 16 镜拆解:
人物/道具镜头 12 镜(含机票、U 盘等特写)≈ 59s → 走图生视频
空镜 1 镜 × 3s = 3s → 可 T2V(无一致性问题,单价更低)
信息镜头 3 镜(贴图镜头) → 关键帧静帧 + 剪辑贴图,不走视频生成
视频生成量 ≈ 62s
按 720P 混合档 0.5 元/s × 重抽率 1.5 估算 ≈ 47 元/集再算三笔"假如"账,理解剧本/分镜决策如何兑现为成本:
- 假如信息镜头让模型生成文字:+3 镜的视频生成费,且小字必糊(机制见视频模型原理),大概率反复返工——贴图路线约等于免费。
- 假如独白改成对白:近景说话镜头全部要做口型 → 按全部人物/道具镜头做口型的上限估算:≈59s × 0.45 元/s ≈ +27 元/集(对口型价格见音频);实际按音频章惯例只做正面说话的特写镜头,成本远低于此——还不算口型失败的返抽。
- 假如场景从 1 个涨到 4 个:多 3 套场景概念图与定场镜,出图成本约 +30%,且跨场景色调统一难度上升(剪辑·调色统一)。
结论:剧本阶段的"独白为主 + 信息镜头贴图 + 场景预算",在分镜这一步直接兑现为约一半的成本差——这就是"分镜表质量决定钱花得值不值"(本章开头)的量化含义。
4. AI 辅助拆分镜
把单集剧本丢给 LLM,用下面的提示词出分镜初稿(可直接复制的成品见提示词模板速查):
text
你是漫剧分镜师。把下面的剧本拆成镜头的分镜表(竖屏单集 1~2 分钟:先定成片总长,按平均 4~5 秒/镜倒推,通常在 15~25 镜之间;横屏单集 4~8 分钟约 40~120 镜——定场/信息镜可放宽至 5~10 秒,见 §5 横屏时长结构)。
约束:① 每镜头 3~6 秒(独白长镜头可放宽至 7~8 秒,见 §3 例外条款);② 单镜头单一动作、单一运镜;
③ 按所选形态构图(竖屏 9:16 时面部特写放画面上 1/3);④ 对话镜头优先中景与近景正反打;
⑤ 开头 3 秒必须是特写或冲突画面。
输出格式:镜号 | 景别 | 运镜 | 画面描述(可直接用作 AI 绘图提示词的具象描述)| 台词 | 时长。
剧本如下:<贴入剧本>人工修正三个点(AI 分镜的典型毛病):
- 动作堆叠:一个镜头写了两个动作 → 拆成两镜;
- 运镜冗余:对话镜头加运镜 → 删掉,对话镜头固定或微推即可;
- 时长注水:单个镜头写 8~10 秒 → 压回甜区,长信息拆镜头。
动作戏怎么拆:预备-动作-结果三镜法。打斗与动作场面是拆镜的特殊考题——一个"摘镜对峙"若只给一镜,观众只看到一团模糊。经典拆法是给每个关键动作配三镜:① 预备(蓄力:握眼镜的手收紧、脚步沉下——让观众知道"要来了");② 动作(打击本体,可用 0.5~1 秒快切或特写强化冲击);③ 结果(动作的后果:对手倒地、旁人倒吸凉气——往往就是一个反应镜头,见 §2)。三段式让动作有因果、有力度,也顺带把一个大动作拆成了 AI 能稳定生成的三个小动作(逐镜生成与衔接方法见视频生成·动作控制)。
三镜法拆分示例——一个 4 秒的动作单元(第 2 集,顾辰摘镜抬眼逼退拦路者):
| 镜 | 段落 | 景别·运镜 | 画面描述 | 时长 |
|---|---|---|---|---|
| 1 | 预备 | 近景·缓推 | 顾辰握眼镜的手收紧,指节发白 | 1.5s |
| 2 | 动作 | 特写·固定 | 摘镜抬眼,眼神如刀 | 1s |
| 3 | 结果 | 中景·固定 | 拦路者后退半步、旁人倒吸凉气(反应镜头) | 1.5s |
衔接与生成:镜 1 尾帧(手部收紧构图)截图作镜 2 首帧、镜 2 尾帧作镜 3 首帧——首尾帧链式衔接(角色一致性·路线三),三段各自"单动作",恰好把 AI 最难的大动作拆成三个稳定小动作。注意镜 2 只有 1 秒——短于生成甜区下限,这类镜头直接用首尾帧生成 3 秒素材、剪辑时切短(生成素材 3~6 秒、剪辑阶段按节奏切短,见剪辑·镜头时长)。
5. 分镜节奏:先排情绪,再排镜头
逐镜合格 ≠ 整集好看——"每镜都达标、整集却平"是分镜阶段最常见的隐性翻车。节奏要在写分镜表时就设计:把剧本的情绪曲线翻译成镜头密度与景别的变化。
单集四段情绪曲线与镜头参数的对应(基准:竖屏单集 1~2 分钟、15~25 镜;横屏按时长同比放宽,见下文横屏时长结构):
| 段落 | 约占全集 | 情绪任务 | 景别倾向 | 密度指引 |
|---|---|---|---|---|
| 钩子 | 开头 ~10% | 3 秒内抓住人 | 特写/冲突画面直接进场,不用定场远景 | 镜头最密:分镜表按 2~4 秒/镜设计,成片剪辑时可进一步切短至 1~2 秒/镜 |
| 升级 | 中段 ~60% | 矛盾加码、释放信息 | 中景/近景正反打为主战场 | 常规密度:分镜表按 3~6 秒甜区写 |
| 高潮 | 后段 ~20% | 冲突爆发 | 特写与近景占比拉高 | 密度最高:可留 0.5 秒级快切点 |
| 悬念 | 结尾 ~10% | 留下集钩子 | 近景定格或空镜缓推 | 主动降速:镜头拉长,停在悬念画面 |
表内百分比为基准指引,看的是密度对比而非逐段精确对齐——上方实例的钩子段(镜 1~3)占 10s/74s≈13.5%、悬念段(镜 14~16)12s≈16.2%,超出指引是因为钩子段含 6 秒级独白镜头、悬念段含空镜缓冲,属正常留白;高潮段(镜 12~13)10s≈13.5% 低于 ~20% 指引,则是 8 秒独白长镜摊薄了段落占比——高潮的密度看镜 13 的 2 秒快切点,不看段落总占比。所以自查判据不是"占比偏差 ±5%",而是逐段对照情绪任务是否达成、段间密度对比是否拉开;只有当密度关系与情绪任务明显错位(如高潮段反而比升级段更疏、钩子段开头 3 秒没有特写或冲突画面)时,才值得回头检查节奏是否失控。
经验法则:
- 情绪越高,景别越近、镜头越短——特写配额只花在钩子与高潮;日常对话用中景/近景正反打即可,别全程特写。
- 对比产生节奏——一段密集快切后接一个长镜头或空镜,观众才有"喘口气"的对比;全集匀速等于没有节奏。
- 高光镜头预算倾斜——每集标 2~3 个高光镜头(钩子冲突特写、高潮反转特写、结尾悬念帧),重抽次数向它们倾斜,其余镜头过验收线就收。
- 连续正反打不超过 4~5 个来回——超过就插一个反应镜头或空镜打破单调(也是规避多人同框的手法,见第 2 节)。
- 密度意图写进分镜表——时长列按 3~6 秒甜区填,密度用备注标出(如"此处 3 连快切");剪辑阶段的切短与调味法则见剪辑与成片,两头呼应。
横屏时长结构:4~15 分钟的节拍扩展
四拍框架(剧本章节拍表)不变,但横屏单集时长是竖屏的 2~8 倍(平台惯例 4~15 分钟,见剧本·单集体量;注意区分时长倍率与制作量倍率:因下述镜头密度放宽、静帧化与空镜占比可提高,横屏实际制作量约为竖屏的 2~5 倍,见全流程总览·形态决策),结构差异三条:
- 升级段容纳 2~4 轮目标-障碍循环(竖屏 1~2 轮)——每轮 75~90 秒,轮间需要"变速点"(新信息/新人物/场景切换)防中段塌掉;
- 留存机制不同:竖屏防"3 秒划走",横屏防"渐进流失"——YouTube 口径前 30 秒平均流失 20~30%【社区专家口径】,之后每 30 秒给观众一个继续看的理由(新信息/小反转/画面变化);平台留存曲线上的每个陡坡,都对应一个"没给理由"的段落;
- 镜头密度基准放宽:单镜 3~6 秒甜区不变(模型约束),但横屏的定场镜/信息镜头可以更长(5~10 秒),快切点密度不必像竖屏那样极致——横屏观众对"慢一点"的容忍度更高,对"画面糙"的容忍度更低。
以 4 分钟(240 秒)横屏单集为例的镜头量分布骨架(接近 40~120 镜区间下限):
| 段落 | 时间配额 | 镜头数 | 要点 |
|---|---|---|---|
| 钩子 | 0~30 秒 | 4~6 镜 | 前 30 秒留存生死线,冲突直接进场 |
| 升级 | 30~195 秒(2 轮循环 × 75~90 秒) | 24~36 镜(每轮 12~18) | 轮间设变速点;定场/信息镜可用 5~10 秒长镜 |
| 小高潮 | 195~225 秒 | 5~7 镜 | 全集情绪最高点,特写配额集中 |
| 悬念 | 225~240 秒 | 2~4 镜 | 新钩子直通下一集开头 |
| 合计 | 240 秒 | 约 35~53 镜 | 单镜均长 4.5~7 秒,比竖屏略长 |
节奏验收:两档量规(集级)
| 维度 | 合格线(能用) | 优秀线(好看) |
|---|---|---|
| 段落结构 | 四拍齐全、密度对比拉开 | 情绪曲线有形状:蓄能多久、哪一秒松手是设计值(不是感觉值);钩子/高潮/悬念段与升级段的镜头密度比 ≥2 |
| 留存自觉 | 无拖沓镜头(删掉不影响理解的即删) | 每一秒都有留下来的理由:逐镜答得出"这一秒观众在看什么、期待什么"——答不上的删或改 |
镜头级与声音节奏的优秀线在剪辑侧兑现,见剪辑·节奏量规——分镜管设计,剪辑管兑现。
6. 美术设定:在出图之前定版
分镜表完成后、批量出图之前,先完成两件"定版"工作(详细操作见图像资产生产):
- 画风定版:先按题材在画风图谱与挑选指南选定谱系(新手起步建议、一致性难度排序见该页 §6),再选 1~2 张参考图作为全剧画风锚点,测试图像模型能否稳定复现该画风;定版后把画风提示词段存入固定模板,全剧复用。
- 资产清单:从分镜表汇总——出场角色清单(各需定妆照+三视图+表情差分)、场景清单(各需概念图+日夜变体)、关键道具清单。这就是第 3 环节的生产任务书。
资产清单回答"要生产哪些";每个角色与场景该设计成什么样是清单落笔前的上游决策——方法与共通判据见造型与场景设计(性格→视觉翻译、场景即叙事,各配两档验收量规)。
7. 常见问题与对策
| 问题 | 对策 |
|---|---|
| 画面平、没层次、像"贴纸" | 全是"中景平视正面 + 默认广角感"惹的祸——特写写长焦 + 浅景深压缩空间(见 §2 焦段)、换角度(俯/仰)、加虚化前景、用框架式构图 |
| 分镜表拆了 40+ 镜头,预算爆炸 | 合并同场景对话镜头(中景正反打轮流用);远景定场镜每场景只保留 1 个 |
| 同一角色在多镜里动作衔接不上 | 相邻镜头共享构图元素;关键动作用首尾帧链式衔接 |
| 画面描述太抽象,出图不稳定 | 按图像提示词模板改写为具象描述 |
| 不知道每集拆多少镜头合适 | 竖屏单集 1~2 分钟 ÷ 平均单镜 4~5 秒 ≈ 15~25 镜;横屏单集 4~8 分钟 ≈ 40~120 镜(定场/信息镜可 5~10 秒,取上限时先算预算),拉片验证(W1 任务) |
8. 动手练习
把第 1 集剧本拆成完整分镜表。
- LLM 初稿 + 人工修正三个点;
- 验收:15~25 镜、每镜时长 3~6 秒(独白长镜头可放宽至 7~8 秒,见 §3 例外条款)、每镜画面描述可直接用于出图;
- 汇总资产清单(角色/场景/道具),作为下一环节的生产任务书。