外观
环节 4:视频生成
本章是漫剧制作的成本中心:约七成半的积分消耗在这里(按预算表演算:视频 60 元 ÷(视频 60 + 图像 20)≈ 75%,口径见工具清单与预算表)。核心命题有三个——图生视频怎么操作、运镜与动作怎么控制、抽卡成本怎么管。
1. 工具选择(截至 2026 年 9 月)
漫剧向国产工具四选,按你的镜头类型分工:
| 工具 | 当前模型 | 漫剧适配定位 | 参考成本(社区实测口径) |
|---|---|---|---|
| 即梦 AI | Seedance 2.5 | 主力:多图参考 + @语法调度,支持最长 30 秒原生(超长模式约 3 分钟);图+视频同生态;支持音频驱动(上传配音、生成端同步口型,见音频章)【官方发布口径】 | 720P 约 0.9~1.4 元/秒 |
| 可灵 AI | Kling 3.0 | 长镜头与动作连贯担当:元素绑定(支持参考视频)、大师运镜、4K、平台内置对口型(事后驱动,见音频章) | 5 秒标准条约 1 元;高档会员约 0.43 元/秒(两个单价对应不同档位/计费模式,横向比价前先对齐前提,口径说明见工具清单与预算表) |
| Vidu Q3 | Vidu Q3 | 动漫画风传统强项:参考生视频最多 7 图,主体库适合角色绑定 | 720P 约 0.4 元/秒(错峰更低) |
| 通义万相 API | Wan 2.6 / 3.0(3.0 于 2026-08 上线,原生 30 秒、多模态参考) | 量产降本备选:flash 档单价最低,适合程序化批量生产 | 720P 0.6 元/秒(wan2.6-i2v);flash 档约 0.15~0.3 元/秒(随版本浮动,以百炼定价页为准) |
价格时效
以上价格为 2026 年 9 月的社区实测或官方定价页口径。即梦 2026 年 4 月曾"三连涨"(新用户月积分缩水约 4~6 成、VIP 通道加价,老用户权益不变【媒体多源】),平台调价已成常态——下单前务必以各官网实时价格为准(验证渠道见附录)。完整价格表见工具清单与预算表。
各模型能力维度的横向对比(时长上限 / 分辨率 / 参考图能力 / 对口型等)见附录:模型能力对比。
起步组合建议:即梦会员(图+视频一体,角色参考方便)+ 可灵会员(长镜头、对口型备用)。Vidu 作为动漫画风备选试用(免费额度先试)。万相 API 留给量产期程序化处理。
各平台操作对照速查
同一个生成意图,在三个平台上的操作落点(功能名为 2026 年 9 月口径,入口名称随版本调整,以各平台当前页面为准):
| 操作点 | 即梦 | 可灵 | Vidu |
|---|---|---|---|
| 图生视频入口 | 视频生成 → 上传首帧图 | AI 视频 → 图生视频 | 图生视频 / 参考生视频 |
| 挂角色参考 | 上传参考图,提示词写 @图1 | 预建"元素"(多角度图或参考视频),提示词 @元素名 | 主体库上传 1~7 张参考图 |
| 首尾帧模式 | 首帧 + 尾帧各上传一张 | 首尾帧模式上传两端图 | 支持首尾帧 |
| 参考强度 | 智能参考强度滑块 | 元素权重 | 参考强度 |
| 档位选择 | 模型代际 + 速度档组合 | 标准 / 高品质 / 大师运镜 | 标准 / 错峰闲时档 |
| 典型分工 | 日常镜头主力 | 长镜头、动作连贯、对口型 | 动漫画风镜头、错峰降本 |
用法:每镜生成前对照此表决定"这一镜去哪家"——对话戏等常规镜头留即梦(与出图同生态,参考图直接复用);7~8 秒级长镜头、动作连贯要求高的镜头去可灵;动漫风格难调的镜头试 Vidu;批量任务见 §5 量产工程。
2. 标准操作流程
每个镜头的生成按五步走:
text
① 关键帧定稿(第 3 环节已验收的图)
→ ② 选模型与档位(极速档探路 / 高品质档定稿)
→ ③ 写视频提示词(主体+单一动作+运镜+氛围)
→ ④ 生成(挂参考图/元素,设时长与比例)
→ ⑤ 验收:通过则入库记账,不通过进入抽卡策略(第 5 节)参数设置要点:
- 时长:默认 3~6 秒。确有必要的长镜头(情绪铺垫、连续动作)可至 7~8 秒(分镜章独白长镜头例外条款的口径);更长的时间跨度应拆镜,或用首尾帧链式衔接接力——时长越长漂移越不可控,单价还更贵。
- 分辨率:极速/标准档用于探路(验证动作与运镜对不对),高品质档只给定稿镜头用。加速档本质是蒸馏模型(原理见视频模型原理),便宜但细节略降。
- 比例:与关键帧图一致(竖屏 9:16 / 横屏 16:9,按形态决策),避免裁切。
- 帧率:平台输出帧率以导出文件属性为准(常见 24/25/30fps),下载后记下即可——剪辑·导出规格需要与素材帧率对齐(帧率的概念与"为什么要对齐"见数字媒介基础·视频)。
实操演示:一个镜头从分镜到入库
以分镜表中的一行为例,完整走一遍五步流程(角色:结业剧男主顾辰,与剧本章范例、分镜章 16 镜表同一案例链):
text
分镜表输入:镜 2|近景·推近|顾辰睁眼,眼底一寸寸冷下来|独白|6s|资产:角色-顾辰居家① 关键帧定稿:取第 3 环节已验收的关键帧 keyframe/ep01/002.png——顾辰睁眼静视机票的近景构图。出图阶段已确认角色一致、无崩坏瑕疵,这一步只需"取",不再"改"(图像章 §5 的调试实录演示的是镜 12,流程相同)。
② 选模型与档位:睁眼 + 眼底冷下来 = 微表情镜头——难点不是大幅度动作畸形,而是模型"不动"(6 秒毫无变化)或"加戏"(擅自起身、转头)——微表情镜头同样属高发翻车区。策略:即梦极速档探路验证动作方向,过了再切高品质档定稿。
③ 写视频提示词(v1):
text
@图1 的顾辰缓缓睁眼,目光落在书桌机票上,眼底一寸寸冷下来。
镜头缓慢推近。氛围压抑。提交前按 §2 模板自查:单一动作(睁眼静视)✓ 单一运镜(推近)✓ 未复述外貌(@图1 已锁定)✓。
④ 生成:上传关键帧为首帧 + @图1 挂角色参考,时长 6 秒、9:16,极速档先抽 2 条。
⑤ 验收(对照 §5 验收清单逐条判):
- 第 1 条:睁眼与眼神变化成立,但运镜没有发生——镜头始终停在原构图;另在第 4 秒画面边缘有轻微果冻感(背景柜角扭动,机制见视频模型原理·时空 patch 与"闪烁"的根源)——瑕疵在画面边缘、时长短,本可容忍,但"运镜符合"一项不过,整条例废;
- 第 2 条:果冻感没了,运镜依然没推近——两条死在同一条验收项(运镜符合)上,"画面挺好看"不算过。
诊断与复抽:运镜没发生,按决策树第一级"改提示词"处理——把运镜短语前置(镜头缓慢推近至面部特写:@图1 的顾辰缓缓睁眼……),仍在极速档再抽第 3 条验证运镜是否生效(单变量纪律:只改提示词措辞,其余条件不动)——推近真实发生、动作成立,提示词有效性确认。随后切高品质档抽第 4 条作定稿:过完整验收清单(含时长达标:6 秒生成 = 分镜 6 秒)。
入库记账:定稿存为 video/ep01/002-take4.mp4(命名规范见图像资产·资产库),记账表记:镜 2,极速档 3 条 + 高品质档 1 条,共 4 次生成。本镜重抽率 4.0,高于目标 1.2~1.5——微表情镜头本来就在高发区(模型"不动/加戏"),属预期内消耗,但要在周复盘时与其他镜头分开统计(高发镜头与常规镜头的重抽率分开看,才能看清自己真正的基线水平)。
3. 运镜控制
- 文字运镜:提示词中写运镜词(词表见提示词工程),一镜一个运镜。
- 首尾帧运镜:更可控的方式——首帧是全景构图、尾帧是特写构图,模型会自动生成"推近"效果。构图变化 = 运镜。
- 平台运镜功能:可灵"大师运镜"等功能提供预设运镜模板,适合标准化镜头。
首尾帧实操全流程
"构图变化 = 运镜"是可控性最高的运镜方式,完整操作以"全景 → 面部特写"的推近为例:
- 图像阶段出两张图:同一角色、同一场景、同一光影——图 A 全景构图(首帧)、图 B 特写构图(尾帧)。两张图都用角色参考图锁定,差异只在景别(任何多余差异都会被模型解读为"中间要发生的变化");
- 上传两端:视频工具选首尾帧模式,首帧挂 A、尾帧挂 B;
- 提示词只写运动方式:"镜头从全景缓慢推近至面部特写"——不要再写人物动作,两端构图差已经隐含了全部运动信息,多写等于引入第二个变量;
- 压时长:两端差异越大(全景 → 大特写),越要压短时长防中间漂移——3~5 秒为宜(机制见图生视频·首尾帧为什么也会中间漂移)。
链式衔接的截图技巧:镜头 N 验收通过后,在播放器中停在最后一帧截图(或导入剪映导出静帧),裁掉播放器黑边与控件后直接作为镜头 N+1 的首帧上传。截图分辨率与原视频一致即可用——首帧的作用是"锁定起点构图",不需要二次放大。如果镜头 N 的尾帧恰好有轻微瑕疵,可以在图像工具里把截图局部重绘修好再当首帧用(衔接帧同时享受了图像阶段的可修性,这是首尾帧路线的隐藏福利)。
三种运镜方式怎么选:文字运镜成本最低(零额外资产),先试;文字运镜两次抽不出来(运镜不听话是常见翻车,见 §6 对策表)再切首尾帧运镜;平台运镜模板适合"推/拉/摇/环绕"等标准化镜头,批量生产时稳定性最好。
4. 动作控制
- 单镜头单动作:铁律,见提示词工程。
- 复杂动作拆分:「摘镜对峙」这类复合动作按「预备-动作-结果」拆成 3 个镜头(顾辰第 2 集实例见分镜·三镜法),用首尾帧链式衔接——前一镜的尾帧截图作为后一镜的首帧。
- 参考视频驱动(可灵元素支持):上传一段真人动作视频作参考,让角色复刻动作。适合舞蹈、武术等高难度动作。合规注意:用自拍或已获授权的素材,别直接扒网络视频(见发布与运营合规清单)。
- 降预期清单:多人肢体交互(拥抱、打斗接触)、精细手部动作、大幅度动作与透视变化(起身、落座这类中大幅度动作,身体/手臂易畸形)——当前模型翻车率最高的三类,分镜阶段就应尽量减少。
运动模糊:快动作"贴纸感"的来源与对策
相机拍摄运动物体时,快门开启的瞬间物体在动,会在画面上沿运动方向拖出一段残影——这就是运动模糊。电影 24fps 的画面天然带有这种模糊,人眼把它当作"速度感自然"的信号;而 AI 视频模型生成的每一帧都倾向于清晰,快速运动看起来就像"贴纸在平移"——又稳又假,是 AI 视频"塑料感"的隐形根因之一。(模糊量由快门速度决定,越慢越长;电影感的经验惯例是曝光时间约为帧间隔的一半,即"180° 快门"——认知即可,AI 管线里没有快门可拧,只有"像不像"。)
三个落地手法:
- 提示词引导:快速动作镜头在提示词里写明"motion blur / 运动模糊、速度感拖影"——配合运动词(奔跑、挥剑、转身)使用效果最直接;慢速与静态镜头不用写(强行加模糊只会糊)。
- 控制预期:运动模糊改善的是"快动作的自然感",不是降翻车率——大幅度动作仍按本节降预期清单在分镜阶段规避,别指望模糊能盖住畸形。
- 后期补偿:已定稿素材缺模糊时,剪映"运动模糊/动态残影"类效果可轻度补偿(强度宜小,过了像鬼影);静帧化镜头做关键帧位移动画时同理,轻微模糊能让"图在动"更像"镜头在动"(静帧化操作见剪辑与成片)。
5. 抽卡与成本控制策略(核心)
成本公式,请刻进脑子:
text
单镜头成本 = 单条价格 × 实际生成次数
单集视频成本 = Σ 各镜头成本
每分钟成片成本 = 单集总成本 ÷ 成片分钟数演算示例统一见预算表 §4(80 秒成片 × 混合档约 0.5 元/秒 × 重抽率 1.5 ≈ 60 元/集的演示、混合档加权构成、与分镜章 47 元实算口径的对照、CG 厚涂档演算)——本节不另写一份,避免两处漂移;你的目标是让"实际生成次数"逼近"镜头数 × 1.2"。
单集预算红线:竖屏平涂/混合档 80 元、CG 厚涂档 150 元,横屏按档 ≤180/≤450 元(双档定义见预算表·建议预算红线)——连续两集超红线先停下来复盘抽卡纪律。
五条控本纪律:
- 重抽上限:同一镜头连抽 5 次不过,停止硬抽——降级处理:简化动作、缩短时长、换首尾帧方案、回图像阶段改关键帧;仍不达标的镜头可静帧化:放弃视频生成,直接用关键帧图进剪辑,靠关键帧位移/缩放模拟运镜(传统动态漫的成熟做法,操作见剪辑与成片;注意 7~8 秒的独白长镜头档需配合慢放+定格,纯静帧拉到 8 秒画面微移会显"飘")。硬抽是积分黑洞。
- 探路用低档:动作与运镜先用极速档验证,确认提示词有效后再切高品质档定稿。同平台不同代际模型同理——定场/铺垫等简单镜头用旧代或低档模型,高潮镜头才上新代高品质档(旁证:外部收录文按镜头难度拆分 Seedance 2.0/2.5 的做法)。
- 错峰生成:部分平台(如 Vidu)错峰时段积分减半,批量任务安排在低谷期。
- 验收标准前置:开抽之前写下"这一镜怎样算过"(动作对/角色不崩/无瑕疵),避免"好像还能更好"式的无限重抽。
- 逐笔记账:每条生成记积分与成败,周复盘时算出你的实际重抽率——它是预算表的核心参数。
镜头验收清单:逐条判定标准
"验收标准前置"的落地工具。开抽之前把"这一镜怎样算过"写下来,验收时逐条对照——过 = 入库,不过 = 进决策树,没有中间态:
text
□ 角色一致:脸型/发型/配色/标志配饰与锚定图可辨认一致
(容忍:发丝细节、光影差异;不容忍:换脸、换装、配饰消失)
□ 动作成立:分镜要求的主动作清晰完成,无关节反折、肢体增生
□ 运镜符合:分镜写的运镜真实发生(没发生 = 不过,"画面还行"不算过)
□ 无画面瑕疵:无闪烁、果冻、乱入文字、背景崩坏
(瑕疵在画面边缘且 ≤0.5 秒可容忍;主体区域零容忍)
□ 时长达标:生成时长 ≥ 分镜时长(剪辑可以切短,不能拉长)新手最容易放水的是第 3、4 条——"虽然没推近但挺好看的"就入库了,整集节奏就此失控;以及"就闪了一下应该没人注意"——信息流观众对闪烁极其敏感。验收清单的意义就是把这两条从"感觉"变成"纪律"。
第 5 条有一处例外:独白长镜头(7~8 秒)不要求一次生成达到分镜时长——超出 3~6 秒生成甜区的独白镜头(如分镜表实例的镜 4/5/10/12),按分镜章的独白长镜头例外条款处理:6 秒生成 + 剪辑补足(慢放 ≤1.2 倍、定格推拉模拟运镜),或静帧化(7~8 秒档需配合慢放+定格,纯静帧会显"飘"),操作均见剪辑与成片的静帧化补救与素材时长对策,验收时按所选方案判定。
抽卡决策树:第 N 次失败后改什么
连续失败时按层级逐级处理,不要原地硬抽(硬抽是积分黑洞,每一级的成本与损失不同,顺序不能反):
text
第 1~2 次失败 → 改提示词(零成本)
单变量修改:换一个措辞 / 运镜词前置 / 删冗余词
第 3~4 次失败 → 换生成条件(低成本)
换参考图组合、调参考强度、极速档 ↔ 标准档互换、换平台(对照 §1 分工表)
第 5 次失败 → 降级镜头方案(内容损失)
简化动作(拔刀 → 握刀站立)、缩短时长(6s → 3s)、改首尾帧方案、
换角度重出关键帧(正脸 → 侧脸)
※ 运镜问题专用捷径见 §3:文字运镜两次不过即可切首尾帧,不必等到第 5 次
仍不过 → 回炉或静帧化(最贵/保底)
回第 3 环节重新设计关键帧(把动作在图里就设计得更简单);
或静帧化:放弃视频生成,关键帧图直接进剪辑模拟运镜
(传统动态漫的成熟做法,操作见[剪辑与成片](/workflow/editing))配套纪律:每次"换级"都在记账表标注原因——周复盘时你会发现自己的失败集中在哪一级,那就是你最该补课的环节(提示词问题多 → 回提示词工程精读;方案降级多 → 分镜阶段的难度预算太激进,回分镜调整)。
量产工程:批量生产与 API(开发者加餐)
进入周产 2~3 集的量产期后,手工逐条提交会成为瓶颈。三个工程化手段,按投入顺序排列:
- 任务队列表:分镜表的"生成状态"列(待出图/待出片/已验收,见分镜)就是天然的任务队列——每天开工按队列批量推进,先生成全部极速档探路条,再集中验收,最后统一补定稿。批处理比"想一镜做一镜"省一半以上的等待时间。
- 命名与记账自动化:素材按
video/ep01/002-take4.mp4规范入库后,写个小脚本扫描文件名即可自动汇总"每镜生成条数 → 实际重抽率",周复盘不再手算。这是资产库命名规范(见图像资产)的直接红利。 - API 批量提交:通义万相、可灵均开放 API(额度与价格以官方页面为准)。最小流程伪码示意:
python
# 伪码:批量提交图生视频任务(API 密钥、端点与参数名以官方文档为准)
BUDGET_CAP = 80.0 # 单集视频生成预算红线(元),定义见预算表·核心指标与公式;横屏口径另见该页
total_cost = 0.0
for shot in storyboard: # 遍历分镜表
if shot.status != "待出片":
continue
assert total_cost < BUDGET_CAP # 预算熔断:防止脚本失控烧穿预算
task = wanx.i2v.create(
image=load(f"keyframe/ep01/{shot.no}.png"),
prompt=shot.video_prompt, # 分镜表的"视频提示词"列
duration=shot.duration, # 3~6 秒
ratio=shot.ratio, # 按形态决策取 "9:16"(竖屏)或 "16:9"(横屏)
)
total_cost += unit_price * shot.duration # 按秒单价累计成本
log(task.id, shot.no) # 任务 ID 与镜号落库
# 之后:轮询任务状态 → 完成即下载到 video/ep01/ → 逐条过验收清单 → 记账定位提醒:API 自动化的是提交与下载,不是验收——验收清单逐条判定与抽卡决策永远是人工环节。伪码中的 BUDGET_CAP 熔断是 §5 控本纪律在代码里的最后一道闸:脚本失控(状态列笔误、循环异常)时,批量提交能在几分钟内烧穿整月预算。起步期(里程碑 2 前后,单集 15~25 镜)手工完全应付得来,量产期再投入;API 的另一价值是错峰调度——把批量任务挂到夜间低谷时段跑(部分平台错峰积分减半,见 §5 控本纪律第 3 条)。
6. 常见问题与对策
| 问题 | 对策 |
|---|---|
| 角色动作变形(关节反折等) | 动作拆小;首尾帧锁两端姿态;仍不行就改分镜(换角度/切反应镜头) |
| 运镜不听话(不动或乱动) | 运镜词精简到一个;改用首尾帧构图差实现运镜;换平台运镜模板 |
| 镜头中途角色变脸 | 缩短时长到 3~5 秒;提高参考强度;挂多角度参考图 |
| 画面闪烁/果冻感 | 避免高速运动与细密纹理镜头;换高品质档;后期剪辑补帧缓解 |
| 相邻镜头跳切感强 | 首尾帧链式衔接;或插入空镜/特写做过渡(剪辑技巧见剪辑与成片) |
| 首尾帧中间人物瞬移/跳步 | 两端差异太大或时长太长——缩短至 3~5 秒、缩小首尾构图差、拆成两段链式衔接 |
| 同一镜头连抽 5 次还不过 | 停止硬抽,按 §5 抽卡决策树逐级降级;记录失败原因供周复盘定位薄弱环 |
| 排队慢 | 错峰;会员档位提速;批量任务挂 API(万相/可灵均有 API) |
7. 动手练习
产出一段 3 镜头连贯片段(9~15 秒),含首尾帧衔接与 2 种运镜。
- 从练手小故事的一句话分镜中选 3 个连续镜头(正式分镜表方法见分镜与美术设定,第 4 周学习),用第 3 环节的关键帧图;
- 镜头 1→2 用首尾帧链式衔接,镜头 3 自由发挥;
- 记录每镜的生成次数与积分消耗,算出你的首个"实际重抽率";
- 验收:3 个镜头角色一致、动作符合分镜、总成本 ≤ 你的预算红线。
练习片段默认不对外发布;若要发布,需先过两道合规关——配乐授权(见配音 / 音效 / 配乐)与 AI 生成内容标识(见发布与运营)。