SGBH6AXS / notesZhang Shuai's Personal Blog

AIGC 视频创作培训手册(2026 版)

This post is only available in Chinese for now.

AIGC 视频创作培训手册(2026 版)

根据课堂课件截图与课堂记录整理
说明:本稿以课堂截图中可辨认内容为基础,合并重复页面并重新组织为连续阅读版本。个别截图中被截断、字号过小或无法确认的内容未擅自补写。


目录

  1. AIGC 创作发展史:从关键帧拼接到全能参考
  2. 标准创作流程:剧本 · 分镜 · 画面 · 声音

1. AIGC 创作发展史:从关键帧拼接到全能参考

理解当下的工具选择,得先看清这一年多是怎么演进的。

核心的一条主线是:

1.1 工具链演进时间线

2025 年底:关键帧时代

主力组合:可灵(Kling) + Nano Banana

创作方式主要依赖:

  • 首尾帧
  • 九宫格
  • 关键帧图片
  • 静态构图驱动视频

这一阶段的成败,在很大程度上取决于关键帧图片的质量。


Seedance 2.0 发布:全能参考登场

主力组合:Seedance 2.0 + Nano Banana

变化是「全能参考」开始占据主导,可以混合参考:

  • 图片
  • 动作
  • 运镜
  • 声音
  • 角色
  • 环境

首尾帧与九宫格的地位开始下降。


Image 2 时代:图片模型多一个选择

图片侧模型逐渐出现并行选择:

  • Nano Banana
  • GPT Image 2
  • Midjourney

图片生成不再只是视频创作的前置步骤,而逐渐成为独立的视觉设计环节。


当前阶段

主力组合:Seedance 2.5 + Image 模型 + Nano Banana

当前主流工作方式可以理解为:

  • 视频:Seedance 2.5
  • 画面:Image 系模型 / Nano Banana
  • 审美增强:必要时使用 Midjourney
  • 参考图:不再要求直接出现在成片中,而更多用于约束站位、光影、空间和风格

1.2 配套模型演进:声音、剧本、Agent 与 Skill

视频模型之外,一部完整作品还依赖声音、剧本和辅助工具。

环节 主流选择 用途 / 说明
语音(配音) MiniMax、火山语音模型、开源 TTS 2.0 强调音色、情绪和角色表现
BGM(配乐) Suno 并非每部作品都需要 AI 作曲,按需使用
剧本创作 国内 DeepSeek、豆包;海外 Claude、Codex 系模型 长叙事、复杂设定更依赖推理能力
Agent 辅助创作 国内豆包 2.1;国外 Claude、GPT 用于串联资产管理、提示词生成、多步骤协同
Skill Hell Grind 团队开源的 3 个 Skill Lira(分镜图)、Acting(表演动作)、CineDance(运镜与提示词导演系统)

1.3 创作方法的演进:参考图为什么退居幕后

阶段 ①:首尾帧 / 九宫格

关键帧时代的典型方法。

核心做法:

先把关键帧图片做到很高的一致性,再用首尾帧或九宫图驱动视频。

参考图作用:

几乎等于成片画面,逐帧对齐。

遗留影响:

Seedance 2.0 后已经可以减少这种依赖,但很多创作者由于惯性,仍然在制作大量关键帧。


阶段 ②:创意画板

Image 2 时代前后。

核心做法:

在画板中组织多张参考图,拼贴构图与元素,再集中提供给模型。

参考图作用:

依然重要,但从「单帧」升级成「一组视觉上下文」。

课件将其视为承前启后的过渡方案。


阶段 ③:给参考,让模型发挥

当前主流方法。

核心做法:

更多让模型自己完成画面推演,参考主要用于影响:

  • 站位
  • 光影
  • 环境
  • 空间关系
  • 构图倾向
  • 视觉氛围

技巧上更倾向于:

尽量不让参考图原样直接出现在视频里。

课件的一句话总结:

工具越强,越不需要把答案画死。

创作方法的演进主线,就是把参考图从「照抄对象」变成「隐性约束」。


2026 年 1–9 月重点作品回顾

截图中能够辨认出的案例包括:

  • 《浮光》(1 月 5 日):关键帧时代代表
  • 牌子 didi-ok 神作(2 月 16 日)
  • Image 2 时代——故事版生成视频(4 月 23 日)
  • 《丧尸清道夫》(5 月 9 日):手搓 prompt,古法做视频
  • 《万物生》(5 月 17 日)
  • 贾樟柯戛纳电影节相关作品(5 月 25 日)
  • 《被裁掉的女孩》(6 月 12 日—7 月 8 日):现象级都市影视剧作品
  • 《栖光·中式天庭》(8 月 2 日):可灵模型制作,外交部毛宁转发
  • 《后西游记》(8 月 31 日):首部上线芒果 TV 作品;课件评价实际质量较差,中下等水平
  • 《渡胶》(9 月 7 日):高中生创作日剧,课件评价为「超强质感」
  • Candy didi-ok(9 月 14 日):火山引擎官方合作

2. 标准创作流程:剧本 · 分镜 · 画面 · 声音

2.1 剧本:「核心竞争力」

现在 AIGC 画面越来越卷,观众很容易对「炫技」审美疲劳。

回归本质,真正能让人看下去的是一个好故事。

模型、画面、特效都是放大器,被放大的前提是作品本身值得。

AIGC 剧本与传统剧集的区别

传统拍摄中:

  • 剧本定稿
  • 按照剧本执行
  • 拍摄阶段修改成本较高

AIGC 创作则更像「抽卡」:

  • 某个镜头生成效果特别好
  • 某个意外画面有戏剧价值
  • 可以反过来适度调整剧情
  • 将好的素材吸收到故事里

因此,AIGC 剧本不是一次写死的铁板,而是:

一个能随素材灵活生长的框架——先有扎实的主线,再给意外留出空间。


2.1.1 线索一:用「救猫咪」套路搭骨架

这里指 Blake Snyder 的 Save the Cat 编剧方法。

核心思想:

把一部片子拆成 15 个有明确任务和位置的节拍(Beats)。

这样做的作用是:

  • 避免剧情失控
  • 明确每一段的功能
  • 管理观众预期
  • 控制情绪节奏
  • 方便后续拆分分镜

先判断故事属于哪一类

「救猫咪」提出 10 种经典故事类型。

故事类型 核心结构 代表作品
屋中怪物 Monster in the House 封闭空间 + 怪物 + 一桩引来的「罪」;众人挣扎求生 《大白鲨》《异形》《咒怨》《寂静之地》《逃出绝命镇》
金羊毛 Golden Fleece 一条路 + 一支队伍 + 一个目标;主角上路寻物,最终收获是自我成长 《指环王》《绿野仙踪》《瞒天过海》《星球大战》《西游记》
如意以偿 Out of the Bottle 愿望 + 魔法 + 教训;超自然力量打破主角生活并给出启示 《变相怪杰》《土拨鼠之日》《大话西游》《你的名字》
小人物遇上大麻烦 Dude with a Problem 普通人 + 突发事件 + 生存考验,被卷入远超能力的困境 《虎胆龙威》《拯救大兵瑞恩》《127小时》《活着》
成长仪式 Rites of Passage 人生难题 + 一段走错的路 + 最终接纳;关于跨过某道人生坎 《当幸福来敲门》《伴我同行》《怦然心动》《阳光灿烂的日子》
伙伴之爱 Buddy Love 不完整的主角 + 互补的对方 + 把两人捆在一起的事 《泰坦尼克号》《绿皮书》《爱在黎明破晓前》《末路狂花》
推理侦探 Whydunit 谜案 + 侦探 + 黑暗真相;重点不是「谁做的」,而是「为什么」 《唐人街》《七宗罪》《消失的爱人》《看不见的客人》
傻人有傻福 The Fool Triumphant 被低估的「傻瓜」+ 体制 + 逆袭,用天真击败精明 《阿甘正传》《大话王》《美丽人生》《憨豆先生》
换了一个人 Institutionalized 群体 / 组织 + 身处其中的人 + 「随大流还是做自己」的选择 《飞越疯人院》《华尔街》《教父》《美国丽人》
超级英雄 Superhero 非凡之人 + 平凡人 + 一段代价;强者被困于平庸世界的不被理解 《蝙蝠侠:黑暗骑士》《角斗士》《美丽心灵》《功夫》

例如《泰坦尼克号》可以理解为「伙伴之爱」:

  • 两个不完整的人
  • 因彼此而完整
  • 关系本身推动人物成长

判断好类型以后,就能知道在哪些节拍发力。


「救猫咪」15 节拍

课件以《泰坦尼克号》作为实例。

第一幕:铺陈(约 0–20%)

1. 开场画面 — 0%

一个画面定调,展示主角起点状态。

《泰坦尼克号》例:

老年露丝的回忆开启,打捞队搜寻沉船与「海洋之心」。


2. 主题呈现 — 约 5%

有人点出全片真正要讲的道理。

例:

「爱与自由」——挣脱束缚,真正地活一次。


3. 铺垫 — 1–10%

交代:

  • 主角日常
  • 主角缺陷
  • 主角困境
  • 关系与环境

例:

露丝被订婚,被上流社会与母亲逼迫,压抑到想跳海。


4. 催化剂 — 约 10%

一件事打破日常,点燃故事。

例:

杰克在船尾拉住想轻生的露丝,两人相遇。


5. 争论 — 10–20%

主角犹豫要不要上路,抛出核心疑问。

例:

露丝挣扎——要顺从安排,还是追随内心?


第二幕:对抗(约 20–80%)

6. 进入第二幕 — 约 20%

主角主动选择,踏入新世界。

例:

露丝主动找杰克,决定跟随自己的心。


7. B 故事 — 约 22%

引入情感副线,承载主题。

例:

杰克与露丝的爱情线,是全片的情感副线。


8. 游戏时间 — 20–50%

兑现「卖点承诺」,通常是最好看的部分。

例:

  • 船头飞翔
  • 画像
  • 下层甲板跳舞
  • 甜蜜高光段落

9. 中点 — 50%

假胜利 / 假失败,赌注升级。

例:

  • 两人确定爱意(假胜利)
  • 游轮同时撞上冰山

10. 反派逼近 — 50–75%

内外压力收紧,局面恶化。

例:

  • 海水灌入
  • 阶级歧视
  • 未婚夫追杀
  • 处境急转直下

11. 一无所有 — 约 75%

跌到谷底,常伴随重大失去。

例:

船身断裂沉没,两人落入冰海,被迫分离。


12. 灵魂黑夜 — 75–80%

在失败里沉沦、反思,逼近顿悟。

例:

杰克冻死在冰海,露丝独自漂浮。


第三幕:解决(约 80–100%)

13. 进入第三幕 — 约 80%

灵光乍现,A/B 线合流,找到解决办法。

例:

露丝谨记杰克的话:

「答应我一定要活下去。」


14. 结局 — 80–99%

用新的自己解决问题。

例:

露丝爬回残骸,吹响哨子获救,勇敢活了下来。


15. 终场画面 — 100%

与开场呼应,证明主角已经改变。

例:

老年露丝把「海洋之心」投入大海,一生自由无悔。


怎么用这张表

先列画面,再用一句话把故事的每一个节拍填进去,形成一张:

一句话节拍表

骨架立住以后,再往里面填:

  • 分镜
  • 角色
  • 场景
  • 道具
  • 情绪
  • 镜头
  • 资产

2.1.2 线索二:用「短剧逻辑」抓留存

短剧,尤其是竖屏微短剧,与长片是另一套节奏逻辑。

长片可以慢慢铺,短剧必须秒级留人。

短剧的核心不是追求一条完整、漂亮的弧线,而是让:

每一集都把人牢牢留住。

短剧节奏逻辑:钩子开局 + 爽点滚动


第一步:开局——3 秒内甩出钩子,建立期待

① 钩子(0–3 秒)

第一句台词或第一个画面就是冲突本身。

不要先介绍:

  • 时间
  • 地点
  • 人物关系
  • 世界观背景

而是直接把冲突甩出来。

例:

「婚书是你烧的?」


② 建立期待

抛出观众迫切想知道答案的:

  • 悬念
  • 反差
  • 秘密
  • 信息缺口

让观众产生:

「我得继续看。」


③ 顶住冲突

让对立方继续施压,不要太快解决。

作用是:

  • 把期待值继续拉高
  • 延迟满足
  • 为后面的爽点蓄力

第二步:每一集——期待达成 → 再建期待

上集欠下的:带着旧期待

观众带着上一集的悬念进入本集。


本集前半:期待达成(给爽点)

兑现上一集埋下的期待,例如:

  • 打脸
  • 逆袭
  • 真相揭晓
  • 身份曝光
  • 误会解除
  • 情绪释放

本集结尾:再建立新期待(下钩子)

爽点刚结束,就抛出:

  • 更大的敌人
  • 更大的秘密
  • 更严重的危机
  • 更深层的身份

这就是 cliffhanger(悬念结尾)。


情绪闭环

课件把机制概括成:

先还债,再欠债。

也就是:

旧期待 → 达成 / 爽点 → 新期待 → 下一集达成 → 再制造新期待

理想状态是让观众始终处在:

「刚爽完,又被勾住」


三集短剧咬合示例

以典型「赘婿逆袭」题材为例。

第 1 集:身份反差——废物赘婿的秘密

开场钩子:

婚宴上被当众羞辱:

「三年了,你个吃软饭的废物,也配姓沈?」

建立期待:

他真的是废物吗?到底在隐忍什么?

本集爽点:

主角默默接电话,对方毕恭毕敬:

「少爷,您吩咐的事办好了。」

小小达成:观众确认他并不简单。

集尾再钩:

岳父冷笑:

「明天董事会,我让你净身出户。」

欠下新债:

他明天要怎么办?


第 2 集:第一次打脸——原来是幕后老板

承接旧期待:

董事会现场,所有人等着看他出丑。

本集爽点:

秘书推门递上文件:

「介绍一下,这位是公司真正的控股人。」

全场哗然,岳父腿软。

作用:

  • 期待达成
  • 打脸兑现
  • 情绪释放

集尾再钩:

手机震动,来电显示「爷爷」:

「臭小子,你惹的人,你惹不起。」

新债:

威胁升级。


第 3 集:层层加码——更大的对手

承接旧期待:

神秘大佬带人堵门,气势远超岳父一家。

观众自然会问:

这次他还扛得住吗?

这一集的本质不是简单重复打脸,而是继续提高:

  • 对手等级
  • 风险等级
  • 身份层级
  • 情绪强度

2.2 分镜:把剧本翻译成「一格一个动作」

分镜是从剧本到画面的桥梁。

但要先说明:

AIGC 分镜和传统电影分镜是两回事。

传统分镜服务于:

  • 导演
  • 摄影
  • 美术
  • 演员
  • 现场调度

AIGC 分镜服务于:

  • 视频模型
  • 提示词
  • 镜头时长
  • 角色连续性
  • 空间连续性
  • 动作可执行性

传统分镜 vs AIGC 分镜

对比项 传统电影分镜 AIGC 分镜
服务对象 拍摄团队:导演、摄影、美术、演员 视频模型:分镜即提示词草稿
表现形式 手绘 / 草图 + 景别、机位、运镜标注 + 注释 结构化文字:谁、在哪、做什么、镜头怎么动
时长依据 按叙事和表演需要,单个镜头可长可短 受模型能力硬约束
信息落点 靠现场布景、走位、演员理解来补全 物理空间消失,信息必须用文字重新写清
成败关键 拍摄执行与调度 分镜写得够不够具体、模型能不能读懂

传统电影分镜图通常长什么样

传统分镜通常包括:

  • 画面草图
  • 镜号
  • 景别
  • 机位
  • 运镜
  • 时长
  • 动作
  • 台词
  • 声音
  • 注释

示例结构:

镜号 景别 / 镜头 时长 动作 / 信息
12-1 全景 WS 4s 角色从雨夜走廊尽头走来
12-2 中景 MS 5s 两人对峙
12-3 特写 CU 3s 主角眼神变化

传统分镜中的大量信息,现场团队可以通过经验自动补全。

AIGC 不行。


2.2.1 先记住:分镜时长由模型能力决定

传统分镜中,一个镜头可以:

  • 很短
  • 很长
  • 根据表演需要变化

AIGC 分镜则必须考虑模型单次生成时长。

课件示例:

  • Seedance 2.0:单镜尽量不超过约 15 秒
  • Seedance 2.5:上限可以放宽到约 30 秒

因此拆分镜头的第一步不是「美学」,而是:

先按模型能力切镜头。

原则:

  1. 一个镜头不要塞入太多动作
  2. 一个镜头最好只解决一件事
  3. 超时就拆分
  4. 不要让模型在一个镜头里同时处理过多人物、动作和运镜

2.2.2 AIGC 分镜脚本:结构化文字,逐镜可执行

AIGC 分镜应该直接决定喂给模型的提示词。

理念是:

每一格都要写清楚:什么地方、谁、做了什么、镜头怎么拍。

示例:雨夜走廊对峙

镜 景别 / 运镜 时长 画面:谁、在哪、做什么 台词 / 声音 / 连续性
1 全景 / 缓推 4s 阿哲从雨中走进昏暗走廊尽头,站定;走廊只有头顶一盏冷白灯 雨声、远处闷雷;与前镜色温一致
2 中景 / 固定 6s 阿哲与对手在走廊相距三米对峙,画面左阿哲、右对手,谁都不动 对手:「东西,交出来。」;主光源在画面右侧门口
3 特写 / 微上摇 4s 阿哲下巴绷紧后松开一次,目光不动;雨水顺着额角滑下 阿哲:「你确定?」;光源、湿发与镜 2 一致

把「镜 2」改写成 Seedance 提示词

可以进一步结构化成:

场景:
昏暗旧走廊,雨夜,头顶一盏冷白灯,地面反光。

人物:
画面左 = 阿哲;画面右 = 对手。两人相距约三米。

景别 / 运镜:
中景双人,固定机位,摄影机在门口一侧,不横移。

动作(0–6s):
两人持续对峙,谁都不动;对手微抬下巴。

光线:
唯一主光来自画面右侧门口,冷调,人物右亮左暗。

声音:
对手说:「东西,交出来。」
环境音有雨声与远处闷雷。

连续性:
阿哲湿发、风衣、光位与上一镜一致,不出现第三人。


2.2.3 补课:先懂影视语言,再写分镜

写分镜要填:

  • 景别
  • 运镜
  • 机位
  • 镜头
  • 光线
  • 构图

很多 AIGC 创作者只盯着提示词,却忽略了背后的影视语言。

真正决定:

  • 画面好不好看
  • 情绪对不对
  • 权力关系是否明确
  • 观众注意力在哪里

的,往往就是这些基础语言。


影视基础语言速查:景别 · 机位 · 运镜 · 镜头

① 景别:拍多大

远景 / 全景

作用:

  • 交代环境
  • 强调时空关系
  • 强调人与环境的比例
  • 制造渺小感
  • 制造孤独感

适合:

  • 场景建立
  • 开场
  • 环境说明
  • 大空间关系

中景

大致拍到腰部以上。

特点:

  • 最中性
  • 最常用
  • 兼顾表情与动作
  • 适合对话与叙事

近景 / 特写

聚焦脸部或细节。

作用:

  • 环境退隐
  • 情绪增强
  • 用于情绪高潮
  • 突出关键道具

大特写

只剩:

  • 眼睛
  • 手
  • 嘴
  • 某个局部

作用:

  • 冲击最强
  • 放大紧张
  • 制造悬念
  • 提示关键线索

② 机位角度:从哪拍

平视

  • 与视线齐平
  • 最自然
  • 无评判
  • 常规对话默认角度

仰拍(低角度)

从下往上。

效果:

  • 人物显得高大
  • 强势
  • 有压迫感
  • 有统治感

常用于:

  • 权力人物
  • 英雄登场
  • 威胁感

俯拍(高角度)

从上往下。

效果:

  • 人物显得渺小
  • 脆弱
  • 被支配
  • 无助

荷兰角(倾斜)

画面歪斜。

效果:

  • 不安
  • 失衡
  • 精神紧张
  • 非正常状态

③ 运镜:怎么动

固定

摄影机不动。

作用:

  • 客观
  • 克制
  • 让观众注意画面内部表演

摇 / 移(Pan / Tilt)

摄影机原地转动或移动。

作用:

  • 分配注意力
  • 揭示信息
  • 上摇显高大
  • 下摇显分量

推 / 拉(Push / Pull)

推近:

强调:

「这里很重要。」

将观众拉进人物内心。

拉远:

抽离人物,强调:

  • 孤立
  • 环境
  • 关系变化
  • 疏离感

跟 / 环绕

跟随主体移动,或者围绕主体。

作用:

  • 增加代入感
  • 增强动势
  • 环绕会增加戏剧张力与仪式感

希区柯克变焦 / Dolly Zoom

通常表现为:

  • 主体大小大致保持
  • 背景空间感剧烈变化

常用于:

  • 眩晕
  • 恐惧
  • 突然意识到真相
  • 世界观崩塌
  • 强烈心理冲击

④ 镜头 / 设备:用什么拍

广角(短焦)

特点:

  • 空间关系夸张
  • 环境显得大
  • 近处人物容易变形

常见感受:

  • 压迫
  • 荒诞
  • 沉浸

标准镜头

特点:

  • 接近人眼感受
  • 最自然
  • 中性

长焦

特点:

  • 压缩空间
  • 背景虚化
  • 主体从环境中抽离

常见感受:

  • 浪漫
  • 聚焦
  • 偷窥感

景深

浅景深:

  • 突出主体
  • 背景虚化
  • 信息集中

大景深:

  • 前中后景都清晰
  • 信息量大
  • 适合多层叙事

设备感

稳定器:

  • 平滑
  • 高级
  • 现代

手持:

  • 纪实
  • 慌乱
  • 临场感

航拍:

  • 宏大
  • 上帝视角
  • 地理关系明确

经典镜头案例

凯恩的巨人身影 · 仰拍

《公民凯恩》(1941)

手法:

  • 摄影棚地板挖开
  • 镜头从极低位置仰视凯恩
  • 画面甚至压着天花板

效果:

  • 凯恩显得高大、强势、不可一世
  • 低压天花板又暗示人物被权力困住

AIGC 启示:

如果想让人物「有威压」,不要只写:

霸气、强大

更有效的写法是:

  • 低角度仰拍
  • 头顶压低顶部空间
  • 强调低机位
  • 人物占据大部分画面

眩晕的楼梯井 · 移焦 / Dolly Zoom

《迷魂记》(1958)

手法:

摄影机后退的同时镜头推进变焦,主体大小变化不大,背景空间急剧变化。

效果:

  • 眩晕
  • 恐高
  • 天旋地转
  • 心理冲击

AIGC 启示:

不要只写:

他很震惊。

可以直接指定:

希区柯克变焦 / Dolly Zoom。


诡异的对称长廊 · 广角

《闪灵》(1980)

手法:

  • 广角镜头
  • 正对走廊
  • 严格对称构图
  • 纵深线指向中心

效果:

  • 空间显得空旷
  • 失真
  • 不安
  • 酒店走廊本身变成压迫来源

AIGC 启示:

要「诡异的空间感」,可以明确写:

  • 广角镜头
  • 对称构图
  • 强纵深
  • 中央消失点

窗内窗外 · 大景深

《公民凯恩》(1941)

手法:

通过大景深,让:

  • 前景
  • 中景
  • 后景

同时保持清晰。

效果:

一个镜头内建立多层人物关系与命运关系。

AIGC 启示:

想让前后景同时有叙事价值,可以写:

  • 大景深 / 深焦
  • 前中后景分别放置什么
  • 每层人物处于什么状态

学镜头的正确姿势

不要只记名词。

先问:

「这一刻导演想让我感觉到什么?」

然后再看:

  • 景别
  • 机位
  • 运镜
  • 焦段
  • 景深
  • 构图

是怎样一起实现这种感觉的。


2.2.4 分镜设计视频教学

课件给出的思路是:

有了 AI 还要不要学分镜?要。

因为 AI 可以生成画面,但:

  • 什么镜头先出现
  • 信息怎么释放
  • 冲突怎么升级
  • 观众视线放在哪里
  • 节奏什么时候停顿

仍然需要导演式设计。

分镜设计的核心问题

如何用分镜把一个故事讲得更有吸引力?

可以从四个方向思考:

  1. 信息分配:什么时候让观众知道什么
  2. 视线设计:让观众先看哪里
  3. 情绪节奏:什么时候远,什么时候近
  4. 反差设计:用景别、角度、构图制造前后变化

2.2.5 关键技巧:把情绪写成动作

来自 Hell Grind 的表演方法。

不要这样写

这些描述的问题是:

  • 「愤怒」没有具体动作
  • 「紧张」没有具体表演
  • 「保持静止」容易让模型把画面生成成冻结状态

应该这样写

愤怒

不要写:

他非常愤怒地看着对方。

可以改写为:

  • 下巴绷紧后松开两次
  • 鼻血流到嘴唇却没去擦
  • 目光停在地上的碎片
  • 再缓慢抬头看向门口

紧张 / 隐忍

不要写:

她强忍着内心的紧张。

可以改写为:

  • 一次缓慢眨眼
  • 紧接两次快速眨眼
  • 再用力闭眼
  • 坐下后焦虑地转动钥匙环
  • 手指敲击桌面

保持不动

不要写:

所有人保持静止。

可以改写为:

人物用力维持静止,呼吸仍没有平复;静态镜头持续 1–2 秒,人物胸口轻微起伏、鼻翼轻动、眉毛收紧。

这样模型得到的是:

  • 人物没有大动作
  • 但仍然是「活的」
  • 画面不会变成冻结帧

还可以写「内心 OS」

它不一定出现在台词里,却会改变:

  • 呼吸
  • 眼神
  • 动作节奏
  • 面部紧张度

例如:

他想起别人进门前再次攻击过自己,于是门推开的瞬间,嘴角重新挂上一点勉强的笑。

这种「看不见的动机」会转化为「看得见的表演」。


2.3 画面:把分镜抽成成片

剧本和分镜解决:

要什么。

画面这一阶段解决:

怎么把它抽出来、挑出来、连起来。

核心理念已经从:

「画死每一帧」

转向:

「用参考约束模型,让它自己发挥。」

参考更多用于影响:

  • 站位
  • 光影
  • 环境
  • 空间
  • 人物身份
  • 风格

尽量不要让参考图原样直接出现在成片中。


模型搭配

  • 视频:Seedance 2.5
  • 图片:Image 系模型、Nano Banana
  • Midjourney:常用于提高审美、强化风格

出图是「抽」出来的

画面需要:

  • 反复生成
  • 反复筛选
  • 挑选最合适的版本

可以考虑:

  • 拆成两段
  • 删一个动作
  • 缩小活动范围
  • 改机位
  • 改人物数量
  • 简化空间关系

抽到好画面可以反哺剧情

呼应前面「剧本可变」的理念:

如果抽到一个特别好的镜头,可以适度调整剧情,把它利用起来。


2.3.1 人物资产:三视图(去头) + 大头照,且「不脏」

稳定的人物资产,是长片角色一致性的根基。

课件将人物资产拆成:

三视图负责身体、服装、比例;大头照负责脸。

人物资产 = 「三视图(去头)」 + 「一张大头照」

三视图

通常包括:

  • 正面
  • 侧面
  • 背面

但要:

去掉头部。

用途:

  • 身材
  • 服装
  • 颜色
  • 身体比例
  • 服装轮廓
  • 材质结构

大头照

单独负责:

  • 脸
  • 五官
  • 发型
  • 正面身份识别

要求:

  • 清晰
  • 正光
  • 尺寸足够
  • 不要混入身体比例信息

为什么三视图必须去头

因为三视图本身信息很多。

模型生成时,为了省算力,可能把三张图里的小脸直接「吃进去」,导致:

  • 脸崩
  • 五官漂移
  • 身份不一致

正确做法是:

  • 三视图只保留身体、衣服、比例
  • 把头砍掉
  • 脸交给一张独立、清晰、够大的大头照锁定

要点一:三视图不能有头

三视图负责:

  • 身材
  • 服装
  • 颜色
  • 比例

大头照负责:

  • 脸
  • 五官
  • 发型

两者不要相互干扰。


要点二:资产要「不脏」

这里的「不脏」不是指干净程度,而是:

不要塞入过多不必要细节。

人物资产是用来给模型识别和复用的视觉信息,不是单纯展示审美的成片。

如果塞入太多:

  • 花纹
  • 褶皱
  • 配饰
  • 材质纹理
  • 复杂造型

模型在人物:

  • 转身
  • 运动
  • 远景
  • 侧面
  • 背面

时就容易出现:

  • 变形
  • 漂移
  • 不一致
  • 特征串位

建议保留

  • 脸型
  • 发型轮廓
  • 体型
  • 服装廓形
  • 少量关键标志

其余细节尽量简化。


造型越复杂,资产拆得越细

复杂:

  • 武器
  • 首饰
  • 特殊服装
  • 高辨识度道具

不要全部压在一张人物图里。

可以拆成:

  • 人物基础资产
  • 武器资产
  • 饰品资产
  • 特殊服装资产

按镜头需要调用。


参考图可以「补素」

参考图的任务是让模型:

稳定认出角色。

而不是提前把所有:

  • 材质感
  • 电影感
  • 光影
  • 气氛
  • 最终调色

全部塞满。

具体场景中的这些信息,可以在镜头阶段再增加。


2.3.2 环境图:要变化视角

环境参考的目标不是:

让模型照抄一张图。

而是:

让模型先理解空间结构,再按目标机位重构。

即使最终要拍正面,也可以先提供:

  • 俯视图
  • 平面结构图
  • 3/4 视角
  • 侧视图

让模型理解:

  • 门在哪里
  • 窗在哪里
  • 家具在哪里
  • 走廊如何延伸
  • 空间纵深关系

再重新生成目标机位画面。


防止模型偷偷照搬参考图

可以主动制造输入与输出的差异。

换视角

目标是正面画面,可以给:

  • 俯视图
  • 3/4 视角

逼模型理解结构后重新组织画面。


换比例

目标生成:

  • 16:9 视频

参考图可以使用:

  • 1:1

如果比例无法直接套用,模型就必须重新构图。


换分辨率

例如目标生成:

  • 720p

参考图可以:

  • 480p

目的不是追求低质量,而是保留结构信息,降低模型直接复制细节的倾向。


判断标准

重点看:

  • 人物与环境是否真的融合
  • 空间关系是否合理
  • 光影是否属于同一个空间

而不是:

成片与参考图有多像。


2.3.3 光影:需要「刷」

人物资产往往是在:

  • 棚拍
  • 均匀自然光
  • 正面补光

环境则可能是:

  • 车内
  • 夜景
  • 暗室
  • 逆光
  • 侧光
  • 顶光

如果人物脸仍保持棚拍亮度,就会出现:

像把人物贴上去一样。

因此光影需要「刷」。

这里的「刷」是:

  • 反复生成
  • 微调提示词
  • 换参考
  • 调整光位
  • 调整色温
  • 调整曝光

直到人物与环境属于同一个空间。


解决思路

反复生成 + 微调

不断调整:

  • 主光方向
  • 辅光强度
  • 脸部亮度
  • 阴影
  • 色温
  • 环境反射

使用光影关系正确的参考图

如果人物应该在:

  • 逆光
  • 侧光
  • 暗室
  • 车内

可以给模型同类光影参考,让它理解目标关系。


先看人物是否「属于这个空间」

不要只看:

脸好不好看。

而要看:

  • 人物受光方向
  • 光线亮度
  • 色温
  • 环境反射
  • 阴影方向

是否统一。


2.3.4 延长镜头:参考结尾视频,不要只参考尾帧

如果已经有一个镜头,想继续往后延长:

不要只拿最后一帧图片继续生成。

原因是尾帧只保留:

  • 静态构图
  • 当前人物位置
  • 当前画面信息

却丢失:

  • 人物运动方向
  • 运动速度
  • 惯性
  • 光影变化趋势
  • 动作节奏
  • 镜头运动方向

因此更好的做法是:

参考结尾一小段视频,而不是只参考尾帧。

这样模型才能理解:

  • 人物刚刚怎么动
  • 摄影机往哪动
  • 节奏有多快
  • 动作有没有惯性
  • 光线是怎么变化的

结课方法论:把整套流程串起来

整套课程可以压缩成一条生产链:

故事类型
↓
剧本骨架
↓
Save the Cat / 短剧留存逻辑
↓
一句话节拍表
↓
结构化 AIGC 分镜
↓
镜头语言设计
↓
把情绪翻译成动作
↓
角色 / 环境 / 道具资产
↓
参考图作为导演约束
↓
图片生成与筛选
↓
视频生成
↓
光影、连续性、表演修正
↓
声音 / 配乐 / 后期
↓
成片

最终核心原则

Comments

No comments yet — be the first.

Comments are moderated. Plain text only.