AIGC 视频创作培训手册(2026 版)
This post is only available in Chinese for now.
AIGC 视频创作培训手册(2026 版)
根据课堂课件截图与课堂记录整理
说明:本稿以课堂截图中可辨认内容为基础,合并重复页面并重新组织为连续阅读版本。个别截图中被截断、字号过小或无法确认的内容未擅自补写。
目录
1. AIGC 创作发展史:从关键帧拼接到全能参考
理解当下的工具选择,得先看清这一年多是怎么演进的。
核心的一条主线是:
1.1 工具链演进时间线
2025 年底:关键帧时代
主力组合:可灵(Kling) + Nano Banana
创作方式主要依赖:
- 首尾帧
- 九宫格
- 关键帧图片
- 静态构图驱动视频
这一阶段的成败,在很大程度上取决于关键帧图片的质量。
Seedance 2.0 发布:全能参考登场
主力组合:Seedance 2.0 + Nano Banana
变化是「全能参考」开始占据主导,可以混合参考:
- 图片
- 动作
- 运镜
- 声音
- 角色
- 环境
首尾帧与九宫格的地位开始下降。
Image 2 时代:图片模型多一个选择
图片侧模型逐渐出现并行选择:
- Nano Banana
- GPT Image 2
- Midjourney
图片生成不再只是视频创作的前置步骤,而逐渐成为独立的视觉设计环节。
当前阶段
主力组合:Seedance 2.5 + Image 模型 + Nano Banana
当前主流工作方式可以理解为:
- 视频:Seedance 2.5
- 画面:Image 系模型 / Nano Banana
- 审美增强:必要时使用 Midjourney
- 参考图:不再要求直接出现在成片中,而更多用于约束站位、光影、空间和风格
1.2 配套模型演进:声音、剧本、Agent 与 Skill
视频模型之外,一部完整作品还依赖声音、剧本和辅助工具。
| 环节 | 主流选择 | 用途 / 说明 |
|---|---|---|
| 语音(配音) | MiniMax、火山语音模型、开源 TTS 2.0 | 强调音色、情绪和角色表现 |
| BGM(配乐) | Suno | 并非每部作品都需要 AI 作曲,按需使用 |
| 剧本创作 | 国内 DeepSeek、豆包;海外 Claude、Codex 系模型 | 长叙事、复杂设定更依赖推理能力 |
| Agent 辅助创作 | 国内豆包 2.1;国外 Claude、GPT | 用于串联资产管理、提示词生成、多步骤协同 |
| Skill | Hell Grind 团队开源的 3 个 Skill | Lira(分镜图)、Acting(表演动作)、CineDance(运镜与提示词导演系统) |
1.3 创作方法的演进:参考图为什么退居幕后
阶段 ①:首尾帧 / 九宫格
关键帧时代的典型方法。
核心做法:
先把关键帧图片做到很高的一致性,再用首尾帧或九宫图驱动视频。
参考图作用:
几乎等于成片画面,逐帧对齐。
遗留影响:
Seedance 2.0 后已经可以减少这种依赖,但很多创作者由于惯性,仍然在制作大量关键帧。
阶段 ②:创意画板
Image 2 时代前后。
核心做法:
在画板中组织多张参考图,拼贴构图与元素,再集中提供给模型。
参考图作用:
依然重要,但从「单帧」升级成「一组视觉上下文」。
课件将其视为承前启后的过渡方案。
阶段 ③:给参考,让模型发挥
当前主流方法。
核心做法:
更多让模型自己完成画面推演,参考主要用于影响:
- 站位
- 光影
- 环境
- 空间关系
- 构图倾向
- 视觉氛围
技巧上更倾向于:
尽量不让参考图原样直接出现在视频里。
课件的一句话总结:
工具越强,越不需要把答案画死。
创作方法的演进主线,就是把参考图从「照抄对象」变成「隐性约束」。
2026 年 1–9 月重点作品回顾
截图中能够辨认出的案例包括:
- 《浮光》(1 月 5 日):关键帧时代代表
- 牌子 didi-ok 神作(2 月 16 日)
- Image 2 时代——故事版生成视频(4 月 23 日)
- 《丧尸清道夫》(5 月 9 日):手搓 prompt,古法做视频
- 《万物生》(5 月 17 日)
- 贾樟柯戛纳电影节相关作品(5 月 25 日)
- 《被裁掉的女孩》(6 月 12 日—7 月 8 日):现象级都市影视剧作品
- 《栖光·中式天庭》(8 月 2 日):可灵模型制作,外交部毛宁转发
- 《后西游记》(8 月 31 日):首部上线芒果 TV 作品;课件评价实际质量较差,中下等水平
- 《渡胶》(9 月 7 日):高中生创作日剧,课件评价为「超强质感」
- Candy didi-ok(9 月 14 日):火山引擎官方合作
2. 标准创作流程:剧本 · 分镜 · 画面 · 声音
2.1 剧本:「核心竞争力」
现在 AIGC 画面越来越卷,观众很容易对「炫技」审美疲劳。
回归本质,真正能让人看下去的是一个好故事。
模型、画面、特效都是放大器,被放大的前提是作品本身值得。
AIGC 剧本与传统剧集的区别
传统拍摄中:
- 剧本定稿
- 按照剧本执行
- 拍摄阶段修改成本较高
AIGC 创作则更像「抽卡」:
- 某个镜头生成效果特别好
- 某个意外画面有戏剧价值
- 可以反过来适度调整剧情
- 将好的素材吸收到故事里
因此,AIGC 剧本不是一次写死的铁板,而是:
一个能随素材灵活生长的框架——先有扎实的主线,再给意外留出空间。
2.1.1 线索一:用「救猫咪」套路搭骨架
这里指 Blake Snyder 的 Save the Cat 编剧方法。
核心思想:
把一部片子拆成 15 个有明确任务和位置的节拍(Beats)。
这样做的作用是:
- 避免剧情失控
- 明确每一段的功能
- 管理观众预期
- 控制情绪节奏
- 方便后续拆分分镜
先判断故事属于哪一类
「救猫咪」提出 10 种经典故事类型。
| 故事类型 | 核心结构 | 代表作品 |
|---|---|---|
| 屋中怪物 Monster in the House | 封闭空间 + 怪物 + 一桩引来的「罪」;众人挣扎求生 | 《大白鲨》《异形》《咒怨》《寂静之地》《逃出绝命镇》 |
| 金羊毛 Golden Fleece | 一条路 + 一支队伍 + 一个目标;主角上路寻物,最终收获是自我成长 | 《指环王》《绿野仙踪》《瞒天过海》《星球大战》《西游记》 |
| 如意以偿 Out of the Bottle | 愿望 + 魔法 + 教训;超自然力量打破主角生活并给出启示 | 《变相怪杰》《土拨鼠之日》《大话西游》《你的名字》 |
| 小人物遇上大麻烦 Dude with a Problem | 普通人 + 突发事件 + 生存考验,被卷入远超能力的困境 | 《虎胆龙威》《拯救大兵瑞恩》《127小时》《活着》 |
| 成长仪式 Rites of Passage | 人生难题 + 一段走错的路 + 最终接纳;关于跨过某道人生坎 | 《当幸福来敲门》《伴我同行》《怦然心动》《阳光灿烂的日子》 |
| 伙伴之爱 Buddy Love | 不完整的主角 + 互补的对方 + 把两人捆在一起的事 | 《泰坦尼克号》《绿皮书》《爱在黎明破晓前》《末路狂花》 |
| 推理侦探 Whydunit | 谜案 + 侦探 + 黑暗真相;重点不是「谁做的」,而是「为什么」 | 《唐人街》《七宗罪》《消失的爱人》《看不见的客人》 |
| 傻人有傻福 The Fool Triumphant | 被低估的「傻瓜」+ 体制 + 逆袭,用天真击败精明 | 《阿甘正传》《大话王》《美丽人生》《憨豆先生》 |
| 换了一个人 Institutionalized | 群体 / 组织 + 身处其中的人 + 「随大流还是做自己」的选择 | 《飞越疯人院》《华尔街》《教父》《美国丽人》 |
| 超级英雄 Superhero | 非凡之人 + 平凡人 + 一段代价;强者被困于平庸世界的不被理解 | 《蝙蝠侠:黑暗骑士》《角斗士》《美丽心灵》《功夫》 |
例如《泰坦尼克号》可以理解为「伙伴之爱」:
- 两个不完整的人
- 因彼此而完整
- 关系本身推动人物成长
判断好类型以后,就能知道在哪些节拍发力。
「救猫咪」15 节拍
课件以《泰坦尼克号》作为实例。
第一幕:铺陈(约 0–20%)
1. 开场画面 — 0%
一个画面定调,展示主角起点状态。
《泰坦尼克号》例:
老年露丝的回忆开启,打捞队搜寻沉船与「海洋之心」。
2. 主题呈现 — 约 5%
有人点出全片真正要讲的道理。
例:
「爱与自由」——挣脱束缚,真正地活一次。
3. 铺垫 — 1–10%
交代:
- 主角日常
- 主角缺陷
- 主角困境
- 关系与环境
例:
露丝被订婚,被上流社会与母亲逼迫,压抑到想跳海。
4. 催化剂 — 约 10%
一件事打破日常,点燃故事。
例:
杰克在船尾拉住想轻生的露丝,两人相遇。
5. 争论 — 10–20%
主角犹豫要不要上路,抛出核心疑问。
例:
露丝挣扎——要顺从安排,还是追随内心?
第二幕:对抗(约 20–80%)
6. 进入第二幕 — 约 20%
主角主动选择,踏入新世界。
例:
露丝主动找杰克,决定跟随自己的心。
7. B 故事 — 约 22%
引入情感副线,承载主题。
例:
杰克与露丝的爱情线,是全片的情感副线。
8. 游戏时间 — 20–50%
兑现「卖点承诺」,通常是最好看的部分。
例:
- 船头飞翔
- 画像
- 下层甲板跳舞
- 甜蜜高光段落
9. 中点 — 50%
假胜利 / 假失败,赌注升级。
例:
- 两人确定爱意(假胜利)
- 游轮同时撞上冰山
10. 反派逼近 — 50–75%
内外压力收紧,局面恶化。
例:
- 海水灌入
- 阶级歧视
- 未婚夫追杀
- 处境急转直下
11. 一无所有 — 约 75%
跌到谷底,常伴随重大失去。
例:
船身断裂沉没,两人落入冰海,被迫分离。
12. 灵魂黑夜 — 75–80%
在失败里沉沦、反思,逼近顿悟。
例:
杰克冻死在冰海,露丝独自漂浮。
第三幕:解决(约 80–100%)
13. 进入第三幕 — 约 80%
灵光乍现,A/B 线合流,找到解决办法。
例:
露丝谨记杰克的话:
「答应我一定要活下去。」
14. 结局 — 80–99%
用新的自己解决问题。
例:
露丝爬回残骸,吹响哨子获救,勇敢活了下来。
15. 终场画面 — 100%
与开场呼应,证明主角已经改变。
例:
老年露丝把「海洋之心」投入大海,一生自由无悔。
怎么用这张表
先列画面,再用一句话把故事的每一个节拍填进去,形成一张:
一句话节拍表
骨架立住以后,再往里面填:
- 分镜
- 角色
- 场景
- 道具
- 情绪
- 镜头
- 资产
2.1.2 线索二:用「短剧逻辑」抓留存
短剧,尤其是竖屏微短剧,与长片是另一套节奏逻辑。
长片可以慢慢铺,短剧必须秒级留人。
短剧的核心不是追求一条完整、漂亮的弧线,而是让:
每一集都把人牢牢留住。
短剧节奏逻辑:钩子开局 + 爽点滚动
第一步:开局——3 秒内甩出钩子,建立期待
① 钩子(0–3 秒)
第一句台词或第一个画面就是冲突本身。
不要先介绍:
- 时间
- 地点
- 人物关系
- 世界观背景
而是直接把冲突甩出来。
例:
「婚书是你烧的?」
② 建立期待
抛出观众迫切想知道答案的:
- 悬念
- 反差
- 秘密
- 信息缺口
让观众产生:
「我得继续看。」
③ 顶住冲突
让对立方继续施压,不要太快解决。
作用是:
- 把期待值继续拉高
- 延迟满足
- 为后面的爽点蓄力
第二步:每一集——期待达成 → 再建期待
上集欠下的:带着旧期待
观众带着上一集的悬念进入本集。
本集前半:期待达成(给爽点)
兑现上一集埋下的期待,例如:
- 打脸
- 逆袭
- 真相揭晓
- 身份曝光
- 误会解除
- 情绪释放
本集结尾:再建立新期待(下钩子)
爽点刚结束,就抛出:
- 更大的敌人
- 更大的秘密
- 更严重的危机
- 更深层的身份
这就是 cliffhanger(悬念结尾)。
情绪闭环
课件把机制概括成:
先还债,再欠债。
也就是:
旧期待 → 达成 / 爽点 → 新期待 → 下一集达成 → 再制造新期待
理想状态是让观众始终处在:
「刚爽完,又被勾住」
三集短剧咬合示例
以典型「赘婿逆袭」题材为例。
第 1 集:身份反差——废物赘婿的秘密
开场钩子:
婚宴上被当众羞辱:
「三年了,你个吃软饭的废物,也配姓沈?」
建立期待:
他真的是废物吗?到底在隐忍什么?
本集爽点:
主角默默接电话,对方毕恭毕敬:
「少爷,您吩咐的事办好了。」
小小达成:观众确认他并不简单。
集尾再钩:
岳父冷笑:
「明天董事会,我让你净身出户。」
欠下新债:
他明天要怎么办?
第 2 集:第一次打脸——原来是幕后老板
承接旧期待:
董事会现场,所有人等着看他出丑。
本集爽点:
秘书推门递上文件:
「介绍一下,这位是公司真正的控股人。」
全场哗然,岳父腿软。
作用:
- 期待达成
- 打脸兑现
- 情绪释放
集尾再钩:
手机震动,来电显示「爷爷」:
「臭小子,你惹的人,你惹不起。」
新债:
威胁升级。
第 3 集:层层加码——更大的对手
承接旧期待:
神秘大佬带人堵门,气势远超岳父一家。
观众自然会问:
这次他还扛得住吗?
这一集的本质不是简单重复打脸,而是继续提高:
- 对手等级
- 风险等级
- 身份层级
- 情绪强度
2.2 分镜:把剧本翻译成「一格一个动作」
分镜是从剧本到画面的桥梁。
但要先说明:
AIGC 分镜和传统电影分镜是两回事。
传统分镜服务于:
- 导演
- 摄影
- 美术
- 演员
- 现场调度
AIGC 分镜服务于:
- 视频模型
- 提示词
- 镜头时长
- 角色连续性
- 空间连续性
- 动作可执行性
传统分镜 vs AIGC 分镜
| 对比项 | 传统电影分镜 | AIGC 分镜 |
|---|---|---|
| 服务对象 | 拍摄团队:导演、摄影、美术、演员 | 视频模型:分镜即提示词草稿 |
| 表现形式 | 手绘 / 草图 + 景别、机位、运镜标注 + 注释 | 结构化文字:谁、在哪、做什么、镜头怎么动 |
| 时长依据 | 按叙事和表演需要,单个镜头可长可短 | 受模型能力硬约束 |
| 信息落点 | 靠现场布景、走位、演员理解来补全 | 物理空间消失,信息必须用文字重新写清 |
| 成败关键 | 拍摄执行与调度 | 分镜写得够不够具体、模型能不能读懂 |
传统电影分镜图通常长什么样
传统分镜通常包括:
- 画面草图
- 镜号
- 景别
- 机位
- 运镜
- 时长
- 动作
- 台词
- 声音
- 注释
示例结构:
| 镜号 | 景别 / 镜头 | 时长 | 动作 / 信息 |
|---|---|---|---|
| 12-1 | 全景 WS | 4s | 角色从雨夜走廊尽头走来 |
| 12-2 | 中景 MS | 5s | 两人对峙 |
| 12-3 | 特写 CU | 3s | 主角眼神变化 |
传统分镜中的大量信息,现场团队可以通过经验自动补全。
AIGC 不行。
2.2.1 先记住:分镜时长由模型能力决定
传统分镜中,一个镜头可以:
- 很短
- 很长
- 根据表演需要变化
AIGC 分镜则必须考虑模型单次生成时长。
课件示例:
- Seedance 2.0:单镜尽量不超过约 15 秒
- Seedance 2.5:上限可以放宽到约 30 秒
因此拆分镜头的第一步不是「美学」,而是:
先按模型能力切镜头。
原则:
- 一个镜头不要塞入太多动作
- 一个镜头最好只解决一件事
- 超时就拆分
- 不要让模型在一个镜头里同时处理过多人物、动作和运镜
2.2.2 AIGC 分镜脚本:结构化文字,逐镜可执行
AIGC 分镜应该直接决定喂给模型的提示词。
理念是:
每一格都要写清楚:什么地方、谁、做了什么、镜头怎么拍。
示例:雨夜走廊对峙
| 镜 | 景别 / 运镜 | 时长 | 画面:谁、在哪、做什么 | 台词 / 声音 / 连续性 |
|---|---|---|---|---|
| 1 | 全景 / 缓推 | 4s | 阿哲从雨中走进昏暗走廊尽头,站定;走廊只有头顶一盏冷白灯 | 雨声、远处闷雷;与前镜色温一致 |
| 2 | 中景 / 固定 | 6s | 阿哲与对手在走廊相距三米对峙,画面左阿哲、右对手,谁都不动 | 对手:「东西,交出来。」;主光源在画面右侧门口 |
| 3 | 特写 / 微上摇 | 4s | 阿哲下巴绷紧后松开一次,目光不动;雨水顺着额角滑下 | 阿哲:「你确定?」;光源、湿发与镜 2 一致 |
把「镜 2」改写成 Seedance 提示词
可以进一步结构化成:
场景:
昏暗旧走廊,雨夜,头顶一盏冷白灯,地面反光。
人物:
画面左 = 阿哲;画面右 = 对手。两人相距约三米。
景别 / 运镜:
中景双人,固定机位,摄影机在门口一侧,不横移。
动作(0–6s):
两人持续对峙,谁都不动;对手微抬下巴。
光线:
唯一主光来自画面右侧门口,冷调,人物右亮左暗。
声音:
对手说:「东西,交出来。」
环境音有雨声与远处闷雷。
连续性:
阿哲湿发、风衣、光位与上一镜一致,不出现第三人。
2.2.3 补课:先懂影视语言,再写分镜
写分镜要填:
- 景别
- 运镜
- 机位
- 镜头
- 光线
- 构图
很多 AIGC 创作者只盯着提示词,却忽略了背后的影视语言。
真正决定:
- 画面好不好看
- 情绪对不对
- 权力关系是否明确
- 观众注意力在哪里
的,往往就是这些基础语言。
影视基础语言速查:景别 · 机位 · 运镜 · 镜头
① 景别:拍多大
远景 / 全景
作用:
- 交代环境
- 强调时空关系
- 强调人与环境的比例
- 制造渺小感
- 制造孤独感
适合:
- 场景建立
- 开场
- 环境说明
- 大空间关系
中景
大致拍到腰部以上。
特点:
- 最中性
- 最常用
- 兼顾表情与动作
- 适合对话与叙事
近景 / 特写
聚焦脸部或细节。
作用:
- 环境退隐
- 情绪增强
- 用于情绪高潮
- 突出关键道具
大特写
只剩:
- 眼睛
- 手
- 嘴
- 某个局部
作用:
- 冲击最强
- 放大紧张
- 制造悬念
- 提示关键线索
② 机位角度:从哪拍
平视
- 与视线齐平
- 最自然
- 无评判
- 常规对话默认角度
仰拍(低角度)
从下往上。
效果:
- 人物显得高大
- 强势
- 有压迫感
- 有统治感
常用于:
- 权力人物
- 英雄登场
- 威胁感
俯拍(高角度)
从上往下。
效果:
- 人物显得渺小
- 脆弱
- 被支配
- 无助
荷兰角(倾斜)
画面歪斜。
效果:
- 不安
- 失衡
- 精神紧张
- 非正常状态
③ 运镜:怎么动
固定
摄影机不动。
作用:
- 客观
- 克制
- 让观众注意画面内部表演
摇 / 移(Pan / Tilt)
摄影机原地转动或移动。
作用:
- 分配注意力
- 揭示信息
- 上摇显高大
- 下摇显分量
推 / 拉(Push / Pull)
推近:
强调:
「这里很重要。」
将观众拉进人物内心。
拉远:
抽离人物,强调:
- 孤立
- 环境
- 关系变化
- 疏离感
跟 / 环绕
跟随主体移动,或者围绕主体。
作用:
- 增加代入感
- 增强动势
- 环绕会增加戏剧张力与仪式感
希区柯克变焦 / Dolly Zoom
通常表现为:
- 主体大小大致保持
- 背景空间感剧烈变化
常用于:
- 眩晕
- 恐惧
- 突然意识到真相
- 世界观崩塌
- 强烈心理冲击
④ 镜头 / 设备:用什么拍
广角(短焦)
特点:
- 空间关系夸张
- 环境显得大
- 近处人物容易变形
常见感受:
- 压迫
- 荒诞
- 沉浸
标准镜头
特点:
- 接近人眼感受
- 最自然
- 中性
长焦
特点:
- 压缩空间
- 背景虚化
- 主体从环境中抽离
常见感受:
- 浪漫
- 聚焦
- 偷窥感
景深
浅景深:
- 突出主体
- 背景虚化
- 信息集中
大景深:
- 前中后景都清晰
- 信息量大
- 适合多层叙事
设备感
稳定器:
- 平滑
- 高级
- 现代
手持:
- 纪实
- 慌乱
- 临场感
航拍:
- 宏大
- 上帝视角
- 地理关系明确
经典镜头案例
凯恩的巨人身影 · 仰拍
《公民凯恩》(1941)
手法:
- 摄影棚地板挖开
- 镜头从极低位置仰视凯恩
- 画面甚至压着天花板
效果:
- 凯恩显得高大、强势、不可一世
- 低压天花板又暗示人物被权力困住
AIGC 启示:
如果想让人物「有威压」,不要只写:
霸气、强大
更有效的写法是:
- 低角度仰拍
- 头顶压低顶部空间
- 强调低机位
- 人物占据大部分画面
眩晕的楼梯井 · 移焦 / Dolly Zoom
《迷魂记》(1958)
手法:
摄影机后退的同时镜头推进变焦,主体大小变化不大,背景空间急剧变化。
效果:
- 眩晕
- 恐高
- 天旋地转
- 心理冲击
AIGC 启示:
不要只写:
他很震惊。
可以直接指定:
希区柯克变焦 / Dolly Zoom。
诡异的对称长廊 · 广角
《闪灵》(1980)
手法:
- 广角镜头
- 正对走廊
- 严格对称构图
- 纵深线指向中心
效果:
- 空间显得空旷
- 失真
- 不安
- 酒店走廊本身变成压迫来源
AIGC 启示:
要「诡异的空间感」,可以明确写:
- 广角镜头
- 对称构图
- 强纵深
- 中央消失点
窗内窗外 · 大景深
《公民凯恩》(1941)
手法:
通过大景深,让:
- 前景
- 中景
- 后景
同时保持清晰。
效果:
一个镜头内建立多层人物关系与命运关系。
AIGC 启示:
想让前后景同时有叙事价值,可以写:
- 大景深 / 深焦
- 前中后景分别放置什么
- 每层人物处于什么状态
学镜头的正确姿势
不要只记名词。
先问:
「这一刻导演想让我感觉到什么?」
然后再看:
- 景别
- 机位
- 运镜
- 焦段
- 景深
- 构图
是怎样一起实现这种感觉的。
2.2.4 分镜设计视频教学
课件给出的思路是:
有了 AI 还要不要学分镜?要。
因为 AI 可以生成画面,但:
- 什么镜头先出现
- 信息怎么释放
- 冲突怎么升级
- 观众视线放在哪里
- 节奏什么时候停顿
仍然需要导演式设计。
分镜设计的核心问题
如何用分镜把一个故事讲得更有吸引力?
可以从四个方向思考:
- 信息分配:什么时候让观众知道什么
- 视线设计:让观众先看哪里
- 情绪节奏:什么时候远,什么时候近
- 反差设计:用景别、角度、构图制造前后变化
2.2.5 关键技巧:把情绪写成动作
来自 Hell Grind 的表演方法。
不要这样写
这些描述的问题是:
- 「愤怒」没有具体动作
- 「紧张」没有具体表演
- 「保持静止」容易让模型把画面生成成冻结状态
应该这样写
愤怒
不要写:
他非常愤怒地看着对方。
可以改写为:
- 下巴绷紧后松开两次
- 鼻血流到嘴唇却没去擦
- 目光停在地上的碎片
- 再缓慢抬头看向门口
紧张 / 隐忍
不要写:
她强忍着内心的紧张。
可以改写为:
- 一次缓慢眨眼
- 紧接两次快速眨眼
- 再用力闭眼
- 坐下后焦虑地转动钥匙环
- 手指敲击桌面
保持不动
不要写:
所有人保持静止。
可以改写为:
人物用力维持静止,呼吸仍没有平复;静态镜头持续 1–2 秒,人物胸口轻微起伏、鼻翼轻动、眉毛收紧。
这样模型得到的是:
- 人物没有大动作
- 但仍然是「活的」
- 画面不会变成冻结帧
还可以写「内心 OS」
它不一定出现在台词里,却会改变:
- 呼吸
- 眼神
- 动作节奏
- 面部紧张度
例如:
他想起别人进门前再次攻击过自己,于是门推开的瞬间,嘴角重新挂上一点勉强的笑。
这种「看不见的动机」会转化为「看得见的表演」。
2.3 画面:把分镜抽成成片
剧本和分镜解决:
要什么。
画面这一阶段解决:
怎么把它抽出来、挑出来、连起来。
核心理念已经从:
「画死每一帧」
转向:
「用参考约束模型,让它自己发挥。」
参考更多用于影响:
- 站位
- 光影
- 环境
- 空间
- 人物身份
- 风格
尽量不要让参考图原样直接出现在成片中。
模型搭配
- 视频:Seedance 2.5
- 图片:Image 系模型、Nano Banana
- Midjourney:常用于提高审美、强化风格
出图是「抽」出来的
画面需要:
- 反复生成
- 反复筛选
- 挑选最合适的版本
可以考虑:
- 拆成两段
- 删一个动作
- 缩小活动范围
- 改机位
- 改人物数量
- 简化空间关系
抽到好画面可以反哺剧情
呼应前面「剧本可变」的理念:
如果抽到一个特别好的镜头,可以适度调整剧情,把它利用起来。
2.3.1 人物资产:三视图(去头) + 大头照,且「不脏」
稳定的人物资产,是长片角色一致性的根基。
课件将人物资产拆成:
三视图负责身体、服装、比例;大头照负责脸。
人物资产 = 「三视图(去头)」 + 「一张大头照」
三视图
通常包括:
- 正面
- 侧面
- 背面
但要:
去掉头部。
用途:
- 身材
- 服装
- 颜色
- 身体比例
- 服装轮廓
- 材质结构
大头照
单独负责:
- 脸
- 五官
- 发型
- 正面身份识别
要求:
- 清晰
- 正光
- 尺寸足够
- 不要混入身体比例信息
为什么三视图必须去头
因为三视图本身信息很多。
模型生成时,为了省算力,可能把三张图里的小脸直接「吃进去」,导致:
- 脸崩
- 五官漂移
- 身份不一致
正确做法是:
- 三视图只保留身体、衣服、比例
- 把头砍掉
- 脸交给一张独立、清晰、够大的大头照锁定
要点一:三视图不能有头
三视图负责:
- 身材
- 服装
- 颜色
- 比例
大头照负责:
- 脸
- 五官
- 发型
两者不要相互干扰。
要点二:资产要「不脏」
这里的「不脏」不是指干净程度,而是:
不要塞入过多不必要细节。
人物资产是用来给模型识别和复用的视觉信息,不是单纯展示审美的成片。
如果塞入太多:
- 花纹
- 褶皱
- 配饰
- 材质纹理
- 复杂造型
模型在人物:
- 转身
- 运动
- 远景
- 侧面
- 背面
时就容易出现:
- 变形
- 漂移
- 不一致
- 特征串位
建议保留
- 脸型
- 发型轮廓
- 体型
- 服装廓形
- 少量关键标志
其余细节尽量简化。
造型越复杂,资产拆得越细
复杂:
- 武器
- 首饰
- 特殊服装
- 高辨识度道具
不要全部压在一张人物图里。
可以拆成:
- 人物基础资产
- 武器资产
- 饰品资产
- 特殊服装资产
按镜头需要调用。
参考图可以「补素」
参考图的任务是让模型:
稳定认出角色。
而不是提前把所有:
- 材质感
- 电影感
- 光影
- 气氛
- 最终调色
全部塞满。
具体场景中的这些信息,可以在镜头阶段再增加。
2.3.2 环境图:要变化视角
环境参考的目标不是:
让模型照抄一张图。
而是:
让模型先理解空间结构,再按目标机位重构。
即使最终要拍正面,也可以先提供:
- 俯视图
- 平面结构图
- 3/4 视角
- 侧视图
让模型理解:
- 门在哪里
- 窗在哪里
- 家具在哪里
- 走廊如何延伸
- 空间纵深关系
再重新生成目标机位画面。
防止模型偷偷照搬参考图
可以主动制造输入与输出的差异。
换视角
目标是正面画面,可以给:
- 俯视图
- 3/4 视角
逼模型理解结构后重新组织画面。
换比例
目标生成:
- 16:9 视频
参考图可以使用:
- 1:1
如果比例无法直接套用,模型就必须重新构图。
换分辨率
例如目标生成:
- 720p
参考图可以:
- 480p
目的不是追求低质量,而是保留结构信息,降低模型直接复制细节的倾向。
判断标准
重点看:
- 人物与环境是否真的融合
- 空间关系是否合理
- 光影是否属于同一个空间
而不是:
成片与参考图有多像。
2.3.3 光影:需要「刷」
人物资产往往是在:
- 棚拍
- 均匀自然光
- 正面补光
环境则可能是:
- 车内
- 夜景
- 暗室
- 逆光
- 侧光
- 顶光
如果人物脸仍保持棚拍亮度,就会出现:
像把人物贴上去一样。
因此光影需要「刷」。
这里的「刷」是:
- 反复生成
- 微调提示词
- 换参考
- 调整光位
- 调整色温
- 调整曝光
直到人物与环境属于同一个空间。
解决思路
反复生成 + 微调
不断调整:
- 主光方向
- 辅光强度
- 脸部亮度
- 阴影
- 色温
- 环境反射
使用光影关系正确的参考图
如果人物应该在:
- 逆光
- 侧光
- 暗室
- 车内
可以给模型同类光影参考,让它理解目标关系。
先看人物是否「属于这个空间」
不要只看:
脸好不好看。
而要看:
- 人物受光方向
- 光线亮度
- 色温
- 环境反射
- 阴影方向
是否统一。
2.3.4 延长镜头:参考结尾视频,不要只参考尾帧
如果已经有一个镜头,想继续往后延长:
不要只拿最后一帧图片继续生成。
原因是尾帧只保留:
- 静态构图
- 当前人物位置
- 当前画面信息
却丢失:
- 人物运动方向
- 运动速度
- 惯性
- 光影变化趋势
- 动作节奏
- 镜头运动方向
因此更好的做法是:
参考结尾一小段视频,而不是只参考尾帧。
这样模型才能理解:
- 人物刚刚怎么动
- 摄影机往哪动
- 节奏有多快
- 动作有没有惯性
- 光线是怎么变化的
结课方法论:把整套流程串起来
整套课程可以压缩成一条生产链:
故事类型
↓
剧本骨架
↓
Save the Cat / 短剧留存逻辑
↓
一句话节拍表
↓
结构化 AIGC 分镜
↓
镜头语言设计
↓
把情绪翻译成动作
↓
角色 / 环境 / 道具资产
↓
参考图作为导演约束
↓
图片生成与筛选
↓
视频生成
↓
光影、连续性、表演修正
↓
声音 / 配乐 / 后期
↓
成片
Comments
No comments yet — be the first.