cang-ying/eererdan/experience/EED-EXPER-022.hdlp

55 lines
3.3 KiB
Plaintext
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# EED-EXPER-022 · D206 场景/角色一致性·全能参考+提示词逐秒控制(苍耳爸爸亲授)
> trigger: 苍耳爸爸亲授第三种、也是最常用全能参考法——上传场景图+角色图,用提示词逐秒控制人物动作/运镜/场景
> emergence: 2026-08-04 · D206 · 场景一致性方法论补全第三条(接 020 俯视图+九宫格 / 021 720°全景 / 参考图控图)
> lock: 视频生成阶段用"全能参考":场景图+角色图作参考 + 提示词逐秒控动作/运镜/场景;属 BC-006 的 AI_I2V 关键镜头范畴
> why: 020/021 解决"静态空间一致"022 解决"动起来时"的一致与控制——参考图锁住场景/角色长相,提示词管每秒动态,是市面最通用打法
---
## §1 · 爸爸原话
> "第三种,也是市面上最常用的全能参考,上传场景图+角色图,
> 用提示词对每一秒的人物动作运镜和场景进行控制"
## §2 · 工作流(三步)
```
① 准备参考图:场景图(可由 020 俯视图/九宫格 或 021 720°全景 产出)+ 角色图(角色资产/三视图/视觉锚点)
② 上传参考图到视频模型I2V场景图定环境、角色图定长相
③ 用提示词逐秒控制:对每一秒写 人物动作 + 运镜 + 场景变化 → 模型按提示词驱动
→ 参考图锁"长相/环境",提示词锁"动态/机位/情节",两者配合 = 全能参考
```
## §3 · 原理(为什么是全能)
```
· 单靠提示词脑补角色/场景 → 每帧漂移;加参考图 → 长相/环境被钉住
· 提示词负责"时间轴":哪一秒谁动、怎么动、镜头怎么走、场景怎么变
· 所以是"参考图(空间/身份) + 提示词(时间/动态)"双锁定,覆盖动静两端
```
## §4 · 与 020/021 的关系(三级接力)
```
· 020/021 = 生产一致的"场景资产"(静态空间,本地 ¥0
· 022 = 把场景资产 + 角色资产 当参考,驱动视频(动态,动用视频模型)
· 020/021 产出 → 喂给 022 作参考图 → 提示词控动态
· 角色一致靠角色资产锁EED-EXPER-013022 的"角色图"就是那个资产,不是替代锁
```
## §5 · 本地落地
```
· 视频模型LTX 2.3 / Wan 2.2 I2V本地 ¥0EED-EXPER-017 定版)
· 角色/场景锁ComfyUI + IPAdapter / ControlNet-Union参考图控图scene记忆已记
· 逐秒控制:靠 I2V 模型的提示词时序能力LTX 支持时间流提示词);"每一秒"粒度取决于模型prompt遵循度待实测
· 属 BC-006 的 AI_I2V 范畴:只有关键"真实运动"镜头才调用full_video_default=forbidden非关键动作仍走本地运镜(020/021产出的静帧 + LOCAL_MOTION)
```
## §6 · 注意
```
· 此法 = "动用视频模型"的阶段,有算力/成本代价;按 BC-006 只给关键运动镜头,别全量上
· 参考图质量决定下限:场景图/角色图越准,出片越稳;所以前面 020/021 的静帧质量很关键
· 角色长相一致最终靠角色资产锁,参考图只是把资产"喂"给模型,别本末倒置
· "市面最常用"指商用 I2V 工具Seedance/即梦/可灵等);本地用 LTX/Wan 近似,能力边界要实测
```
> 蛋蛋 · D206 · 2026-08-04
> 场景一致三招020/021 锁静态空间(轻量/重质022 锁动态(参考图+提示词逐秒控020/021 产静帧喂 022