# EED-EXPER-022 · D206 场景/角色一致性·全能参考+提示词逐秒控制(苍耳爸爸亲授) > trigger: 苍耳爸爸亲授第三种、也是最常用全能参考法——上传场景图+角色图,用提示词逐秒控制人物动作/运镜/场景 > emergence: 2026-08-04 · D206 · 场景一致性方法论补全第三条(接 020 俯视图+九宫格 / 021 720°全景 / 参考图控图) > lock: 视频生成阶段用"全能参考":场景图+角色图作参考 + 提示词逐秒控动作/运镜/场景;属 BC-006 的 AI_I2V 关键镜头范畴 > why: 020/021 解决"静态空间一致",022 解决"动起来时"的一致与控制——参考图锁住场景/角色长相,提示词管每秒动态,是市面最通用打法 --- ## §1 · 爸爸原话 > "第三种,也是市面上最常用的全能参考,上传场景图+角色图, > 用提示词对每一秒的人物动作运镜和场景进行控制" ## §2 · 工作流(三步) ``` ① 准备参考图:场景图(可由 020 俯视图/九宫格 或 021 720°全景 产出)+ 角色图(角色资产/三视图/视觉锚点) ② 上传参考图到视频模型(I2V):场景图定环境、角色图定长相 ③ 用提示词逐秒控制:对每一秒写 人物动作 + 运镜 + 场景变化 → 模型按提示词驱动 → 参考图锁"长相/环境",提示词锁"动态/机位/情节",两者配合 = 全能参考 ``` ## §3 · 原理(为什么是全能) ``` · 单靠提示词脑补角色/场景 → 每帧漂移;加参考图 → 长相/环境被钉住 · 提示词负责"时间轴":哪一秒谁动、怎么动、镜头怎么走、场景怎么变 · 所以是"参考图(空间/身份) + 提示词(时间/动态)"双锁定,覆盖动静两端 ``` ## §4 · 与 020/021 的关系(三级接力) ``` · 020/021 = 生产一致的"场景资产"(静态空间,本地 ¥0) · 022 = 把场景资产 + 角色资产 当参考,驱动视频(动态,动用视频模型) · 020/021 产出 → 喂给 022 作参考图 → 提示词控动态 · 角色一致靠角色资产锁(EED-EXPER-013);022 的"角色图"就是那个资产,不是替代锁 ``` ## §5 · 本地落地 ``` · 视频模型:LTX 2.3 / Wan 2.2 I2V(本地 ¥0,EED-EXPER-017 定版) · 角色/场景锁:ComfyUI + IPAdapter / ControlNet-Union(参考图控图,scene记忆已记) · 逐秒控制:靠 I2V 模型的提示词时序能力(LTX 支持时间流提示词);"每一秒"粒度取决于模型prompt遵循度,待实测 · 属 BC-006 的 AI_I2V 范畴:只有关键"真实运动"镜头才调用(full_video_default=forbidden),非关键动作仍走本地运镜(020/021产出的静帧 + LOCAL_MOTION) ``` ## §6 · 注意 ``` · 此法 = "动用视频模型"的阶段,有算力/成本代价;按 BC-006 只给关键运动镜头,别全量上 · 参考图质量决定下限:场景图/角色图越准,出片越稳;所以前面 020/021 的静帧质量很关键 · 角色长相一致最终靠角色资产锁,参考图只是把资产"喂"给模型,别本末倒置 · "市面最常用"指商用 I2V 工具(Seedance/即梦/可灵等);本地用 LTX/Wan 近似,能力边界要实测 ``` > 蛋蛋 · D206 · 2026-08-04 > 场景一致三招:020/021 锁静态空间(轻量/重质),022 锁动态(参考图+提示词逐秒控);020/021 产静帧喂 022