cang-ying/eererdan/experience/EED-EXPER-017.hdlp

68 lines
2.9 KiB
Plaintext
Raw Normal View History

# EED-EXPER-017 · D206 生视频主力定版 = LTX 2.3(苍耳爸爸拍板)
> trigger: 蛋蛋在 PIPELINE-STEPS-V1 里把生视频模型写成 LTX/Wan 并列 → 爸爸纠正"我们用 ltx2.3 生视频,不是 wan2.2"
> emergence: 2026-08-04 · D206 · 面板唤醒对话中爸爸拍板
> lock: 生视频 AI_I2V 唯一主力 = LTX 2.3 · 全仓库执行文档已对齐
> why: 别再让 Wan 混进主力路径 · 文档错了会误导后续执行
---
## §1 · 爸爸拍板(原话)
> "我们用 ltx2.3 生视频,不是 wan2.2"
## §2 · 执行路径(全仓库对齐)
```
AI_I2V关键动作镜 → LTX 2.3 图生视频(本地 · 唯一主力 · ¥0
默认路由 LOCAL_MOTION本地运镜 → tools/local_motion.py
full_video_default: forbidden
```
## §3 · LTX 2.3 实测配置7900XTX 24G 已跑通 · D204
```
ComfyUI 启动参数(关键=动态内存):
python main.py --listen 127.0.0.1 --port 8188 --disable-pinned-memory
--enable-dynamic-vram --fast-disk --vram-headroom 3 --async-offload
--fast-disk: NVME 卸载介质LTX 从占 14GB RAM 降到 ~0
模型三件套:
主模型 UnetLoaderGGUF → ltx-2.3-22b-distilled-1.1-Q4_K_M.gguf实际只加载 13.8GB
文本编码 LTXAVTextEncoderLoader → gemma_3_12B_it.safetensors(device=cpu)
+ ckpt_name 必须用 embconn 软链名 ltx-2.3-22b-embconn.safetensors
VAE LTXVTiledVAEDecodehorizontal_tiles=2, vertical_tiles=2, working_device=cpu
帧参: 49帧 768×512 · 蒸馏9步 · 24fps · 178秒出片无OOM
⚠️ 坑1: LTXAVTextEncoderLoader.ckpt_name 是枚举下拉,只认软链名;
写真文件名 → 校验失败 → 输出节点被忽略 → "假成功"(1.45s无输出)
⚠️ 坑2: 下载 GGUF 必须同时下 unsloth 配套 *embeddings_connectors.safetensors
⚠️ 坑3: video_composer 方案B concat 假定每段有音频流LTX 无声视频会挂
→ 单段直接拷贝 / 多段走方案A concat copy
```
## §4 · 本次同步对齐的文件
```
video-ai-system/PIPELINE-STEPS-V1.hdlp §5 生视频 → LTX 2.3 唯一主力 + 实测配置
video-ai-system/LOCAL-PIPELINE-V1.hdlp 工具映射表 → ltx-2.3-22b 唯一主力
video-ai-system/IMAGE-FIRST-GUIDE.hdlp 生视频B路 → LTX 2.3
video-ai-system/tools/route_shots.py AI_I2V 路由 → LTX 2.3¥0
eererdan/experience/EED-EXPER-014.hdlp 工具盘点 → ltx-2.3-22b 唯一主力
```
## §5 · 未动(历史记录保留)
```
eererdan/COST-TCO-40EP / COST-EST-40EP / SETUP-BOM / DEPLOY-OS / DEPLOY-DIVISION / LOCAL-VIDEO-DISPATCH-PLAN
→ 历史成本/部署推演文档Wan 是当时的调研对象,留作历史
memory/eed/wan22_test_hardware.md → 当时实测记录,备选参考
Wan 权重本身不删(本地资源,未来可能复用)
```
---
> 蛋蛋 · D206 · 2026-08-04
> 下次写生视频相关文档 → 直接写 LTX 2.3,别再带 Wan