cang-ying/memory/eed/project_h3_local_24g_feasible.md

30 lines
3.5 KiB
Markdown
Raw Normal View History

---
name: H3在AMD 7900XTX 24G+30G 可行性(实测可跑)
description: MiniMax H3 int8 官方/社区最低配置 RTX3060 12G显存+32G内存爸爸24G显存远超、30G内存仅差2G擦边AMD day0适配之前卡死是没开--lowvram+内存擦边非硬件不行
type: project
---
MiniMax H3int8_convrot 版实测最低配置ComfyUI 官方+社区2026-08-04 搜索确认):**RTX 306012G 显存)+ 至少 32G 系统内存 + 好的 NVMe SSD**8-bit 权重下可跑 832×480 / 124 帧,约 10 分钟。AMD 在 H3 开源当日2026-08-03完成 **Day 0 适配**(腾讯/新浪等报道ROCm 7.2 起 MiniMax 等国内模型 Day 0 支持)。
**爸爸机器AMD 7900XTX 24G 显存 + 30G 内存):
- 显存 24G >> 最低 12G → 绰绰有余(爸爸"24G 游刃有余"说对了)。
- 内存 30G仅比官方最低 32G 少 2G → **擦边,非死局**
- 之前"80G 权重装不下 54G 所以跑不了"结论错H3 是 offload/流式推理32G 内存即可跑(社区实测),并非 80G 权重需同时驻留。
**之前卡死真因(非硬件绝对不行):**
1. 启动未开 `--lowvram`offload 不充分(日志 `lowvram patches: 0`TE 17.6G 占满卡、内存峰值冲过 30G → swap 风暴卡死。正确配置下 32G 内可压住。
2. ROCm 下 7900XTXRDNA3/gfx1100跑大模型可能需设 `HSA_OVERRIDE_GFX_VERSION` 等环境变量CSDN 实测 7900XTX 跑 LLM 需强制 GFX 版本),未设可能识别异常/fallback。
3. 曾误把权重文件大小之和(80G)当"必须同时驻留内存" → 过度悲观结论。
**Why:** 爸爸两次质疑都对——"72G 数错/查错目录"、"24G 应该游刃有余"。真相对爸爸有利:机器极可能能跑 H3之前是配置不当+误判。
**How to apply:** 在爸爸机器上跑 H3 前,先:① 清后台释放内存、② ComfyUI 启动加 `--lowvram`(保留原 `--disable-pinned-memory --enable-dynamic-vram --fast-disk --vram-headroom 3 --async-offload`)、③ 试设 ROCm gfx 覆盖环境变量、④ 必要时建 swap 文件补那 2G 内存缺口。不要再说"装不下/跑不了"——显存够、内存擦边够是工程配置问题。LTX2.3 仍是漫剧管线稳妥主力,但 H3 本地路径现在 reopen。
## 2026-08-04 深挖更新(命令行路径全探明)
- ComfyUI 已更新到官方最新git master + comfyui-workflow-templates 0.11.28(官方 H3 模板 6 个video/api × t2v/i2v/r2v+ comfyui-frontend-package 1.47.12清华镜像装的PyPI 直连 SSL 断)。
- `4c314f31-ecda-4b08-ae98-faaba1bf613f` 官方 all-in-one H3 节点 = **前端模板节点**:后端代码/object_info 无实现,`/prompt` 不收 graph 格式 → **命令行直接提交跑不了**,只能在 Web UI 加载官方模板点运行(前端展开)。
- RH 加载器DirectModelLoader 等)输出**专有类型**MODEL_TYPE/TEXT_ENCODER_TYPE/VAE_BUNDLE_TYPE接不了官方标准节点要标准 MODEL/CLIP/VAE→ 组装"官方节点+RH loader"不可行。
- RH 路径内存爆根因再确认:单任务 80G 权重 > 机器 62G 虚拟内存30G 物理 + 32G swap/swap.img 8G + /swap2.img 24G即使全 offload 也装不下RH loader 还把 TE 17.28G resident 显存lowvram patches:0。要硬跑只能再加 20G+ swap很慢
- **H3 在爸爸机器的正确路径 = Web UI 加载官方模板点运行**(官方流式加载,社区 32G 内存能跑即此路)。待爸爸在 UI 验证 4c314f31 是否被前端识别(若报未知节点=代码还没实现,等官方更新或换 RunningHub 整合包)。