h3-env-context.md
MiniMax H3 部署环境上下文(远程服务器 192.168.31.25 / zywpc)
硬件
- GPU: NVIDIA GeForce RTX 5060 Ti 16GB VRAM(CUDA 13.2,驱动 595.84,当前空闲)
- CPU/内存: 32GB RAM(另有约 72GB swap)
- 磁盘: NVMe SSD,剩余 705GB
- OS: Ubuntu(内核 6.8),Python 3.12.3
ComfyUI 部署
- 位置: /home/zyw/ComfyUI,venv: /home/zyw/ComfyUI/venv
- 端口: 8189(--listen 0.0.0.0)
- 模型: diffusion_models 88GB + text_encoders 79GB + vae 11GB + loras 4.8GB (MiniMax H3 相关模型已齐全;checkpoints 目录为空,用 diffusion_models 方案)
- 自定义节点: ComfyUI-Spectrum-MiniMax-H3, ComfyUI-Manager, Impact-Pack, VideoHelperSuite, KJNodes, Easy-Use, Florence2, PuLID-Flux, comfyui-tensorops, ComfyUI-GGUF, ComfyUI-SolAttn_triton 等 20+
现有启动脚本(显存优化档位演进)
- start_comfyui_optimized.sh: 基础优化(--lowvram --force-fp16 --reserve-vram 1.5 --use-sage-attention --cache-lru 20 --preview-method none)
- start_comfyui_v2.sh: 同上(无 cpu-vae)
- start_comfyui_v3.sh: v2 + --vram-headroom 2 --fast-disk --cache-none --disable-smart-memory(过于激进)
- start_comfyui_v4.sh: v2 + --fast-disk,--reserve-vram 降到 1.0(当前推荐档)
- 环境变量: PYTORCH_CUDA_ALLOC_CONF=max_split_size_mb:512,expandable_segments:True, OMP_NUM_THREADS=4
用户目标
- 在 16GB 显存 + 32GB 内存的这台远程服务器上,用 MiniMax H3 生成 约 1MP(约 100 万像素,如 1280x720 或 1024x1024)× 15 秒 的视频。
- 需要判断可行性、所需优化手段、预计速度与潜在 OOM 风险。
备注
- 曾打过补丁 patch_h3.py 到 comfy_extras/nodes_minimax_h3.py(把 ref_videos Autogrow 改为固定 IMAGE 输入),说明用户已在折腾 H3 节点的输入兼容问题。