H3素材驱动-开源项目盘点-20260927.md

「白模/红模素材 → H3 换人/复刻」相关开源项目盘点

盘点时间:2026-09-27 01:0x | 执行者:DSH(本机)| 未安装、未运行任何项目(只查了 GitHub/HF 元数据与 README) 配套报告:H3白模红模素材参考能力核查-20260927.md(官方能力核查) 星数/许可为 2026-09-27 从 GitHub API 实测值,社区项目迭代极快,用前请再看一眼仓库首页。


一、结论速览

有,而且分三类。最贴题的是 ReShot——它把「白模/红模素材」这件事自动化了:

类别代表项目一句话
① 专门的"参考控制视频"生成器(最贴题)maosika-ai/reshot(Apache-2.0,27★)把任意视频转成 depth 深度灰模 / OpenPose 骨架 / canny 线稿 视频,实测用于 MiniMax H3(--target h3),喂 <Video 1> 或 H3 Fun ControlNet 的 pose 输入
② H3 参考视频/换人/长视频工作流(社区节点)AIMixer/ComfyUI_MiniMaxH3_Director(2034★,Apache-2.0)、NikoDemon80/ComfyUI-H3-Motion-Context(1016★)、nkxx188/ComfyUI-MiniMaxH3-Easy(785★)、本地 siyuan-liu31/minimax-h3-video-studio(18★,含舞蹈复刻/人物迁移技能)等把 Ref2VA 变好用:多段导演台、跨段动作/音频连续、长视频、坏脸修复
③ 其它模型系的动作迁移/角色替换(H3 之外的替代路线)zai-org/SCAIL-2(Apache-2.0,1225★,端到端无骨骼依赖、可分钟级)、Wan-AI/Wan2.2-Animate-14B(Apache-2.0,官方开源)不依赖骨骼/白模,直接「驱动视频 + 角色图 → 成片」,长片处理更省事

为什么社区要造「白模/红模」素材? ReShot 的 README 把原因写得很直白:直接把真人视频当参考,模型会连脸、衣服、风格一起抄,而且平台内容审核可能直接拒;用嘴描述动作又不可控。所以有人先渲染成无身份的白模/红模视频再喂模型。ReShot 就是这个需求的自动化版本:不用买/下载白模素材,自己把任意片段转成灰模或骨架即可,且能控制"只保留什么"。


二、① ReShot(最推荐先看这个)

做什么:mp4 进 → mp4 出,三种控制视频:

--control输出保留丢弃适合
depth(默认)灰模(近白远黑)站位、比例、所有动作、镜头、场景形状脸、衣服、光照、风格通用:打斗、走位、运镜、群像
poseOpenPose 骨架(含手,不含脸)每个肢体与手指其它一切(含体型与场景)舞蹈/武术;可直接接 H3 Fun ControlNet 的 pose 输入
canny白线黑底构图与轮廓颜色明暗(但会保留脸/服装轮廓)只要画面版式时

对本需求的直接价值

典型用法(把你这批素材变成"标准控制视频")

# 红模素材 → 深度灰模(H3 规格,小尺寸防串脸)
reshot 03_L_复仇摇-ai素材_720x1280.mp4 -o h3_depth.mp4 --target h3 --control depth --max-res 320
# 红模素材 → 骨架(可直连 H3 Fun ControlNet 的 pose 输入,省掉提示词里"别画骨架"的解释)
reshot 03_L_复仇摇-ai素材_720x1280.mp4 -o h3_pose.mp4  --target h3 --control pose

注意:你手上的红模/白模素材本身已经是"无身份人偶",这一步的收益主要是①尺寸/帧率/时长自动合规 ②可自行生产素材(不必再找抖音素材号)③深度图比纯色绿幕人偶少很多干扰(绿幕背景不需要,但也没坏处)。


三、② H3 参考视频/换人/长视频:社区工作流盘点

项目星许可做什么与「白模/红模换人」的关系
AIMixer/ComfyUI_MiniMaxH3_Director2034Apache-2.0官方 ComfyUI H3 之上做多段导演台长舞蹈/多镜头一次编排(官方 Director 的增强版)
huangserva/ComfyUI_MiniMaxH3_Director1100见仓库H3 Director 工作流同类,可对比选一个
NikoDemon80/ComfyUI-H3-Motion-Context1016见仓库跨段动作与音频真正连续(clip chaining)白模舞蹈 >15 s 必须分段,这个是接缝质量关键
nkxx188/ComfyUI-MiniMaxH3-Easy785见仓库一个精简工作流覆盖 T2V/I2V/首尾帧/参考视频想少折腾时的入门全套
LBH-123-AI/Comfyui_Minimax_h3_latent_Upscaler666见仓库H3 潜空间放大(跳过 5B VAE 解码)出片后提清晰度
xmarre/ComfyUI-Spectrum-MiniMax-H3672见仓库免训练加速(切 H3 轨迹)提速
Larryvrh/ComfyUI-MiniMax-H3-Turbo586Apache-2.0Turbo LoRA 集成提速
letorig/video-generator-client549MITSeedance/Kling/MiniMax/Wan 异步客户端批量化脚本调用
OpenVDN/vdn-minimax-h3544Apache-2.0VideoDeltaNet-H3:准实时 T2VA/I2VA/FL2VA/Ref2VA-like研究向,实时生成
Carasibana/ComfyUI-H3-FaceRefine441见仓库小脸修复(逐帧跟踪→裁切→H3 重绘→贴回)舞蹈全身远景脸崩的现成解药
SkyNotSilent/awesome-MiniMax-H3-cases412见仓库2084 个可播放 H3 案例 + 663 条公开提示词 + 25 篇教程抄提示词、找同类案例
HELPMEEADICE/TE-Speed-MiniMaxH3-OSS323见仓库超级缓存加速插件提速
seesee75-commits/ComfyUI-MiniMaxH3-Director297见仓库H3 时间线编辑器(分镜/首尾帧/图-视频-音频参考/联音)多镜头换人编排
T8mars/minimax-h3-prompt-skill-T8257见仓库H3/Seedance 提示词技能 + 案例查看器写提示词
duckyshell/ComfyUI-MiniMaxH3-Prompt-Writer230MIT多模态 H3 提示词生成节点(本地/API)写提示词
astropuzzo/ComfyUI-MiniMax-H3-Image-Studio189UnlicenseH3 图像/参考编辑节点与工作流角色图制作
Zzz1phyrf/ComfyUI-H3-LongVideo129见仓库Ref2VA 长视频控制器(唱歌/说话向)长片分段
karuvanan/MiniMax-H3-Director-Cut-Studio121NOASSERTIONPySide6 桌面导演台(分镜规划/时间线/长视频经 ComfyUI 渲染)桌面端编排
sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA119见仓库W4A4 + Streaming VSA 加速提速
ANe5s/ComfyUI-MiniMax-H3-Hybrid28见仓库用更强的 FL2VA 模型 + 已验证的 Ref2VA 张量叠加画质探索
klfzqxs/ref2va-h3-video-optimizer27见仓库用顺序迭代反馈自动优化 Ref2VA 提示词自动调词
ethanfel/ComfyUI-MiniMaxH3-Timed-References8GPL-3.0给核心 Ref2VA 节点加带时间戳的图片参考分镜级参考
siyuan-liu31/minimax-h3-video-studio(本机已装)18无 LICENSE 文件Studio + h3ctl CLI;自带 h3-dance-replication(舞蹈复刻)、h3-character-migration(人物迁移)、长视频分段合成本机现成,且技能命名最贴合本需求;注意其 SageAttention 实验补丁曾致 GPU 掉总线(2026-09-14 已修,仍建议优先官方 Director)

其它索引类:iSk2y/awesome-minimax-h3、wildminder/awesome-minimax-H3、exportAnything/ComfyUI-MiniMax-FastH3-Workflows、teskor-hub/minimax-h3-skill(含 references/comfyui.md,写了参考视频会被缩放到 768 短边/768×1344 面积上限/每轴 32 取整)。

⚠️ 提示词类项目(Prompt-Writer / prompt-skill / optimizer)对"换人"帮助有限——换人成不成,靠的是 参考接线 + retention 声明 + 分段策略,不是把词写得更花。


四、③ H3 之外的替代路线(动作迁移/角色替换)

项目星许可说明对你的场景
zai-org/SCAIL-21225Apache-2.0论文《SCAIL-2: Unifying Controlled Character Animation with End-to-end In-Context Conditioning》官方实现;端到端、不依赖骨骼/白模,宣称可做分钟级跳舞/打戏的角色替换若你嫌 H3 单段 15 s + 分段续接漂移麻烦,这是最值得评估的替代;建于 Wan 之上(默认分支 wan-scail2),显存/时长需实测
nkxx188/ComfyUI-SCAIL2-Easy83Apache-2.0SCAIL-2 的简洁 ComfyUI 插件想走 GUI 就配这个
vjumpkung/comfyui-scail-2-loop-sampler见仓库见仓库SCAIL-2 循环采样(长片)长舞蹈
Wan2.2-Animate-14B—Apache-2.0阿里通义万相官方开源的角色动画模型(动作/表情 1:1,14B,HF Wan-AI/Wan2.2-Animate-14B);ComfyUI 官方模板蓝图 motion_transfer_wan_animate_2(+distilled) 已内置与 H3 不同的模型系:骨骼/姿态驱动型;16 GB 卡跑 14B 需量化+实测
drbaph/Viggle-Animate-ComfyUI(HF)—other基于绑定的动作迁移 ComfyUI 封装观望
maosika-ai/reshot27Apache-2.0见上文;它也支持 --target wan(Wan 2.1 VACE)跨模型通用的控制视频生成

五、给你这两条素材的推荐组合(仍然不跑,等 GPU 空闲)

目标推荐组合说明
最省事:就用现有红模/白模素材换人H3 官方 Director-rv2v(Ref2VA) + 03(14.04 s 直接可用)/ 02(先裁 ≤15 s) + 三视图本机已验证过同类流程;无需新装任何东西
最稳的控制质量先 reshot … --target h3 --control depth --max-res 320(或 pose)→ 再把产物当 <Video 1> 走 Director-rv2v尺寸/帧率/时长自动合规;避免串脸;比直接喂彩色红模更"只传动作"
骨架强控制ReShot pose.mp4 → H3 Fun ControlNet Union 的 pose 输入需补装 minimax_h3_fun_controlnet_union_pruned_int8_convrot + sdpose_wholebody_fp16 + rt_detr_v4-x-hgnet_fp16(本机 ComfyUI 0.37.0 已满足 ≥0.35);但 ReShot 直接产 pose.mp4 就免了 SDPose 那几个权重 —— 二选一即可,别重复装
要 >15 s 成片Director-rv2v 分段 + ComfyUI-H3-Motion-Context 接缝;或直接评估 SCAIL-2 分钟级路线H3 单段限 15.083 s(362 帧),长片必须分段
舞蹈全身远景脸糊叠加 ComfyUI-H3-FaceRefine(或本机已有的 RTX VSR/FaceRefine 后处理)现成解药

装之前要知道的三件事

  1. 许可:ReShot / SCAIL-2 / Wan2.2-Animate = Apache-2.0(可商用);本机 Studio 没有 LICENSE 文件(自用无妨,二次分发要问作者);个别 H3 节点仓库未标许可。
  2. 别装一堆重复的加速插件:Turbo/Spectrum/TE-Speed/W4A4-VSA 功能重叠,挑一个(本机已有官方 Turbo 4 步 + dasiwa 加速链路)。
  3. 显存:ReShot 3 GB 很轻;H3 Ref2VA 本机实测峰值约 14.5 GB/16.3 GB(分段 5 s 档);SCAIL-2/Wan-Animate 14B 系需先算显存账,16 GB 卡大概率要量化 + 短段。

六、参考链接

七、本地相关文件

下载此文件