结论:说对了一半。 要分两层看: ① 如果指 pip 包版本号 "sageattention 3.x"——不存在(PyPI 官方包最新仍是 1.0.6,2.2.x 全部走源码/社区编译轮子,没有 3.x 包)。 ② 如果指 SageAttention3 这个算法/实现——真实存在(THU-ML 官方仓库
sageattention3_blackwell/,论文 arXiv:2505.11594),但它不是 2.2.0 的"升级版 3",而是另一条技术路线:Blackwell FP4 注意力,目前主要落地在 SGLang 等推理服务,尚未进入 ComfyUI 主线。
| 出处 | 最新版本 | 说明 |
|---|---|---|
PyPI sageattention | 1.0.6(2024-11 发布,此后未更新) | 官方 pip 包停留在 1.x |
| 你在 GPU 机上的安装 | 2.2.0(/home/zyw/SageAttention 源码装) | 2.2.x 是社区为 RTX 50 系 Blackwell 做的预编译/源码路线,仍是 ComfyUI 生态当前主线 |
sageattention3_blackwell/ 子目录,独立模块 sageattn3_blackwell。python ≥ 3.13、torch ≥ 2.8.0、CUDA ≥ 12.8。| 检查项 | 你的现状 | 是否满足 SageAttention3 |
|---|---|---|
| Python | 3.12.3(h3-env-context) | ❌ 需 ≥3.13 |
| torch / CUDA | CUDA 13.x、torch 未见 2.8 基线 | 未满足产出方推荐 |
| GPU | RTX 5060 Ti(sm120 Blackwell) | ✅ 算力满足 |
| 场景 | MiniMax H3 + ComfyUI(dasiwa/官方工作流) | ⚠️ H3 不在官方 README 已验证清单(CogVideoX/Hunyuan/Mochi/Flux/SD3.5),且官方明示其他视频模型需混合用法、不保证无损 |
| 生态 | 社区/Comfy 选择 2.2.x | 主线未动 |
结论:不用追、不用装。 你机器上的 2.2.0 是当前 ComfyUI 生态的正确选择,SageAttention3 是给"RTX 50 系 + 大吞吐推理服务(SGLang/vLLM)+ 已验证扩散模型"准备的前瞻路线;等它(a)进入 ComfyUI 官方 sage 后端、(b)或社区出适配 H3 的验证与 Blackwell 轮子后再说。想跟进就 Star thu-ml/SageAttention 看 release。