# 停用全部 LLM + 启动 ComfyUI（2026-09-13 23:30 CST）

> 操作机：DSH 机 192.168.31.76 ｜ 目标机：GPU 机 192.168.31.31（zywpc）
> 触发：用户「现在有了更多的模型和 lora，帮我先停用 LLM，启动 comfyui」
> 背景：16GB 显存，LLM 与 ComfyUI 必须错开（当前 LLM 侧已占 15.4GB/16GB）

## 一、切换前状态

| 项目 | 状态 |
|---|---|
| LM Studio 守护进程 | `llmster`（pid 416402）LISTEN `0.0.0.0:1234`，无已加载模型 |
| llama 服务 | **`llama-ko-ridge` active**，`llama-server`（pid 516767）LISTEN `0.0.0.0:8080` |
| 其余单元 | `lmstudio` / `llama-ridge` / `llama-ridge-long` / `llama-ko-ridge-fast` 均 inactive |
| ComfyUI | **未运行**（无 main.py 进程，8189 未监听） |
| 显存 | **15770 MiB / 16311 MiB**（几乎占满） |

## 二、执行步骤

1. **卸载 LM Studio 模型**：`lms unload --all` → `No models to unload.`（本就空闲，但守护进程占端口）
2. **停 4 个 llama 单元**：`bash ~/stop-ridge.sh` → `已停止全部 LLM 服务`，显存立刻回到 **18 MiB**
3. **停 LM Studio 守护进程**：`systemctl stop lmstudio` 为 no-op（单元本就 inactive，进程是独立守护）→ 改用
   `echo yueling408 | sudo -S pkill -f "llmste[r]"`
   - ⚠️ **踩坑记录**：第一次写成 `pkill -f "llmster"`，而**该 pkill 所在的 ssh 命令行文本本身就含 "llmster" 字样**，于是 pkill 把承载它的 shell 一起杀掉 → SSH 会话自断、后续输出全丢。**以后一律写 `llmste[r]`（方括号规避自匹配）**。
4. **启动 ComfyUI**（沿用 2026-09-10 验证过的**稳定档：LOW_VRAM + 无 sage attention**）：

   ```bash
   cd /home/zyw/ComfyUI && setsid nohup env \
     PYTORCH_CUDA_ALLOC_CONF=max_split_size_mb:512,expandable_segments:True \
     CUDA_VISIBLE_DEVICES=0 OMP_NUM_THREADS=4 \
     venv/bin/python main.py --listen 0.0.0.0 --port 8189 \
     --lowvram --force-fp16 --reserve-vram 1.0 --fast-disk \
     --cache-lru 20 --preview-method none \
     > /home/zyw/comfyui_8189_opt.log 2>&1 < /dev/null &
   ```

   - `setsid` + `< /dev/null` 确保 SSH 断开后进程不被 SIGHUP 带走（本轮实测：启动后重连仍在）。
   - **不加 `--use-sage-attention`**：SageAttention 与 GPU 掉总线（NV_ERR_GPU_IS_LOST）疑云未清，稳定优先。

## 三、切换后验证（全部通过 ✅）

| 检查项 | 结果 |
|---|---|
| llama-server / llmster | 均已消失，1234 与 8080 **无监听** |
| 显存 | 15770 MiB → **18 MiB**（停 LLM 后）；ComfyUI 起来后 **154 MiB** |
| 端口 8189 | `LISTEN 0.0.0.0:8189` |
| ComfyUI 版本 | **0.34.0**，frontend 1.51.9，templates 0.11.52 |
| system_stats | HTTP **200**；RAM 空闲 29.8 GB |
| 启动日志 | `To see the GUI go to: http://0.0.0.0:8189`，ComfyUI-Manager 缓存已更新 |
| 局域网入口 | DSH 机 `curl --noproxy '*' http://192.168.31.31:8189/` → **HTTP 200** |

访问入口：**http://192.168.31.31:8189**

## 四、当前 ComfyUI 资产（本轮"更多模型和 LoRA"实测）

- `models/checkpoints/`：**27 个，125 GB**（含 `sd1.5/` 2 个、`sdxl/` 5 个子目录）
- `models/loras/`：**71 个，25 GB**（含 `h3/`、`krea/`、`minimax/` 子目录）

按用途分布：

- **国风 / 亚洲写实人像**：GuoFeng3.2、GuoFeng3_Fix、JinXiaoMix-H、ChinaBeautyReal-2.0、AsiaFacemix-pruned-fix、Ancient-Chinese-head-portrait-AY、Chinese wedding v2.0 AY、机甲v3.0AY、V08_V08、Gf_style2、Ekmix-gen3
- **SDXL**：sd_xl_base_1.0、sd_xl_refiner_1.0、anythingxl.2RKM、kohakuXLBeta_beta7、nekorayxl_v06W3
- **SD1.5**：chilloutmix_NiPrunedFp32Fix、ghostmix_v20Bakedvae
- **写实/2.5D 通用**：realPony_cuteJpFixedNo03、henmixReal_v10、hans-v4.4、uberRealisticPornMerge_urpmv12、perfectWorld_v2Baked、neverendingDreamNED_bakedVae、dream2reality_v10、koreanstyle25D
- **视频（H3）**：`loras/h3/`、`loras/minimax/` 下 6 个 H3 turbo/FL2V/REF2V 加速 LoRA（含「H3 语音」相关）
- **LoRA 大类**：服饰（hanfu v2.9/v3.0-ming/v3.0-song、lolitaDress、Chinese style、吴带ribbon）、国风插画（MoXin、GuoFeng2/3.2_Lora）、人物 likeness（iu_V35、tifa、angelababy、liuyifei、aespa Karina、futuaner、naeun、nana）、Krea2 系列 5 个（realism_engine v3.1、masterpieces-v51、snofs、bloomgirls、filterbypass3）、风格类（C4D、pixel sprites、novice-sketch、hipoly3D、SDXL_MSPaint、xRayHentai）等

## 五、反向切换（要回去用 LLM 时）

1. 先停 ComfyUI（否则 16GB 显存冲突）：
   `pkill -f "venv/bin/python main[.]py"`（或 `pkill -f "main[.]py"`）
2. 再按需起 LLM：
   - Ridge 官方版 / KO 无审核版：`bash ~/switch-llm.sh [ridge-long|ridge-fast|ko-long|ko-fast]`（API `http://192.168.31.31:8080/v1`）
   - LM Studio：`echo yueling408 | sudo -S systemctl start lmstudio`，然后
     `lms load qwen3.8-9b-heretic-uncensored-nvfp4 --gpu max --context-length 262144 -y`（:1234）

## 六、备注

- ComfyUI **不会自启**（GPU 机断电/重启后需手动执行第二节第 4 步）；也无 systemd 单元，仍为 nohup 托管。
- 本机（DSH 机）访问局域网服务必须带 `--noproxy '*'`（本机 ALL_PROXY 会把局域网请求拐走）。
- 本次未改动 ComfyUI 版本/节点，仅做进程切换。
