2026-09-13-LLM全停与ComfyUI启动.md

停用全部 LLM + 启动 ComfyUI(2026-09-13 23:30 CST)

操作机:DSH 机 192.168.31.76 | 目标机:GPU 机 192.168.31.31(zywpc) 触发:用户「现在有了更多的模型和 lora,帮我先停用 LLM,启动 comfyui」 背景:16GB 显存,LLM 与 ComfyUI 必须错开(当前 LLM 侧已占 15.4GB/16GB)

一、切换前状态

项目状态
LM Studio 守护进程llmster(pid 416402)LISTEN 0.0.0.0:1234,无已加载模型
llama 服务llama-ko-ridge active,llama-server(pid 516767)LISTEN 0.0.0.0:8080
其余单元lmstudio / llama-ridge / llama-ridge-long / llama-ko-ridge-fast 均 inactive
ComfyUI未运行(无 main.py 进程,8189 未监听)
显存15770 MiB / 16311 MiB(几乎占满)

二、执行步骤

  1. 卸载 LM Studio 模型:lms unload --all → No models to unload.(本就空闲,但守护进程占端口)
  2. 停 4 个 llama 单元:bash ~/stop-ridge.sh → 已停止全部 LLM 服务,显存立刻回到 18 MiB
  3. 停 LM Studio 守护进程:systemctl stop lmstudio 为 no-op(单元本就 inactive,进程是独立守护)→ 改用 echo yueling408 | sudo -S pkill -f "llmste[r]"
    • ⚠️ 踩坑记录:第一次写成 pkill -f "llmster",而该 pkill 所在的 ssh 命令行文本本身就含 "llmster" 字样,于是 pkill 把承载它的 shell 一起杀掉 → SSH 会话自断、后续输出全丢。以后一律写 llmste[r](方括号规避自匹配)。
  4. 启动 ComfyUI(沿用 2026-09-10 验证过的稳定档:LOW_VRAM + 无 sage attention):
    cd /home/zyw/ComfyUI && setsid nohup env \
      PYTORCH_CUDA_ALLOC_CONF=max_split_size_mb:512,expandable_segments:True \
      CUDA_VISIBLE_DEVICES=0 OMP_NUM_THREADS=4 \
      venv/bin/python main.py --listen 0.0.0.0 --port 8189 \
      --lowvram --force-fp16 --reserve-vram 1.0 --fast-disk \
      --cache-lru 20 --preview-method none \
      > /home/zyw/comfyui_8189_opt.log 2>&1 < /dev/null &
    • setsid + < /dev/null 确保 SSH 断开后进程不被 SIGHUP 带走(本轮实测:启动后重连仍在)。
    • 不加 --use-sage-attention:SageAttention 与 GPU 掉总线(NV_ERR_GPU_IS_LOST)疑云未清,稳定优先。

三、切换后验证(全部通过 ✅)

检查项结果
llama-server / llmster均已消失,1234 与 8080 无监听
显存15770 MiB → 18 MiB(停 LLM 后);ComfyUI 起来后 154 MiB
端口 8189LISTEN 0.0.0.0:8189
ComfyUI 版本0.34.0,frontend 1.51.9,templates 0.11.52
system_statsHTTP 200;RAM 空闲 29.8 GB
启动日志To see the GUI go to: http://0.0.0.0:8189,ComfyUI-Manager 缓存已更新
局域网入口DSH 机 curl --noproxy '*' http://192.168.31.31:8189/ → HTTP 200

访问入口:http://192.168.31.31:8189

四、当前 ComfyUI 资产(本轮"更多模型和 LoRA"实测)

按用途分布:

五、反向切换(要回去用 LLM 时)

  1. 先停 ComfyUI(否则 16GB 显存冲突): pkill -f "venv/bin/python main[.]py"(或 pkill -f "main[.]py")
  2. 再按需起 LLM:
    • Ridge 官方版 / KO 无审核版:bash ~/switch-llm.sh [ridge-long|ridge-fast|ko-long|ko-fast](API http://192.168.31.31:8080/v1)
    • LM Studio:echo yueling408 | sudo -S systemctl start lmstudio,然后 lms load qwen3.8-9b-heretic-uncensored-nvfp4 --gpu max --context-length 262144 -y(:1234)

六、备注

下载此文件