ComfyUI 自定义节点包,内置 ✨ DSH Agent Bridge(页面右上角浮动 AI 助手)+ 两个节点:
在 ComfyUI 页面右上角添加一个浮动按钮("一掌劈开天"),点开即一个轻量聊天窗口,直连本机运行的 DSH(DeepSeek Harness)本体(http://127.0.0.1:3080)——即完全体的 AI agent(同模型 + 全套工具:读文件、跑命令、调 MCP、控制远程 GPU 等),全程无需任何 API key。
- 聊天:消息经
POST /dsh/chat转发到 DSHsession.prompt;回复通过 websocket(/dsh/ws,代理到events.mux)实时流式显示,断线自动切换轮询兜底并重连 - 交互卡片:agent 的问题(
question/requested)与权限审批(approval/requested)以可点击卡片呈现(选项 / 允许一次 / 拒绝),回答经POST /dsh/respond转发回 DSH - 文件查看:
/dsh/view白名单内(工作区、ComfyUIoutput/input/user)的本地图片路径自动渲染为可点击缩略图,点开看大图 - 窗口:官方 DSH 图标、可拖动/缩放/最大化、位置记忆、最小化保留对话、Markdown 渲染(标题/表格/代码块/引用/链接)
- 零配置:模型凭据由 DSH 本体管理;只需 DSH 在
127.0.0.1:3080运行(例如npx @deepseek-ai/dsh web)。会话默认工作目录E:\ComfyTV,/dsh/view白名单可在dsh_bridge.py的allowed中调整
| 节点 | 分类 | 功能 |
|---|---|---|
| llama_mini | GC_Tool/llama_mini |
视觉/文本多模态 LLM 节点:接入 llama.cpp server,多图综合反推、纯文本生成 |
| unload_clear | GC_Tool |
通过 ComfyUI 的 POST /free 卸载指定机器(本机/远程)的模型并清缓存 |
cd ComfyUI/custom_nodes
git clone https://github.com/timwuyue/gc_tool.git重启 ComfyUI 即可(clone 后的 gc_tool 目录本身就是节点包)。依赖仅 requests + pillow + numpy(ComfyUI 自带,无需额外安装)。
连接自建的 llama.cpp server(OpenAI 兼容 API):
- 有图 = 多图直接一请求(指令前置、每图一条消息,模型直接看原图);无图 = 纯文本
- 配置:ComfyUI 设置面板(齿轮)→
Other → llama_mini:server 地址、模型名、token 上限、采样参数、缩放、日志开关等 - 面板开关:
seed(采样种子)、unload_before(执行前通过POST /free卸载指定 ComfyUI 的模型,防爆显存)、unload_after(执行后卸载 llama server 模型,需 router 模式) - 建议:llama.cpp server 用 router 模式启动(不带
-m,--models-dir加载),支持模型热加载/卸载
llama-server -m /path/to/Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q8_0.gguf \
--mmproj /path/to/mmproj-Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-BF16.gguf \
-c 128000 -ngl -1 --host 0.0.0.0 --port 8080不带 -m 启动,用 --models-dir 指向模型目录。多模态模型的主模型 + mmproj 必须放在同一子目录(子目录名即模型名),router 才会自动配对视觉能力:
llama-server --models-dir ./models -c 128000 -ngl -1 --host 0.0.0.0 --port 8080模型目录结构:
models/
└── Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q8_0/
├── Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q8_0.gguf
└── mmproj-Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-BF16.gguf
Router 模式下模型按需自动加载;llama_mini 的 unload_after(POST /models/unload 卸载)和 model_path(自动重新加载)依赖此模式。
| 参数 | 说明 |
|---|---|
-c N |
上下文长度(如 128000) |
-ngl N |
GPU 层数;-1 = 全部层上 GPU,0 = 纯 CPU |
--host 0.0.0.0 |
监听所有网卡(远程访问需要) |
--port N |
端口(llama_mini 设置的 server_url 需对应) |
--reasoning off |
关闭思考模式(Qwen3 系列模型) |
--api-key xxx |
开启鉴权(llama_mini 设置的 api_key 对应) |
--sleep-idle-seconds N |
空闲 N 秒自动卸载模型(单模型模式也可用;全自动,但下次请求需等待重新加载) |
Windows 下可执行文件为 llama-server.exe,--models-dir 用绝对路径(如 D:\ComfyUI\models\LLM\router-models)。
参数 unload_models(卸载模型)+ clear_cache(清缓存),等价于 ComfyUI 菜单"编辑 → 卸载模型 / 卸载模型和执行缓存"。带 * 透传输入/输出,可插在 workflow 任意位置。
- 节点默认配置针对
Qwen3.5-9B-Uncensored-HauhauCS-Aggressive-Q8_0多模态模型,可通过设置面板修改 - 详细用法见
llama_mini/README.md