dsh-local-llm-controller
在终端中运行以下命令:
dsh plugin install Lbunc/dsh-local-llm-controller
将以下提示词粘贴到 DeepSeek Harness 对话框中:
在终端执行 dsh plugin install Lbunc/dsh-local-llm-controller(源码地址:https://github.com/Lbunc/dsh-local-llm-controller),安装完成后重启 DSH Web 即可在设置页看到该插件。
插件介绍
在 DSH(DeepSeek Harness)中使用本地大模型,过去意味着反复打开终端启动 llama-server、手动配置端口与鉴权头、再到模型设置里逐条填写 Provider 信息。dsh-local-llm-controller 把整条链路收进设置页的一张卡片:填好 llama.cpp 目录和模型文件夹,点一次「启动」,本地模型立刻出现在会话底部可供选择;点「停止」即释放端口,状态、报错和最近日志都直接显示在卡片上,无需切换到终端查看。
v2.0 引入了 A / B 双模型槽位,每个槽位对应一个独立的 GGUF 文件夹,可同时管理两个模型。每个槽位提供 8 组可编辑启动参数(文本/视觉 × 快速/长上下文),支持逐行增删 -ngl、-t、-c、采样等参数;模型名与 Provider 键由所选 GGUF 文件名自动派生,后续可在「设置 → 模型」页重命名。视觉模式下,文件名含 mmproj 的投影器会被自动识别并挂载,省去手动拼接 CLI 参数的麻烦。
适合已经在本地跑 llama.cpp、拥有 Qwen、Llama、Mistral 等 GGUF 量化模型、并希望将它们无缝接入 DSH 会话的用户,尤其是需要同时管理多个模型、切换上下文长度或处理多模态视觉任务的场景。本插件只负责 DSH 与 llama.cpp 之间的连接与控制,不包含 llama-server 本体,也不负责下载模型权重。
截图预览
使用场景
- 在 DSH 会话中一键切换多个本地 GGUF 模型
- 按文本/视觉 × 短/长上下文快速调整启动参数
- 自动挂载 mmproj 跑视觉多模态本地推理
适合人员
- 已在本地运行 llama.cpp 的大模型爱好者
- 希望把本地模型无缝接入 DSH 会话的开发者
- 需要同时管理多个模型与上下文长度的 AI 工作流用户



